Seed-TTS
Jun 2024
Seed-Music
Sep 2024
Seed 2.1 Pro
Jun 2026
Seed 2.1 Turbo
Jun 2026
SeedRealtime
Aug 2026
2025
2026
Für Präsentation und Weitergabe
Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.
Bild
Alle Releases
Zu dieser Auswahl gibt es keinen Eintrag.
-
Seed-TTS Audio
- Familie autoregressiver TTS-Modelle nahe an menschlicher Sprache.
- Klonte Stimmen und steuerte Emotion sowie Sprechstil.
- Zielte auf hochwertige, vielseitige Sprachsynthese.
-
Seed-Music Audio
- Einheitliches Framework für kontrollierte, hochwertige Musik.
- Kombinierte autoregressive Modelle und Diffusion.
- Erlaubte Erzeugung samt Postproduktion und Editing.
-
Seed 2.1 Pro Multimodal
- ByteDance zeigt sein stärkstes Modell auf der Konferenz Volcano Engine FORCE in Peking.
- Das Modell sieht zwei Stunden Video am Stück und schneidet es anschließend.
- ByteDance nennt bessere Werte als Claude Opus 4.6 bei Code, Agenten und Multimodalität, zu rund 80 Prozent geringeren Gesamtkosten.
-
Seed 2.1 Turbo Multimodal
- Die schnelle Variante von Seed 2.1 zielt auf hohe Anfragezahlen im Betrieb.
- Sie liest 262.144 Token und nimmt Text, Bild und Video entgegen.
- Der Preis liegt bei 0,50 Dollar je Million Eingabe-Token und 2,50 Dollar je Million Ausgabe-Token.
-
SeedRealtime Audio
- Erstes Modell von ByteDance, das gleichzeitig sieht, hört und spricht.
- Es ersetzt die übliche Kette aus Spracherkennung, Bildverständnis und Sprachausgabe durch ein einziges Modell.
- Es achtet auf Pausen, Sprecher und Hintergrundgeräusche und entscheidet daraus, wann eine Antwort passt.
Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Aug 2026.