Doubao
Aug 2023
Doubao Seed 2.0
Feb 2026
Seedance 2.5
Jun 2026
Seed 2.1 Pro
Jun 2026
Seedream 5.0 Pro
Jul 2026
SeedRealtime
Aug 2026
2024
2025
2026
Für Präsentation und Weitergabe
Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.
Bild
Alle Releases
Kategorie
Zu dieser Auswahl gibt es keinen Eintrag.
-
Doubao Sprache
- ByteDances KI-Assistent, der später Chinas meistgenutzte KI-App wurde.
- Startete im August 2023 zunächst per Einladung in China.
- Zeigte ByteDances Plan, Chat-KI in seine Massenprodukte zu bringen.
-
Seed-TTS Audio
- Familie autoregressiver TTS-Modelle nahe an menschlicher Sprache.
- Klonte Stimmen und steuerte Emotion sowie Sprechstil.
- Zielte auf hochwertige, vielseitige Sprachsynthese.
-
Seed-Music Audio
- Einheitliches Framework für kontrollierte, hochwertige Musik.
- Kombinierte autoregressive Modelle und Diffusion.
- Erlaubte Erzeugung samt Postproduktion und Editing.
-
Doubao 1.5 Pro Sprache
- MoE-Modell mit Deep-Thinking-Modus, das o1 bei AIME forderte.
- Auf GPT-4o-Niveau, aber drastisch günstiger im Betrieb.
- Trieb Chinas populärste KI-App, ByteDances Doubao, an.
-
Seedream 3.0 Bild
- ByteDances zweisprachige Bild-KI mit nativer 2K-Ausgabe.
- Erzeugte 1K-Bilder in rund drei Sekunden bei starker Ästhetik.
- Zeitweise an der Spitze der Artificial-Analysis-Rangliste.
-
Seedance 1.0 Video
- ByteDances Video-KI mit 1080p und nahtlosen Multi-Shot-Übergängen.
- Erzeugte fünf Sekunden Video in rund 41 Sekunden.
- Lag in Benchmarks bei Text- und Bild-zu-Video vorn.
-
Seedream 4.0 Bild
- Vereinte Bilderzeugung und Bildbearbeitung in einem multimodalen Modell.
- Hohe Auflösung, starke Konsistenz und schnelle Generierung.
- Spitzenplätze in unabhängigen Bild-Benchmarks.
-
Doubao Seed 2.0 Multimodal
- Neue Foundation-Familie hinter der Doubao-App, mit langkettigem Reasoning und multimodalem Verstehen.
- Führende Ergebnisse in Multimodal-, Mathematik- und Coding-Benchmarks bei rund einer Größenordnung niedrigeren Token-Preisen.
-
Seedance 2.5 Video
- Erzeugt native 30-Sekunden-Videos in einem Durchgang, ohne einzelne Clips zusammenzusetzen.
- Verarbeitet bis zu 50 multimodale Referenzen gleichzeitig, darunter Bilder, Clips und Audio.
-
Seed 2.1 Pro Multimodal
- ByteDance zeigt sein stärkstes Modell auf der Konferenz Volcano Engine FORCE in Peking.
- Das Modell sieht zwei Stunden Video am Stück und schneidet es anschließend.
- ByteDance nennt bessere Werte als Claude Opus 4.6 bei Code, Agenten und Multimodalität, zu rund 80 Prozent geringeren Gesamtkosten.
-
Seed 2.1 Turbo Multimodal
- Die schnelle Variante von Seed 2.1 zielt auf hohe Anfragezahlen im Betrieb.
- Sie liest 262.144 Token und nimmt Text, Bild und Video entgegen.
- Der Preis liegt bei 0,50 Dollar je Million Eingabe-Token und 2,50 Dollar je Million Ausgabe-Token.
-
Seedream 5.0 Pro Bild
- Multimodales Bildmodell mit präziserem interaktiven Bearbeiten, besserer Text-Bild-Treue und realistischer Porträt-Textur.
- Versteht und erzeugt Text nativ in über zehn Sprachen.
-
SeedRealtime Audio
- Erstes Modell von ByteDance, das gleichzeitig sieht, hört und spricht.
- Es ersetzt die übliche Kette aus Spracherkennung, Bildverständnis und Sprachausgabe durch ein einziges Modell.
- Es achtet auf Pausen, Sprecher und Hintergrundgeräusche und entscheidet daraus, wann eine Antwort passt.
Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Aug 2026.