Anbieter

ByteDance

13 Releases · Aug 2023 bis Aug 2026 · im Schnitt alle 3 Monate · 5 Kategorien

Zurück zur Übersicht

Doubao Aug 2023 Doubao Seed 2.0 Feb 2026 Seedance 2.5 Jun 2026 Seed 2.1 Pro Jun 2026 Seedream 5.0 Pro Jul 2026 SeedRealtime Aug 2026 2024 2025 2026

Für Präsentation und Weitergabe

Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.

Bild
HTML herunterladen

Alle Releases

Kategorie
  1. Doubao Sprache

    • ByteDances KI-Assistent, der später Chinas meistgenutzte KI-App wurde.
    • Startete im August 2023 zunächst per Einladung in China.
    • Zeigte ByteDances Plan, Chat-KI in seine Massenprodukte zu bringen.

    Reihe Doubao

  2. Seed-TTS Audio

    • Familie autoregressiver TTS-Modelle nahe an menschlicher Sprache.
    • Klonte Stimmen und steuerte Emotion sowie Sprechstil.
    • Zielte auf hochwertige, vielseitige Sprachsynthese.

    Reihe Seed

  3. Seed-Music Audio

    • Einheitliches Framework für kontrollierte, hochwertige Musik.
    • Kombinierte autoregressive Modelle und Diffusion.
    • Erlaubte Erzeugung samt Postproduktion und Editing.

    Reihe Seed

  4. Doubao 1.5 Pro Sprache

    • MoE-Modell mit Deep-Thinking-Modus, das o1 bei AIME forderte.
    • Auf GPT-4o-Niveau, aber drastisch günstiger im Betrieb.
    • Trieb Chinas populärste KI-App, ByteDances Doubao, an.

    Reihe Doubao

  5. Seedream 3.0 Bild

    • ByteDances zweisprachige Bild-KI mit nativer 2K-Ausgabe.
    • Erzeugte 1K-Bilder in rund drei Sekunden bei starker Ästhetik.
    • Zeitweise an der Spitze der Artificial-Analysis-Rangliste.

    Reihe Seedream

  6. Seedance 1.0 Video

    • ByteDances Video-KI mit 1080p und nahtlosen Multi-Shot-Übergängen.
    • Erzeugte fünf Sekunden Video in rund 41 Sekunden.
    • Lag in Benchmarks bei Text- und Bild-zu-Video vorn.

    Reihe Seedance

  7. Seedream 4.0 Bild

    • Vereinte Bilderzeugung und Bildbearbeitung in einem multimodalen Modell.
    • Hohe Auflösung, starke Konsistenz und schnelle Generierung.
    • Spitzenplätze in unabhängigen Bild-Benchmarks.

    Reihe Seedream

  8. Doubao Seed 2.0 Multimodal

    • Neue Foundation-Familie hinter der Doubao-App, mit langkettigem Reasoning und multimodalem Verstehen.
    • Führende Ergebnisse in Multimodal-, Mathematik- und Coding-Benchmarks bei rund einer Größenordnung niedrigeren Token-Preisen.

    Reihe Doubao

  9. Seedance 2.5 Video

    • Erzeugt native 30-Sekunden-Videos in einem Durchgang, ohne einzelne Clips zusammenzusetzen.
    • Verarbeitet bis zu 50 multimodale Referenzen gleichzeitig, darunter Bilder, Clips und Audio.

    Reihe Seedance

  10. Seed 2.1 Pro Multimodal

    • ByteDance zeigt sein stärkstes Modell auf der Konferenz Volcano Engine FORCE in Peking.
    • Das Modell sieht zwei Stunden Video am Stück und schneidet es anschließend.
    • ByteDance nennt bessere Werte als Claude Opus 4.6 bei Code, Agenten und Multimodalität, zu rund 80 Prozent geringeren Gesamtkosten.

    Reihe Seed Quelle datanorth.ai

  11. Seed 2.1 Turbo Multimodal

    • Die schnelle Variante von Seed 2.1 zielt auf hohe Anfragezahlen im Betrieb.
    • Sie liest 262.144 Token und nimmt Text, Bild und Video entgegen.
    • Der Preis liegt bei 0,50 Dollar je Million Eingabe-Token und 2,50 Dollar je Million Ausgabe-Token.

    Reihe Seed Quelle openrouter.ai

  12. Seedream 5.0 Pro Bild

    • Multimodales Bildmodell mit präziserem interaktiven Bearbeiten, besserer Text-Bild-Treue und realistischer Porträt-Textur.
    • Versteht und erzeugt Text nativ in über zehn Sprachen.

    Reihe Seedream

  13. SeedRealtime Audio

    • Erstes Modell von ByteDance, das gleichzeitig sieht, hört und spricht.
    • Es ersetzt die übliche Kette aus Spracherkennung, Bildverständnis und Sprachausgabe durch ein einziges Modell.
    • Es achtet auf Pausen, Sprecher und Hintergrundgeräusche und entscheidet daraus, wann eine Antwort passt.

    Reihe Seed Quelle technode.com

Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Aug 2026.