Fish Audio S2-Pro
Mär 2026
Fish Audio S2.1 Pro
Jul 2026
Für Präsentation und Weitergabe
Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.
Bild
Alle Releases
Zu dieser Auswahl gibt es keinen Eintrag.
-
Fish Audio S2-Pro Audio
- Quelloffenes Sprachsynthese-Modell samt Gewichten, Trainings- und Inferenzcode, veröffentlicht am 9. März 2026 auf GitHub und Hugging Face.
- Trainiert auf über 10 Millionen Stunden Audio in rund 50 Sprachen, mit doppelt autoregressiver Architektur und Feinabstimmung per Reinforcement Learning.
- Mehr als 15.000 Tags steuern Gefühl, Tonfall, Lautstärke und Rhythmus; in Blindtests schlug es mehrere geschlossene Systeme.
-
Fish Audio S2.1 Pro Audio
- Sprachsynthese für 83 Sprachen mit Stimmklonen aus 15 Sekunden Material; Gefühl, Betonung und Effekte wie Lachen oder Flüstern steuert man per Klammer-Syntax direkt im Text.
- Die Zeit bis zum ersten Ton sank auf rund 70 Millisekunden, der Durchsatz unter Last verdoppelte sich gegenüber S2 Pro.
- Im direkten Hörvergleich lag es in 61 Prozent der Fälle vor dem Vorgänger. Zum Start am 28. Juli 2026 war die API kostenlos nutzbar, begleitet von 52 Millionen Dollar Startfinanzierung.
Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Jul 2026.