

S2.1 Pro
#3 in Sprachsynthese (TTS)Fish Audio · pro · 3× · zuletzt 30. Juli 2026
S2.1 Pro ist das aktuelle Flaggschiff-Text-to-Speech-Modell von Fish Audio, das auf dem offen gewichteten S2-Pro-Modell aufbaut und über die Fish Audio API sowohl als kostenpflichtige Produktionsversion als auch als kostenlose Entwicklerversion (s2.1-pro-free) verfügbar ist. Das Modell unterstützt 83 Sprachen, Voice-Cloning aus wenigen Sekunden Referenzaudio, Echtzeit-Streaming mit niedriger Latenz sowie wortgenaue Steuerung von Emotion und Sprechweise über natürliche Textmarker (Tags). Es wird öffentlich am 28. Juli 2026 im Rahmen einer Finanzierungsrunde offiziell gelauncht, nachdem es zuvor bereits im Juni 2026 als kostenlose API angekündigt wurde.