Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
fish-audio

Fish Audio S2.1 Pro

#2 in Sprachsynthese (TTS)

Fish Audio · pro · 3× · zuletzt 30. Juli 2026

75
Momentum

Fish Audio S2.1 Pro ist ein produktionsreifes Text-to-Speech-Modell (Sprachsynthese) von Fish Audio, das im Juni/Juli 2026 als Nachfolger von S2-Pro veröffentlicht wurde. Das Modell unterstützt 83 Sprachen, bietet Voice-Cloning aus kurzen Referenzaufnahmen sowie wortgenaue Steuerung von Emotion und Prosodie über natürlichsprachliche Tags, und ist auf niedrige Latenz für Echtzeit-Dialoganwendungen ausgelegt. Der Zugang erfolgt über die Fish Audio Cloud-API, wobei eine kostenlose Entwicklerstufe mit gleicher Modellqualität ohne SLA-Garantien und eine kostenpflichtige Produktionsstufe mit Latenz- und Verfügbarkeitsgarantien angeboten werden.

Momentum-Verlauf
01.05.30.07.

Features

Echtzeit-StreamingJa, WebSocket-Streaming für Echtzeit-Konversations-Sprachausgabe konzipiert
Latenz~70–100 ms Time-to-First-Audio (TTFA) bei Einzelanfrage
LizenzProprietäres, gehostetes Modell über API; offene Vorgängermodelle (S2) unter Fish Audio Research License mit separater kommerzieller Lizenz für Eigen-Hosting
PlattformFish Audio Cloud-API (REST/WebSocket, msgpack), Python- & TypeScript-SDKs, Web-Playground unter fish.audio
PreisKostenlose API bis 24. Juli 2026 (bzw. laut anderer Quelle bis 31. August 2026); danach Pay-as-you-go ab $15 / 1M Zeichen; Abo-Pläne $0–$749/Monat
Release-DatumÖffentlicher Launch 28. Juli 2026; freie API-Verfügbarkeit ab Juni 2026 angekündigt
Sprachen83 Sprachen
Voice-CloningJa, Voice-Cloning aus 5 Sekunden Referenzaudio über API

Weitere Produkte in dieser Kategorie: Sprachsynthese (TTS)

Belege (3)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.