Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
cartesia

Cartesia · v3.6 · seit 17. August 2026 · 2× · zuletzt 20. Aug. 2026

36
Momentum

Sonic-3.6 ist das aktuelle Echtzeit-Text-to-Speech-Modell von Cartesia, veröffentlicht am 17. August 2026 als Nachfolger von Sonic-3.5. Das Modell basiert auf State-Space-Modellen statt Transformern und erreicht laut Anbieter eine Sprachlatenz von unter 90ms bis zum ersten Audio-Output. Es unterstützt 44 Sprachen, bietet Instant- und Professional-Voice-Cloning und führt aktuell beide Artificial-Analysis-Speech-Arena-Leaderboards (Provider Voice und Controlled Voice) an. Das Modell ist als gehostete API in der Beta-Phase verfügbar, nicht als selbst-hostbare Gewichte.

Momentum-Verlauf
22.05.20.08.

Features

Echtzeit-StreamingJa, Streaming-TTS-Modell auf Basis von State Space Models statt Transformern
LatenzUnter 90ms Time-to-First-Audio (Herstellerangabe)
LizenzKommerzielle Nutzung ab Pro-Plan ($5/Monat) enthalten; Free-Tier ohne Kommerzlizenz
PlattformGehostete API (Beta), kein Self-Hosting der Modellgewichte
PreisAb $5/Monat (Pro-Plan, Commercial License); Free-Tier $0 (20.000 Credits/Monat, nicht kommerziell); Startup $49/Monat; Scale $299/Monat
Release-Datum17. August 2026
Sprachen44 Sprachen
Voice-CloningInstant Voice Cloning (ab Pro-Plan) und Professional Voice Cloning (ab Startup-Plan) verfügbar

Weitere Produkte in dieser Kategorie: Sprachsynthese (TTS)

Belege (2)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.