

Whistle
#9 in Transkription (STT)Unknown · seit 2. Oktober 2026 · 2× · zuletzt 11. Okt. 2026
40
Momentum
Whistle ist ein Speech-to-Text-Modell (STT) von Cactus Compute, veröffentlicht am 2. Oktober 2026 als einzelne 16,9-MB-Datei, die auf der CPU ohne Abhängigkeiten läuft. Es transkribiert bis zu 30 Sekunden 16-kHz-Mono-Audio pro Durchlauf in sieben Sprachen und liefert Wort-Zeitstempel sowie Sprach-Embeddings. Die Benchmarks stammen laut Quellen vom Hersteller und sind nicht unabhängig verifiziert.
Momentum-Verlauf
13.07.11.10.
Features
| Echtzeit-Streaming | Nicht unterstützt (Streaming-Ausgabe laut Quelle geplant) |
| Latenz | 11,1 ms Time-to-first-token (10 s Audio, Apple M4 Pro, Herstellerangabe) |
| Lizenz | Apache-2.0 |
| Plattform | 17 Plattformen, u.a. macOS, Linux (x86-64, ARM64, ARMv7, RISC-V, MIPS32), Windows x64/ARM, Android, iOS, watchOS, tvOS, Browser (WebAssembly), WASI |
| Preis | Kostenlos (laut Drittquelle; keine offizielle Preisseite gefunden) |
| Release-Datum | 2. Oktober 2026 |
| Sprachen | Englisch, Deutsch, Französisch, Spanisch, Italienisch, Niederländisch, Polnisch (Spracherkennung automatisch oder manuell wählbar) |