

Krisp · seit Juni 2019 (erste Produktveröffentlichung als Noise-Cancellation-App); seitdem kontinuierlich um Transkriptions- und Voic · 3× · zuletzt 30. Juni 2026
Krisp ist eine Voice-AI-Plattform des 2017 in Armenien gegründeten Unternehmens Krisp Technologies (Hauptsitz Berkeley, USA), die ursprünglich als reine Geräuschunterdrückungssoftware startete. Heute umfasst das Produkt neben Echtzeit-Rauschunterdrückung auch einen KI-Meeting-Assistenten mit Transkription, Zusammenfassungen und Echtzeit-Akzentumwandlung für Desktop-, Mobil- und Browser-Plattformen. Die Software läuft als virtuelles Audiogerät zwischen Mikrofon/Lautsprecher und Kommunikations-Apps wie Zoom, Teams oder Google Meet und verarbeitet Audio größtenteils lokal auf dem Gerät. Preislich reicht das Angebot von einem kostenlosen Tarif mit Nutzungslimits bis zu Business- und Enterprise-Plänen für Unternehmen und Call-Center.
Features
| Echtzeit-Streaming | Ja, Echtzeit-Rauschunterdrückung, Akzentumwandlung, Sprachübersetzung und Live-Transkription während laufender Calls |
| Latenz | Ca. 200 ms Latenz für Akzentumwandlung, unter 20 ms für Basis-Rauschunterdrückung |
| Latenz (ms) | ~20 ms Mindestlatenz für das Noise-Cancellation-/Voice-Isolation-Modell (VIVA SDK, CPU-basiert, Echtzeit-Audiostrom) |
| Modellgröße (Parameterzahl) | Turn-Taking-Modell: 6 Mio. Parameter (audio-only); allgemein werden "sehr kleine, CPU-basierte KI-Modelle" eingesetzt (keine veröffentlichte Parameterzahl für das STT-Modell selbst) |
| Plattform | Desktop (Windows, Mac, Linux), Web/Browser, iOS und Android; integriert sich in Zoom, Google Meet, Microsoft Teams, Slack und 800+ weitere Apps |
| Preis | Kostenlos: 60 Min./Tag Rauschunterdrückung, unbegrenzte Transkription; Pro: 8 $/Monat (jährlich) bzw. 12–16 $/Monat; Business: 15 $/Nutzer/Monat (jährlich); Enterprise: individuell |
| Release-Datum | Erstveröffentlichung Juni 2019 als KI-Rauschunterdrückungs-App; Unternehmen gegründet 2017 |
| Sprachen | Meeting-Transkription unterstützt 16-17 Sprachen (u.a. Englisch, Spanisch, Französisch, Deutsch, Russisch, Italienisch, Niederländisch, Polnisch, Portugiesisch, Hindi, Koreanisch); Voice Translation unterstützt 80+ Sprachen |
| Voice-Cloning | Kein Voice-Cloning-Feature; stattdessen Deepfake-Erkennung zum Schutz vor synthetischen/geklonten Stimmen im Call-Center-Produkt |