Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
krisp

Krisp · seit Juni 2019 (erste Produktveröffentlichung als Noise-Cancellation-App); seitdem kontinuierlich um Transkriptions- und Voic · 3× · zuletzt 30. Juni 2026

1
Momentum

Krisp ist eine Voice-AI-Plattform des 2017 in Armenien gegründeten Unternehmens Krisp Technologies (Hauptsitz Berkeley, USA), die ursprünglich als reine Geräuschunterdrückungssoftware startete. Heute umfasst das Produkt neben Echtzeit-Rauschunterdrückung auch einen KI-Meeting-Assistenten mit Transkription, Zusammenfassungen und Echtzeit-Akzentumwandlung für Desktop-, Mobil- und Browser-Plattformen. Die Software läuft als virtuelles Audiogerät zwischen Mikrofon/Lautsprecher und Kommunikations-Apps wie Zoom, Teams oder Google Meet und verarbeitet Audio größtenteils lokal auf dem Gerät. Preislich reicht das Angebot von einem kostenlosen Tarif mit Nutzungslimits bis zu Business- und Enterprise-Plänen für Unternehmen und Call-Center.

Momentum-Verlauf
19.05.17.08.

Features

Echtzeit-StreamingJa, Echtzeit-Rauschunterdrückung, Akzentumwandlung, Sprachübersetzung und Live-Transkription während laufender Calls
LatenzCa. 200 ms Latenz für Akzentumwandlung, unter 20 ms für Basis-Rauschunterdrückung
Latenz (ms)~20 ms Mindestlatenz für das Noise-Cancellation-/Voice-Isolation-Modell (VIVA SDK, CPU-basiert, Echtzeit-Audiostrom)
Modellgröße (Parameterzahl)Turn-Taking-Modell: 6 Mio. Parameter (audio-only); allgemein werden "sehr kleine, CPU-basierte KI-Modelle" eingesetzt (keine veröffentlichte Parameterzahl für das STT-Modell selbst)
PlattformDesktop (Windows, Mac, Linux), Web/Browser, iOS und Android; integriert sich in Zoom, Google Meet, Microsoft Teams, Slack und 800+ weitere Apps
PreisKostenlos: 60 Min./Tag Rauschunterdrückung, unbegrenzte Transkription; Pro: 8 $/Monat (jährlich) bzw. 12–16 $/Monat; Business: 15 $/Nutzer/Monat (jährlich); Enterprise: individuell
Release-DatumErstveröffentlichung Juni 2019 als KI-Rauschunterdrückungs-App; Unternehmen gegründet 2017
SprachenMeeting-Transkription unterstützt 16-17 Sprachen (u.a. Englisch, Spanisch, Französisch, Deutsch, Russisch, Italienisch, Niederländisch, Polnisch, Portugiesisch, Hindi, Koreanisch); Voice Translation unterstützt 80+ Sprachen
Voice-CloningKein Voice-Cloning-Feature; stattdessen Deepfake-Erkennung zum Schutz vor synthetischen/geklonten Stimmen im Call-Center-Produkt

Weitere Produkte in dieser Kategorie: Transkription (STT)

Belege (3)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.