Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
stability-ai

Stability Ai · seit 2024-06-05 · 2× · zuletzt 30. Juni 2026

1
Momentum

Stable Audio Open ist ein Open-Source-Text-zu-Audio-Modell von Stability AI, das im Juni 2024 veröffentlicht wurde. Es erzeugt variable-length Stereo-Audioclips von bis zu 47 Sekunden Länge bei 44,1 kHz, spezialisiert auf Sound-Effekte, Drumbeats, Instrument-Riffs und Produktionselemente statt vollständige Songs oder Gesang. Das Modell basiert auf einer latenten Diffusionsarchitektur mit Transformer-Komponenten und T5-Textkonditionierung und wurde ausschließlich mit Creative-Commons-lizenzierten Aufnahmen von Freesound und Free Music Archive trainiert. Die Modellgewichte sind auf Hugging Face verfügbar und stehen unter der Stability AI Community License für Forschung, nicht-kommerzielle sowie limitierte kommerzielle Nutzung.

Momentum-Verlauf
19.05.17.08.

Features

Echtzeit-StreamingKein Echtzeit-Streaming; Generierung erfolgt offline/batch (max. 47s Ausgabe)
LatenzAutoencoder-Latent-Rate von 21,5 Hz für Musik- und Audiogenerierung
LizenzStability AI Community License (Forschung, nicht-kommerziell, limitiert kommerziell)
Max. Musikdauer (Sekunden)47 Sekunden (variables Stereo-Audio bei 44,1 kHz)
PlattformModellgewichte auf Hugging Face; Code/Training über stable-audio-tools auf GitHub
PreisModellgewichte kostenlos; kommerzielle Nutzung frei bis 1 Mio. USD Jahresumsatz, darüber Enterprise-Lizenz nötig
Release-Datum5. Juni 2024 (Ankündigung); Forschungspaper am 19./22. Juli 2024
SprachenNur Englisch (Prompt-Verständnis), andere Sprachen mit schlechterer Performance
Unterstützte EingabeformateTexteingabe (Text-Prompts auf Englisch) mit optionaler Zeitkonditionierung (seconds_start, seconds_total); Audio-Variationen und Style-Transfer von Audio-Samples ebenfalls möglich
Voice-CloningNicht unterstützt – Modell kann keine realistischen Vocals/Gesang erzeugen
Vokal-/Gesang-QualitätNicht unterstützt – das Modell ist nicht in der Lage, realistische Vokale oder verständliche Sprache/Gesang zu erzeugen

Weitere Produkte in dieser Kategorie: KI-Musikgenerierung

Belege (2)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.