

Stability Audio 3.0
#17 in KI-MusikgenerierungStability Ai · v3.0 · 3× · zuletzt 30. Juni 2026
Stability Audio 3.0 (offiziell "Stable Audio 3.0") ist eine von Stability AI im Mai 2026 veröffentlichte Modellfamilie zur KI-Audiogenerierung, bestehend aus vier Modellen: Small SFX, Small, Medium und Large. Die Modelle erzeugen instrumentale Musik, Sounddesign und Soundeffekte aus Textprompts, mit variabler Länge von wenigen Sekunden bis zu über sechs Minuten bei Medium und Large. Drei der vier Modelle (Small SFX, Small, Medium) sind als offene Gewichte auf Hugging Face verfügbar, während Large nur über die Stability-AI-API bzw. Enterprise-Self-Hosting zugänglich ist. Das Modell generiert keine verständlichen Gesangsstimmen oder Lyrics und bietet kein Voice-Cloning; die Trainingsdaten stammen vollständig aus lizenzierten Quellen (u.a. AudioSparx, Freesound).
Features
| Echtzeit-Streaming | Nicht als Feature dokumentiert; Small-Modelle laufen on-device (Smartphones/Laptops) für lokale Generierung ohne Cloud-Anbindung |
| Latenz | Large-Modell für 'low-latency generation at high volume' auf Musikplattformen konzipiert; keine konkrete Zeitangabe veröffentlicht |
| Lizenz | Stability AI Community License (freie Kommerzialisierung der Outputs); Enterprise License Pflicht für Organisationen mit über $1 Mio. Jahresumsatz |
| Plattform | Hugging Face (Small SFX, Small, Medium als offene Gewichte), Stability AI API und Enterprise-Self-Hosting (Large), Web-App stableaudio.com, ComfyUI-Integration |
| Preis | Keine offizielle Preisliste für Stable Audio 3.0 veröffentlicht; API nutzt Credit-System (1 Credit = $0,01), Web-App bietet kostenlose Testcredits |
| Release-Datum | 20. Mai 2026 |
| Voice-Cloning | Nicht unterstützt – Modellfamilie ist auf Instrumentalmusik und Soundeffekte ausgelegt, keine verständlichen Gesangsstimmen oder Voice-Cloning |