

Stable Audio 3.0
#15 in KI-MusikgenerierungStability Ai · v3.0 · 5× · zuletzt 30. Juni 2026
Stable Audio 3.0 ist eine im Mai 2026 von Stability AI veröffentlichte Familie generativer Audio-Modelle (Small SFX, Small, Medium, Large) auf Basis latenter Diffusion mit einem neuartigen semantisch-akustischen Autoencoder. Die Modelle erzeugen Musik und Soundeffekte aus Text-Prompts mit variabler Länge von bis zu rund 6 Minuten 20 Sekunden und unterstützen Audio-Inpainting sowie Fortsetzung bestehender Clips. Drei der vier Modelle (Small SFX, Small, Medium) sind offene Gewichte auf Hugging Face verfügbar, das Flaggschiff Large ist nur über die Stability-AI-API bzw. Enterprise-Self-Hosting nutzbar. Alle Modelle wurden ausschließlich auf lizenzierten bzw. Creative-Commons-Daten (u.a. AudioSparx, Freesound) trainiert; Stimmklonen oder Gesangserzeugung werden nicht unterstützt.