

MiniMax-Music3
#6 in KI-MusikgenerierungMinimax · v3 · 2× · zuletzt 17. Aug. 2026
MiniMax-Music3 (auch als "Music 3.0" bezeichnet) ist ein von MiniMax entwickeltes KI-Musikgenerierungsmodell, das aus Songtext und einer Musikbeschreibung komplette Songs von bis zu fünf Minuten Länge erzeugt, inklusive Struktur (Intro, Strophe, Refrain, Bridge etc.), Gesang und Arrangement. Es basiert auf einer hierarchischen Architektur mit einem 8B-Parameter-Global-LLM für die langfristige musikalische Struktur und einem 0,6B-Parameter-Local-LLM für akustische Details, kombiniert mit einem Flow-Matching- und Flow-VAE-Synthesesystem. Die Modellgewichte sind unter einer eigenen Community License offen verfügbar (Hugging Face, GitHub, ModelScope), zusätzlich existiert eine gehostete API-Variante. Ausgabe erfolgt als 32-kHz-16-Bit-Stereo-Audio.
Features
| Echtzeit-Streaming | Lokale Inferenz unterstützt aktuell nur Nicht-Streaming-Generierung; gehostete API bietet optionales Streaming (nur Hex-Ausgabe) |
| Lizenz | MiniMax-Music3 Community License (kommerzielle Nutzung erlaubt, ab 20 Mio. USD Jahresumsatz separate schriftliche Genehmigung nötig, Pflicht zur Markennennung) |
| Plattform | Gehostete Music Generation API sowie herunterladbare Gewichte (Hugging Face, GitHub, ModelScope) für lokale Inferenz via SGLang-Omni, diffusers oder ComfyUI |
| Preis | 0,15 $ pro API-Generierung (gehostet); kostenlose Variante music-3.0-free verfügbar; Modellgewichte kostenlos unter Community License |
| Release-Datum | API: 16. Juli 2026; offene Gewichte: 13. August 2026 |
| Sprachen | Unterstützt Songtexte in mehreren Sprachen ('lyrics in many languages') |