

Ming-Image-0.1-Design
#16 in Text-zu-BildInclusionai · v0.1 · design · 2× · zuletzt 25. Sept. 2026
Ming-Image-0.1-Design ist ein von inclusionAI (Ant Group) entwickeltes Text-zu-Bild-Modell mit 6 Milliarden Parametern, das speziell für textreiche visuelle Designs wie UI-Screens, Infografiken, Poster und Dashboards ausgelegt ist. Es generiert vollständige Bildkompositionen inklusive lesbarem Text und unterstützt native RGBA-Ausgabe mit transparentem Hintergrund. Das Modell wurde am 22. September 2026 unter MIT-Lizenz als Open-Weight-Modell auf Hugging Face, GitHub und ModelScope veröffentlicht und erreicht laut Herstellerangaben Platz 1 unter offenen Modellen im UI/UX-Design-Leaderboard von Artificial Analysis. Es gibt kein gehostetes API-Angebot; Nutzung erfordert eigene Inferenz-Infrastruktur (empfohlen: eine CUDA-GPU mit 80 GiB VRAM).
Features
| Fine-tuning | Nicht offiziell dokumentiert; als offenes Gewichtsmodell grundsätzlich fine-tuning-fähig (im Gegensatz zu geschlossenen Modellen) |
| Generierungszeit | 12 Sampling-Schritte, CFG 1.0, BF16-Präzision; ca. 340s (warm) bis 608s (kalt) auf getesteter Hardware bei 2048px |
| Lizenz | MIT (kommerzielle Nutzung ohne Einschränkungen erlaubt) |
| Max-Auflösung | 2048×2048 (empfohlen), 1024×1024 für schnellere Generierung |
| Plattform | Hugging Face, GitHub, ModelScope; Inferenz via vLLM-Omni, eigene Infrastruktur erforderlich |
| Preis | Kostenlos (Open-Weight-Modell, MIT-Lizenz; Selbst-Hosting erforderlich, kein offizielles bezahltes API) |
| Release-Datum | 22. September 2026 (Gewichte bereits am 17. September 2026 veröffentlicht) |