

Ling-3.0-flash
#57 in Open-Source-SprachmodelleUnknown · v3.0 · flash · 2× · zuletzt 08. Aug. 2026
Ling-3.0-flash ist ein von Ant Groups InclusionAI (Ling-Serie) entwickeltes Open-Weight-Sprachmodell mit hybrider linearer Mixture-of-Experts-Architektur: 124 Milliarden Gesamtparameter, von denen pro Token nur rund 5,1 Milliarden aktiviert werden (1/64 Sparse-MoE-Routing, kombiniert mit Kimi Delta Attention und Gated MLA). Es unterstützt ein natives Kontextfenster von 262.144 Token (Erweiterung bis zu 1M Token angekündigt), ist textbasiert (kein multimodaler Input) und für agentische Anwendungen wie Coding, Tool-Aufrufe und Langkontext-Aufgaben optimiert. Das Modell wurde um den 23. Juli 2026 veröffentlicht, Gewichte sind u.a. über Hugging Face verfügbar; unabhängige Benchmark-Bewertungen (z.B. Artificial Analysis) waren zum Teil erst kurz nach Release verfügbar.
Features
| Key-Benchmark (%) | GPQA Diamond: 59,3%; Artificial Analysis Intelligence Index: 26 |
| Kontextfenster (Token) | 262.144 Token nativ, Erweiterung auf bis zu 1M Token vorgesehen |
| Lizenz | MIT-Lizenz (laut abgeleitetem Modell auf Hugging Face, das die Lizenz vom Basismodell übernimmt) |
| Multimodalität | Nur Text (Input und Output), keine Bild-/Audio-Unterstützung |
| Plattform | Verfügbar über Hugging Face (Gewichte), API bei InclusionAI/Ant Group, OpenRouter, ZenMux, Kilo Code, Puter |
| Preis pro 1M Token | 0,07 $ Input / 0,22 $ Output pro 1M Token (InclusionAI-API, Stand Artificial Analysis) |
| Release-Datum | 23. Juli 2026 (laut OpenRouter-Modell-ID-Erstellung); Artificial Analysis nennt 4. August 2026 |