

Naive-N0.5-Flash
#31 in Open-Source-SprachmodelleNaiveai · flash · 2× · zuletzt 29. Sept. 2026
Naive-N0.5-Flash ist ein von NaiveAI (Peking) veröffentlichtes Open-Weight-Sprachmodell mit Mixture-of-Experts-Architektur: 309 Milliarden Gesamtparameter, davon 15,5 Milliarden aktive Parameter pro Token. Das Modell nutzt ausschließlich eine Hybrid-Architektur aus Sliding-Window-Attention (SWA) und leichtgewichtiger DeepSeek Sparse Attention (DSA) im Verhältnis etwa 5:1, ohne jegliche Full-Attention-Schichten, und erreicht dadurch ein natives 1-Million-Token-Kontextfenster. Es basiert auf dem offenen MiMo-V2.5-Basismodell von Xiaomi und wurde für Coding- und KI-Forschungs-/Entwicklungsaufgaben trainiert. Gewichte und Inferenzcode stehen unter MIT-Lizenz auf Hugging Face zur Verfügung; ein API-Zugang wurde mit gestaffelten Preisen angekündigt.
Features
| Key-Benchmark (%) | SWE-bench Pro: 73,6% (Platz 3 hinter Opus 5.5 mit 89,9%) |
| Kontextfenster (Token) | 1.000.000 Token (nativ, ohne Full-Attention) |
| Lizenz | MIT-Lizenz (Gewichte und Inferenzcode) |
| Multimodalität | Keine Angabe zu Multimodalität; Fokus auf Text/Code |
| Plattform | Hugging Face (Open-Weight-Download), API angekündigt (noch nicht live) |
| Preis pro 1M Token | $0,10 Input / $0,40 Output / $0,01 Cache-Read (angekündigt, API noch nicht live) |
| Release-Datum | 27. September 2026 |