

DeepSeek V4.1
#109 in Frontier-SprachmodelleDeepSeek · v4.1 · seit 10. September 2026 · 3× · zuletzt 13. Sept. 2026
DeepSeek V4.1 ist offiziell als "DeepSeek-V4.1-Flash" erschienen – ein separates "V4.1 Pro" existiert noch nicht. Es handelt sich um ein multimodales Mixture-of-Experts-Modell mit 552 Mrd. Parametern (8 Mrd. aktiv beim Input, 16 Mrd. beim Output), das eine neue "Causal-Encoder-Decoder"-Architektur mit 20 Encoder- und 20 Decoderschichten nutzt. Das Modell unterstützt ein 1-Million-Token-Kontextfenster, native Bildeingabe und wird unter MIT-Lizenz als offenes Gewicht auf Hugging Face bereitgestellt. Es ersetzt ab 14. September 2026 das teurere V4-Pro-Modell im API-Routing und positioniert sich preislich deutlich günstiger als vergleichbare Flaggschiff-Modelle.
Features
| Key-Benchmark (%) | HLE (Humanity's Last Exam): 36,8% Gesamtwert / 39,1% auf reinem Text-Subset (offizielle DeepSeek-Angabe) |
| Kontextfenster (Token) | 1.000.000 Token (max. Output ca. 256.000+ Token empfohlen) |
| Lizenz | MIT License (offene Modellgewichte) |
| Multimodalität | Native Bildverständnis (Text + Bild als Input, Textausgabe); unterstützt JPEG, PNG, GIF, WebP |
| Plattform | DeepSeek API (Modell-ID: deepseek-flash), Chat-Web/App, Hugging Face (Gewichte für Selbst-Hosting via vLLM, SGLang, Transformers) |
| Preis pro 1M Token | Off-Peak: $0,15 Input / $0,60 Output; Peak: $0,30 Input / $1,20 Output (Cache-Hit: $0,003) |
| Release-Datum | 10. September 2026 (offizielle Veröffentlichung von DeepSeek-V4.1-Flash) |