

V4-Flash
#244 in Frontier-SprachmodelleUnknown · v4 · 2× · zuletzt 04. Aug. 2026
3
Momentum
DeepSeek-V4-Flash ist ein Mixture-of-Experts-Sprachmodell von DeepSeek mit 284 Milliarden Gesamtparametern und 13 Milliarden aktivierten Parametern pro Token, das für Coding, Tool-Nutzung und agentische Workflows optimiert ist. Das Modell unterstützt ein 1-Million-Token-Kontextfenster und wird unter der MIT-Lizenz als offenes Gewicht veröffentlicht. Die offizielle Version DeepSeek-V4-Flash-0731 ersetzte am 31. Juli 2026 die im April 2026 vorgestellte Preview-Version und erhielt durch neues Post-Training deutlich verbesserte Agenten-Fähigkeiten, u.a. native Unterstützung der Responses API und Codex-Integration.
Momentum-Verlauf
24.06.22.09.
Features
| Key-Benchmark (%) | Terminal-Bench 2.1: 82,7 (offiziell, vendor-reported) |
| Kontextfenster (Token) | 1.048.576 Token (1M), max. Output 384.000 Token |
| Lizenz | MIT License (offene Gewichte) |
| Multimodalität | Textbasiertes Modell mit Function-Calling und Reasoning-Modus; keine offizielle Bild-/Audio-Multimodalität bestätigt |
| Plattform | DeepSeek API (deepseek-v4-flash), chat.deepseek.com, Hugging Face, LM Studio |
| Preis pro 1M Token | $0,14 Input (Cache Miss) / $0,0028 Input (Cache Hit) / $0,28 Output |
| Release-Datum | Preview: 24. April 2026; offizielle Version (0731): 31. Juli 2026 |