

DeepSeek V3
#6 in Reasoning-ModelleDeepSeek · v3 · seit 26. Dezember 2024 · 55× · zuletzt 17. Aug. 2026
62
Momentum
DeepSeek-V3 ist ein von DeepSeek AI entwickeltes Mixture-of-Experts-Sprachmodell mit 671 Milliarden Gesamtparametern, von denen pro Token 37 Milliarden aktiviert werden. Es wurde am 26. Dezember 2024 als Open-Source-Modell veröffentlicht und nutzt Multi-Head Latent Attention (MLA) sowie eine DeepSeekMoE-Architektur mit einer Auxiliary-Loss-freien Lastverteilung. Das Modell wurde auf 14,8 Billionen Tokens vortrainiert und unterstützt ein Kontextfenster von bis zu 128.000 Tokens; Vision- bzw. Bildeingaben werden nicht unterstützt.
Momentum-Verlauf
20.05.18.08.
Features
| Key-Benchmark (%) | MMLU (EM): 88,5% |
| Kontextfenster (Token) | 128.000 Token |
| Lizenz | Code: MIT-Lizenz; Modellnutzung (Base/Chat) unterliegt separater DeepSeek Model License, kommerzielle Nutzung erlaubt |
| Multimodalität | Nur Text, keine Vision-/Bildunterstützung |
| Plattform | API (DeepSeek Platform, OpenAI-kompatibel), Chat unter chat.deepseek.com, Open-Weights auf Hugging Face/GitHub für Self-Hosting |
| Preis pro 1M Token | $0,14 Input / $0,28 Output (Cache-Miss) |
| Release-Datum | 26. Dezember 2024 |