

DeepSeek V4 Flash 0731
#3 in Lokale LLM-RuntimesDeepSeek · v4 · flash 0731 · 6× · zuletzt 01. Aug. 2026
DeepSeek-V4-Flash-0731 ist die offizielle, produktionsreife Version von DeepSeek-V4-Flash und ersetzt die zuvor genutzte Preview-Version. Es handelt sich um ein Mixture-of-Experts-Modell mit 284 Milliarden Gesamt- und 13 Milliarden aktiven Parametern pro Token, einem 1-Million-Token-Kontextfenster sowie deutlich verbesserten agentischen und Coding-Fähigkeiten gegenüber der Preview, erreicht durch intensiveres Post-Training statt Architekturänderungen. Die Gewichte stehen unter MIT-Lizenz offen zum Download (u.a. Hugging Face) bereit und lassen sich lokal via vLLM oder llama.cpp/Unsloth-GGUF-Quantisierungen betreiben; parallel ist das Modell über die offizielle, OpenAI-kompatible DeepSeek-API nutzbar.