

GLM-5.3-Flash
#3 in Small & Edge-ModelleZhipu Ai · v5.3 · flash · 17× · zuletzt 29. Aug. 2026
82
Momentum
GLM-5.3-Flash ist ein von Z.ai (Zhipu AI) am 26. August 2026 veröffentlichtes Mixture-of-Experts-Modell mit 320 Milliarden Gesamt- und 18 Milliarden aktiven Parametern. Es ist das erste nativ multimodale Modell der GLM-5-Reihe, verfügt über eine hybride Sparse-plus-Linear-Attention-Architektur sowie ein Kontextfenster von rund 1 Million Token, und wurde unter MIT-Lizenz mit offenen Gewichten auf Hugging Face veröffentlicht. Laut Z.ai übertrifft es den Vorgänger GLM-5.2 bei etwa einem Zehntel der Kosten und nähert sich in Coding- und Agenten-Benchmarks Claude Opus 4.8 an.
Momentum-Verlauf
01.06.30.08.
Features
| Key-Benchmark (%) | 63,4% auf DeepSWE v1.1 (vs. 46,2% bei GLM-5.2); 57 Punkte im Artificial Analysis Intelligence Index |
| Kontextfenster (Token) | 1.048.576 Token (max. Output 131.072 Token) |
| Lizenz | MIT-Lizenz (offene Gewichte) |
| Multimodalität | Nativ multimodal: Text-, Bild- und Video-Eingabe, Text-Ausgabe |
| Plattform | API (Z.ai API Platform), Hugging Face (Gewichte), ZCode, GLM Coding Plan, Chat (chat.z.ai), Self-Hosting via SGLang, vLLM, TokenSpeed, KTransformers |
| Preis pro 1M Token | $0,15 Input / $0,50 Output (Listenpreis); Launch-Promo bis 9. September 2026: $0,075 / $0,25 |
| Release-Datum | 26. August 2026 |