

GLM-5.3 Flash
#34 in Frontier-SprachmodelleZhipu · v5.3 · flash · 15× · zuletzt 29. Aug. 2026
GLM-5.3-Flash ist ein von Z.ai (Zhipu AI) am 26. August 2026 veröffentlichtes Mixture-of-Experts-Sprachmodell mit 320 Milliarden Gesamtparametern und 18 Milliarden aktiven Parametern pro Token. Es ist das erste nativ multimodale Modell der GLM-5-Serie, unterstützt Text-, Bild- und Videoeingaben und verfügt über ein 1-Million-Token-Kontextfenster mit hybrider Sparse-plus-Linear-Attention-Architektur. Das Modell wurde zuvor anonym als "Ox Alpha" auf OpenRouter und OpenCode getestet und wird unter MIT-Lizenz mit offenen Gewichten auf Hugging Face bereitgestellt. Z.ai positioniert es als kostengünstige Alternative für Coding-, Agenten- und visuelle Aufgaben, die laut Hersteller nahe an Claude Opus 4.8 heranreicht.
Features
| Key-Benchmark (%) | Terminal-Bench 2.1: 84,3% (Claude Opus 4.8: 85,0%); DeepSWE v1.1: 63,4% |
| Kontextfenster (Token) | 1.048.576 Token (ca. 1M), max. 131.072 Ausgabe-Token |
| Lizenz | MIT-Lizenz (offene Gewichte) |
| Multimodalität | Nativ multimodal: Text, Bild und Video als Eingabe, Textausgabe |
| Plattform | Hugging Face (zai-org/GLM-5.3-Flash), Z.ai API, OpenRouter, GLM Coding Plan |
| Preis pro 1M Token | $0,15 Input / $0,50 Output (Launch-Rabatt bis 9. Sept. 2026: $0,075/$0,25); Cache-Read $0,03 |
| Release-Datum | 26. August 2026 |