GLM-5.2
von Z.ai · Lizenz: MIT · Kommerziell nutzbar
744B-MoE-Gigant unter MIT-Lizenz: Schlägt GPT-5.5 auf SWE-Bench Pro, 1 Million Token Kontext — das derzeit stärkste komplett frei nutzbare Coding-Modell.
Was ist GLM-5.2?
Z.ai (ehemals Zhipu AI) positioniert GLM-5.2 als offenes Frontier-Modell für Coding und langfristige Agenten-Aufgaben. Das Mixture-of-Experts-Modell besitzt rund 744 Mrd. Parameter, von denen nur etwa 40 Mrd.
pro Token aktiv sind, und bietet ein Kontextfenster von 1 Million Token. Auf SWE-Bench Pro erreicht es 62,1 % und schlägt damit GPT-5.5 (58,6 %) — bei rund einem Sechstel der API-Kosten. Das größte Plus ist die MIT-Lizenz: Sie erlaubt uneingeschränkte kommerzielle Nutzung, Modifikation und Weiterverbreitung.
Lokal ist GLM-5.2 allerdings nur etwas für Enthusiasten mit Server-Hardware: In 4-Bit-Quantisierung werden über 400 GB (V)RAM benötigt, über Ollama gibt es das Modell nur als Cloud-Variante. Wer die nötige Hardware besitzt (z. B.
8x H100 oder große EPYC-Server mit viel RAM plus MoE-Offloading), betreibt eines der besten Coding-Modelle der Welt völlig unabhängig von US-Anbietern. vLLM und SGLang werden offiziell unterstützt, Community-GGUFs für llama.cpp und LM Studio existieren. Optimiert für projektweite Engineering-Workflows und mehrstufige agentische Prozesse.
Fähigkeiten-Matrix
Was kann GLM-5.2 — und was nicht?
Hardware-Anforderungen
| Größe | Min. RAM | Empf. VRAM | CPU möglich? | Quantisierung | Empfohlene GPU |
|---|---|---|---|---|---|
| 744B-A40B | 512 GB | 480 GB | ✗ Nein | Q4_K_M | 8x H100 80GB |
Kompatibilität
Bewertung
Weitere GLM-Modelle
War diese Übersicht hilfreich?