Alle Depeschen

DepescheModelle

Z.ai kontert die Fable-Sperre: GLM-5.2 als MIT-offenes Coding-Flaggschiff

Z.ai hat GLM-5.2 veröffentlicht – ein vollständig MIT-offenes Coding-Flaggschiff mit nutzbarem 1-Mio.-Token-Kontext. Unmittelbar nach der US-Sperre für Anthropics Fable/Mythos positioniert die chinesische Firma das Modell ausdrücklich „ohne regionale Grenzen“. Im unabhängigen Artificial-Analysis-Index ist es mit 51 das stärkste offene Modell.

Aussagen gegen die Quellen geprüft · 9. Juli 2026

Z.ai kündigte GLM-5.2 am 13. Juni 2026 an – sofort verfügbar für Nutzer des GLM-Coding-Plans, mit MIT-lizenzierten offenen Gewichten sowie API und Chatbot „nächste Woche“. Headline-Feature ist ein nutzbarer 1-Mio.-Token-Kontext (gegenüber 200 K bei GLM-5.1) plus eine neue, höchste Reasoning-Stufe „max“ neben „high“.

Architektonisch bleibt GLM-5.2 ein MoE (Mixture of Experts)Architektur, bei der je Anfrage nur ein Teil des Modells („Experten“) aktiv wird. So hat das Modell sehr viele Gesamt-Parameter, rechnet aber nur mit wenigen aktiven – das spart Rechenzeit.Mehr im Wissen → wie GLM-5/5.1 (rund 744 Mrd. Gesamt- und 40 Mrd. aktive ParameterDie im Training gelernten „Stellschrauben“ eines Modells (gezählt in Milliarden). Mehr Parameter heißt grob mehr Kapazität, aber auch mehr Rechen- und Speicherbedarf – und sagt allein wenig über die Qualität.Mehr im Wissen →; der Parameter-Badge auf Hugging Face nennt 753 Mrd.). Neu ist „IndexShare“: Der Indexer der Sparse AttentionAufmerksamkeits-Mechanismus, der nicht jeden Token mit jedem vergleicht, sondern nur eine ausgewählte Teilmenge. Das senkt Rechen- und Speicheraufwand bei sehr langen Kontexten erheblich.Mehr im Wissen → wird über je vier Layer geteilt, was die FLOPs pro Token bei vollem 1-Mio.-Kontext um rund das 2,9-Fache senkt – Z.ai legte dazu ein eigenes Paper („Index Cache“) vor.

Im unabhängigen Artificial-Analysis-Index erreicht die Variante GLM-5.2 (max) einen Intelligence-Index von 51 und einen Coding-Index von 69 (Terminal-BenchAusführungsbasierter Benchmark (0–100 %): das Modell löst echte Shell-/Terminal-Aufgaben in einer Sandbox, gewertet wird, ob das Ergebnis wirklich funktioniert. Dadurch kontaminationsärmer als reine Wissensquizze.Mehr im Wissen → 2.1 81 %, τ²-benchBenchmark für die Verlässlichkeit beim Werkzeug-Einsatz: dieselbe Aufgabe wird viele Male wiederholt, gemessen wird, wie konstant das Modell die Tools korrekt bedient (0–100 %).Mehr im Wissen → 99 %) und ist damit das stärkste Open-Weight-Modell – ein deutlicher Sprung gegenüber GLM-5.1 (40/56). Der Preis bleibt mit $1,40 / $4,40 je Mio. Tokens niedrig. Z.ais eigene Vergleiche (etwa „nahe Opus 4.8“ auf Frontier-SWE mit 74,4 % gegen 75 %) sind Anbieterangaben und unabhängig nicht bestätigt.

Die Veröffentlichung ist auch ein politisches Signal: Z.ai bewirbt GLM-5.2 explizit als grenzenlos zugänglich – exakt zu dem Zeitpunkt, an dem die US-Regierung den Zugang zu Anthropics Fable/Mythos auf US-Bürger beschränkt hat. Damit reiht sich der Release in die laufende Debatte um einen europäischen „Airbus-Moment“ und die Frage ein, ob Exportkontrollen offene chinesische Modelle eher stärken.