Alle Depeschen

DepescheModelleneu

Das enttarnte Ox Alpha ist unabhängig gemessen: GLM-5.3-Flash steht im Agentik-Index auf Rang 6 von 175 – zu drei Prozent des Preises von Claude Fable 5

Artificial Analysis führt seit dem 26. August 2026 beide neuen Z.ai-Modelle: GLM-5.3 (max) mit Intelligence 59,5 / Coding 74,8 / Agentic 59,1 und das offene GLM-5.3-Flash mit 57,5 / 71,5 / 58,2. Auf der Agentik-Achse ist das für das Flash Rang 6 von 175 dort gemessenen Modellen – vor GPT-5.6 Sol (max) und Claude Fable 5 – bei $0,15 / $0,50 je Mio. Token. GLM-5.3 (max) steht auf Rang 2, 0,1 Punkte hinter Claude Opus 5. Damit sind die beiden Bedingungen unserer Katalogregel erfüllt, und GLM-5.3-Flash geht als eigener Eintrag in den Modellkatalog.

Die Zahlen stammen aus unserem eigenen Abruf der Artificial-Analysis-v2-Schnittstelle am 27. August 2026. GLM-5.3-Flash (Anlagedatum dort: 26.08.2026) kommt auf einen Intelligence-Index von 57,5, einen Coding-Index von 71,5 und einen Agentic-Index von 58,2. Die geschlossene Schwester GLM-5.3 (max) (18.08.2026) steht bei 59,5 / 74,8 / 59,1. Zum Vergleich der bisherige Bestwert unseres Katalogs unter den offenen Modellen, GLM-5.2 (max): 52,6 / 68,8 / 45,7. Das Flash gewinnt also gegen den Vorgänger auf allen drei Achsen – und kostet dabei $0,15 statt $1,40 je Mio. Eingabe-Token.

Der Agentic-Index ist die Achse, auf der das Ergebnis heraussticht. Von 175 Modellen, für die Artificial Analysis diesen Wert ausweist, stehen über GLM-5.3-Flash nur sechs Einträge: Claude Opus 5 in zwei Aufwandsstufen (59,2 und 58,4, $5 / $25), GLM-5.3 (max) (59,1, $1,40 / $4,40), Grok 4.6 (high) (58,7, $2 / $6) und Qwen3.8 Max (58,4, $2 / $6). Direkt unter dem Flash liegen GPT-5.6 Sol (max) mit 57,8 ($4 / $20), Qwen3.8 2.4T A95B mit 57,1 und Claude Fable 5 mit 56,6 ($10 / $50). Der Preisabstand zu Fable 5 beträgt Faktor 67 beim Eingabe- und Faktor 100 beim Ausgabe-Token. Wir geben diese Rangfolge als das wieder, was sie ist – eine Momentaufnahme eines Anbieters von Messungen, nicht ein Urteil über Nützlichkeit.

Der zweite Wert, der selten irgendwo steht: Artificial Analysis weist die Kosten des eigenen Index-Laufs aus. Für GLM-5.3-Flash kostete er $138,02 insgesamt und $0,0869 je Aufgabe; für GLM-5.3 (max) $1.238,50 und $0,6829 je Aufgabe. Bei festem Tarif ist das ein brauchbarer Näherungswert für den Token-Verbrauch – das Flash braucht für dieselbe Aufgabenmenge rund ein Achtel der Ausgaben und verliert dabei 2 Indexpunkte. Bezahlt wird das mit Zeit: 49,3 Token/s Ausgabe gegenüber 86,5 beim max, und 42 Sekunden bis zum ersten Antwort-Token.

Die Gegenprobe kommt von einem Tester, den wir seit Wochen mitlesen und der die Reihe kennt. Er hatte GLM-5.3 (max) am 16. August auf seinem privaten Projekt-Benchmark einen „very big jump“ bescheinigt. Das Flash misst er nun nach der Enttarnung erneut – und findet dieselbe Position wie beim anonymen Ox Alpha: „towards the low end of the table“, 8,9 von 24 Punkten, wobei er selbst darauf hinweist, dass ein oder zwei Punkte Unterschied dort nicht signifikant sind. Neu sind die Betriebswerte, die es in der Gratisphase nicht gab: rund zwei Cent je Prompt in einer Aktionsphase mit doppelter Anrechnung, im Schnitt neun Minuten je Prompt über 20 Prompts. Im direkten Vergleich mit DeepSeek V4 Flash – ähnlicher Preis, ähnliche Dauer – gewinnt DeepSeek bei Testabdeckung und Randfällen, GLM-5.3-Flash aber bei der Code-Qualität. Das ist Tier C, ein Tester, unveröffentlichte Methodik; als Gegengewicht zum Index-Rang ist es trotzdem der ehrlichere Teil der Geschichte.

Zwei Dinge bleiben offen. Erstens der Preis: Artificial Analysis misst mit $0,15 / $0,50, OpenRouter listet exakt die Hälfte ($0,075 / $0,25). Z.ais eigene Doku liefert die Mechanik – im GLM Coding Plan verbraucht ein Aufruf zu Nebenzeiten 50 % der Standard-Punkte. Wir führen im Katalog den AA-Wert, weil er über alle Modelle gleich erhoben ist, und halten die Abweichung fest. Zweitens die Gewichte der großen Schwester: Z.ai hatte am 14. August offene Gewichte für GLM-5.3 „in zwei Wochen“ angekündigt. Am 27. August lagen in der Organisation zai-org nur GLM-5.3-Flash und GLM-5.3-Flash-BF16 (beide angelegt am 25.08.), keine Ablage „GLM-5.3“. Die Frist läuft noch – aber das kleine Modell kam zuerst.

Aufgefallen ist uns das Ganze über den YouTube-Eingang: Ein Testvideo vom 27. August zum enttarnten Modell war der Anlass, die Schnittstelle gezielt nach den beiden Slugs zu fragen. Der Fund selbst steht auf Tier A/B – Modellkarte, Anbieter-Doku, OpenRouter und der eigene Messabruf; das Video liefert die Praxis-Gegenlage und ist als Tier C gekennzeichnet.