Was dort liegt: Die Hugging-Face-Organisation von Qwen führt seit dem 14. August 2026 zwei neue Ablagen – „Qwen/Qwen3.8-27B“ und „Qwen/Qwen3.8-27B-FP8“, bei unserem Abruf beide „Updated about 2 hours ago“. Beide tragen die Lizenzkennung „apache-2.0“. Die FP8-Fassung nutzt „fine-grained fp8 quantization with block size of 128“ im Format F8_E4M3 und nennt Hugging Face Transformers, vLLM, SGLang und TokenSpeed als kompatible Laufzeiten; einen Inferenz-Anbieter hatte sie beim Abruf noch nicht („This model isn't deployed by any Inference Provider“). Die Basis-Ablage weist zwei Downloads im letzten Monat aus – die Zahl misst hier vor allem, wie frisch die Freigabe ist.
Die Architektur aus der Modellkarte: 27 Milliarden Parameter, dicht statt Mixture-of-Experts, 64 Schichten, aufgebaut als „16 × (3 × (Gated DeltaNet → FFN) → 1 × (Gated Attention → FFN))“ – also dasselbe Muster aus überwiegend linearer Aufmerksamkeit mit eingestreuten vollen Attention-Blöcken wie beim großen Modell, nur in einem Sechzehntel der Tiefe. Der Kontext beträgt „262,144 natively and extensible up to 1,000,000 tokens“, die Erweiterung ist als YaRN-Konfiguration beschrieben. Zum Denkmodus sagt die Karte: „Qwen3.8 models operate in thinking mode by default“ – den bei Qwen3.8-Max ausdrücklich vermerkten Satz „thinking cannot be disabled“ enthält sie nicht.
Der Lizenzunterschied ist der Kern. Qwen3.8-Max liegt unter einer Hauslizenz, die ab 100 Millionen monatlich aktiven Nutzern beziehungsweise 20 Millionen US-Dollar Monatsumsatz eine sichtbare Modell-Nennung verlangt und ab 50 Millionen US-Dollar Umsatz in zwölf zusammenhängenden Monaten eine gesonderte Erlaubnis für Model-as-a-Service-Geschäfte. Qwen3.8-27B steht unter Apache 2.0 – keine Schwellen, kein Zustimmungsvorbehalt, keine Nennungspflicht. Damit stehen die beiden Freigaben derselben Modellfamilie unter zwei grundverschiedenen Rechtsregimen, und nur die kleinere ist im Sinne der Open Source Initiative offen.
Der zweite Unterschied betrifft die Modalitäten und dreht das erwartbare Verhältnis um: Die Karte des 27-B-Modells beschreibt „Native support for image and video understanding, from STEM diagrams and documents to hour-scale videos“, während die freigegebenen Max-Gewichte laut ihrer eigenen Karte ein reines Textmodell sind („Multimodal inputs are not supported“). Wer aus der Qwen3.8-Familie ein Modell für einen Arbeitsablauf mit Bildern sucht, findet es also im kleinen, nicht im großen.
Die Leistungsangaben sind vollständig Anbieterwerte und mit einer Methodennotiz versehen, die man mitlesen muss. Die Karte vergleicht Qwen3.8-27B gegen Qwen3.6-27B, Qwen3.7-Plus, Muse Glimmer-30B und Opus4.6 Max und nennt unter anderem SWE-Bench Pro 61,7 (Qwen3.6-27B 53,5 · Qwen3.7-Plus 57,6 · Muse Glimmer-30B 51,2 · Opus4.6 Max 53,4), LiveCodeBench v6 90,3 (Qwen3.7-Plus 89,6 · Opus4.6 Max 88,8), OSWorld-Verified 84,3 (Qwen3.7-Plus 73,3 · Opus4.6 Max 72,7), WebArena-Verified 64,8 (Qwen3.7-Plus 55,3; für Muse Glimmer-30B und Opus4.6 Max ohne Wert), GPQA Diamond 89,2 (Qwen3.7-Plus 90,3 · Opus4.6 Max 91,3) und Terminal Bench 2.1 (Terminus) 73,0 (Qwen3.7-Plus 64,0 · Opus4.6 Max 78,2).
Zur Einordnung dieser Tabelle drei Punkte. Erstens die Fußnote der Karte selbst: „Except for Opus4.6 Max, which uses the officially reported score, all models are evaluated with the Claude Code harness“ – Alibaba hat die Konkurrenzmodelle also selbst durchgemessen, in einem Harness fremder Bauart. Zweitens die Wahl des Vergleichsmodells: Verglichen wird gegen Opus 4.6 Max, nicht gegen die aktuellen Anthropic-Modelle unseres Katalogs. Drittens das Bild, das die Tabelle selbst zeichnet, wenn man sie ganz liest: Bei den agentischen und Coding-Messungen liegt das 27-B-Modell vorn, beim Fachwissen (GPQA Diamond) und im Terminal Bench dagegen hinter Opus4.6 Max. Es ist also kein Modell, das alles gewinnt, sondern eins, das auf den agentischen Achsen ungewöhnlich weit für seine Größe kommt.
Was wir nicht behaupten: Eine unabhängige Messung von Qwen3.8-27B liegt uns nicht vor – weder von Artificial Analysis noch von einem AI Security Institute. Das Modell bekommt deshalb vorerst keinen eigenen Katalog-Eintrag; wir tragen ihn nach, sobald eine unabhängige Zahl existiert. Das ist dieselbe Regel, die wir zwei Tage zuvor auf GLM-5.3 angewandt haben. Ein Preis für einen gehosteten Zugang ist nicht bekannt: Die von der Modellkarte verlinkte Übersichtsseite bei Qwen Cloud liefert bei unserem Abruf am 14. August 2026 HTTP 404.