Katalog
KI-Modelle im Vergleich
Anbieter, Kontextfenster, Preise und Stärken – kuratiert und belegt. Preise je 1 Mio. Tokens (Input / Output) in US-Dollar.
Stand: 2026-07-25
27 von 27 Modellen
Claude Opus 5
Claude
Allrounder-Spitze (löst Opus 4.8 ab)
- Kontext
- 1 Mio. Token
- Preis I/O
- $5 / $25
- Preis-Leistung
- 6,1 Idx/$
Größte Sprünge bei agentischem Coding, Computer-Use und langer Wissensarbeit
Claude Fable 5
Claude
Benchmark-Spitze, wieder freigegeben
- Kontext
- 1 Mio. Token
- Preis I/O
- $10 / $50
- Preis-Leistung
- 3,0 Idx/$
Höchste Intelligenz der Claude-Reihe (Tier über Opus)
GPT-5.6 Sol
GPT
Coding-Spitze
- Kontext
- 1 Mio. Token
- Preis I/O
- $5 / $30
- Preis-Leistung
- 5,2 Idx/$
Führt den unabhängigen AA Coding Index an (77, max); Rang 2 im AA-Intelligence-Index (59)
Claude Opus 4.8
Claude
vom Nachfolger Opus 5 abgelöst
- Kontext
- 1 Mio. Token
- Preis I/O
- $5 / $25
- Preis-Leistung
- 5,6 Idx/$
Sehr leistungsfähig bei langen, autonomen Agenten-Aufgaben
GPT-5.5
GPT
Bewährtes Coding-Flaggschiff
- Kontext
- 1 Mio. Token
- Preis I/O
- $5 / $30
- Preis-Leistung
- 4,9 Idx/$
Aktuelles Flaggschiff der GPT-Reihe (Anbieter-Positionierung)
GPT-5.6 Terra
GPT
Preis-Leistungs-Tipp
- Kontext
- 1 Mio. Token
- Preis I/O
- $2 / $12
- Preis-Leistung
- 12,2 Idx/$
Erreicht GPT-5.5 im AA-Index (Intelligenz 55, Coding 77 – leicht darüber) zu einem Bruchteil des Preises (seit 30.07.2026 $2 / $12)
Grok 4.5
Grok
Frontier-nah, in der EU noch gesperrt
Eingeschränkt verfügbar
- Kontext
- 500 K Token
- Preis I/O
- $2 / $6
- Preis-Leistung
- 18,0 Idx/$
Coding auf Höhe der proprietären Spitzengruppe (unabhängiger AA Coding Index 72)
Claude Sonnet 5
Claude
Tempo-Preis-Arbeitspferd
- Kontext
- 1 Mio. Token
- Preis I/O
- $2 / $10
- Preis-Leistung
- 13,3 Idx/$
Laut Anbieter deutlich verbesserte Agentic-Coding- und Tool-Use-Leistung gegenüber Sonnet 4.6
GPT-5.6 Luna
GPT
Schnell & günstig
- Kontext
- 1 Mio. Token
- Preis I/O
- $0.2 / $1.2
- Preis-Leistung
- 113,3 Idx/$
Für ihren Preis (seit 30.07.2026 $0,20 / $1,20) starke AA-Werte: Intelligenz 51, Coding 71
GPT-5.4
GPT
Günstige GPT-Allzweck
- Kontext
- 1 Mio. Token
- Preis I/O
- $2.5 / $15
- Preis-Leistung
- 9,1 Idx/$
Deutlich günstiger als GPT-5.5 bei gleichem Kontext/Output
GLM-5.2
GLM
Open-Weight Agentic-Coding-Flaggschiff (MIT)
- Kontext
- 1 Mio. Token
- Preis I/O
- $1.4 / $4.4
- Preis-Leistung
- 23,7 Idx/$
Vollständig offene MIT-Lizenz – frei self-hostbar; ausdrücklich „ohne regionale Grenzen“ (Kontrast zur Fable-/Mythos-Sperre)
Gemini 3.5 Flash
Gemini
Preis-Leistungs-Tipp
- Kontext
- 1 Mio. Token
- Preis I/O
- $1.5 / $9
- Preis-Leistung
- 14,8 Idx/$
Schnell und breit multimodal bei 1-Mio.-Token-Kontext
Gemini 3.1 Pro
Gemini
Multimodal-Spezialist
- Kontext
- 1 Mio. Token
- Preis I/O
- $2 / $12
- Preis-Leistung
- 10,2 Idx/$
Breit multimodal: Text, Bild, Video, Audio und PDF
DeepSeek-V4-Pro
DeepSeek
Open-Weight-Preis-Leistung
- Kontext
- 1 Mio. Token
- Preis I/O
- $0.435 / $0.87
- Preis-Leistung
- 80,9 Idx/$
Offene Gewichte (auf HuggingFace publiziert, lokal/self-hosted möglich)
MiniMax-M3
MiniMax
Open-Weight Allzweck (1-Mio.-Kontext)
- Kontext
- 1 Mio. Token
- Preis I/O
- $0.3 / $1.2
- Preis-Leistung
- 83,8 Idx/$
Open-Weight (MiniMax Community License) – self-hosted/lokal betreibbar
Kimi K2.6
Kimi
Open-Weight Agenten-/Coding-Schwergewicht
- Kontext
- 262 K Token
- Preis I/O
- $0.95 / $4
- Preis-Leistung
- 25,1 Idx/$
Open-Weight (Modified MIT) – self-hosted/lokal betreibbar, nativ INT4-quantisiert
Hy3
Hy
Open-Weight Preis-Leistungs-Spitze (Apache 2.0)
- Kontext
- 262 K Token
- Preis I/O
- $0.14 / $0.58
- Preis-Leistung
- 164,0 Idx/$
Vollständig offene Apache-2.0-Lizenz – ohne Field-of-Use-Klausel und ohne geografische Ausnahme (Kontrast zur Fable-/Mythos-Sperre und zu Kimis Modified MIT)
GLM-5.1
GLM
Open-Weight Agentic-Coding (MIT)
- Kontext
- 203 K Token
- Preis I/O
- $1.4 / $4.4
- Preis-Leistung
- 18,6 Idx/$
Vollständig offene MIT-Lizenz – frei self-hostbar/lokal betreibbar
Grok 4.3
Grok
Von DeepSeek-V4 überholt
- Kontext
- 1 Mio. Token
- Preis I/O
- $1.25 / $2.5
- Preis-Leistung
- 24,3 Idx/$
Großes 1-Mio.-Token-Kontextfenster
Claude Haiku 4.5
Claude
Schnell & günstig, aber überholt
- Kontext
- 200 K Token
- Preis I/O
- $1 / $5
- Preis-Leistung
- 15,0 Idx/$
Schnellstes und günstigstes Modell der Reihe
Qwen3-Max
Qwen
Agentic-Allzweck (Alibaba Cloud)
- Kontext
- 262 K Token
- Preis I/O
- $1.2 / $6
- Preis-Leistung
- 10,0 Idx/$
Leistungsstärkstes Modell der Qwen-Reihe (Anbieterangabe)
Command A+
Command
Enterprise & Souveränität
- Kontext
- 128 K Token
- Preis I/O
- k. A.
Cohere-Flaggschiff und erstes Mixture-of-Experts-Modell des Anbieters
Gemma 4 12B
Gemma
Lokal & On-Device
- Kontext
- 256 K Token
- Preis I/O
- k. A.
Offene Gewichte unter Apache-2.0-Lizenz (lokal/self-hosted)
Mistral Large 3
Mistral
Open-Weight für EU/Souverän
- Kontext
- 256 K Token
- Preis I/O
- $0.5 / $1.5
- Preis-Leistung
- 21,3 Idx/$
Offene Gewichte unter Apache 2.0 (lokal/self-hosted möglich)
Llama 4 Maverick
Llama
Kontext-Spezialist
- Kontext
- 10 Mio. Token
- Preis I/O
- k. A.
Offene Gewichte zum Download (lokal/self-hosted möglich)
MiniCPM5-1B
MiniCPM
Kognitiver Kern fürs Gerät
- Kontext
- 131 K Token
- Preis I/O
- k. A.
Offene Gewichte unter Apache-2.0 – lokal/self-hosted, komplettes Trainings-Rezept und die Datensätze offengelegt
Ornith 1.0
Ornith
Selbst-gerüstetes Open-Source-Agentic-Coding (MIT)
- Kontext
- 262 K Token
- Preis I/O
- k. A.
Vollständig offene MIT-Lizenz „ohne regionale Grenzen“; alle vier Größen frei auf Hugging Face (deepreinforce-ai) – vom 9B-Dense für Edge/IDE bis zum 397B-MoE-Flaggschiff.
Kontextfenster, max. Ausgabe und Preise laut offizieller Anbieter-Dokumentation (Tier A) – Preise je 1 Mio. Tokens in USD, in einem schnelllebigen Feld vor Nutzung gegenprüfen. Kein erfundenes Ranking; die Reihenfolge ist kuratiert. Release-Daten und unabhängige Benchmarks (LMArena/Artificial Analysis) folgen über die Recherche-Pipeline.