Wofür · Entscheidungshilfe
Günstig & Hochvolumen
Kostensensitiv, latenzkritisch, große Mengen. Hier die kuratierten Empfehlungen – Modelle und Werkzeuge.
Empfohlene Modelle
Alle Modelle →Reihenfolge: zuerst unsere kuratierte Einstufung ( Spitze zuerst, dann solide, situativ, überholt), bei Gleichstand nach dem Gesamt-Token-Preis aus Input + Output (günstigster zuerst). Der Balken zeigt diesen Wert je Modell (länger = besser); markiert den besten Wert der Liste – er steht ggf. nicht oben, weil die Einstufung zuerst zählt.
DeepSeek · open-weight
DeepSeek-V4-Pro
Open-Weight-Preis-Leistung
Der Preis-Leistungs-Sieger unter den offenen Gewichten: sehr starkes Coding (59) und Agentic (67) seiner Preisklasse, dabei mit Abstand am günstigsten und selbst hostbar. Erste Wahl, wo Kosten, Datenhoheit oder lange Generierungen zählen – allerdings reine Text-Modalität.
Google · proprietär
Gemini 3.5 Flash
Preis-Leistungs-Tipp
Der Preis-Leistungs-Ausreißer: Intelligence-Index 50 (über Sonnet 4.6 und dem teureren Gemini 3.1 Pro) und Agentic 70 – zum Bruchteil des Flaggschiff-Preises. Auch beim Coding stark (70) – die empfehlenswerte Default-Wahl für Tempo und Volumen.
OpenAI · proprietär
GPT-5.6 Luna
Schnell & günstig
Schnellste und günstigste 5.6-Stufe, seit 9. Juli 2026 allgemein verfügbar – und seit dem 30. Juli 2026 um 80 Prozent verbilligt: **$0,20 / $1,20** statt $1 / $6 je Million Ein-/Ausgabe-Token. Unabhängig gemessen (AA, max) solide für den Preis: AA-Intelligence-Index 51, AA Coding Index 71 – unter GPT-5.5 (55 / 75), aber nun zu einem Fünfundzwanzigstel des Sol-Eingabepreises und mit rund 231 Tokens/s die schnellste der drei. Die Wahl für Hochvolumen- und latenzkritische Aufgaben.
Mistral AI · open-weight
Mistral Large 3
Open-Weight für EU/Souverän
Günstigstes Flaggschiff ($0,50 / $1,50) und Apache-2.0-offen – damit self-hosted und für souveräne EU-Deployments geeignet. Im AA Intelligence Index 16 (AA-Schätzung, vollständige unabhängige Eval ausstehend), AA Coding 20 – solide statt Spitze.
OpenAI · proprietär
GPT-5.4
Günstige GPT-Allzweck
Das kostensensitive GPT: halber Input-/Output-Preis von GPT-5.5 bei gleichem 1-Mio.-Kontext. Im unabhängigen AA Intelligence Index 51 (knapp unter GPT-5.5 mit 55), AA Coding Index 71 – eine solide, preisstarke Allzweck-Wahl statt Spitzenreiter.
Anthropic · proprietär
Claude Haiku 4.5
Schnell & günstig, aber überholt
Beim reinen Preis-Leistungs-Verhältnis von DeepSeek-V4-Pro überholt – das erreicht alle drei AA-Indizes höher und kostet weniger pro Token. Haiku bleibt sinnvoll, wo niedrige Latenz, ein gemanagter Anbieter oder Bild-Eingabe zählen (die DeepSeek nicht bietet).
Google · open-weight
Gemma 4 12B
Lokal & On-Device
Nicht für Spitzenleistung gebaut, sondern für lokalen/Edge-Betrieb: läuft auf Consumer-Laptops, multimodal und Apache-2.0-offen. Empfehlung dort, wo Offline-Betrieb, Datenschutz oder Hardware-Limits wichtiger sind als Benchmark-Spitzen.
Token-Preis: kein Vergleichswert