Wofür · Entscheidungshilfe

Günstig & Hochvolumen

Kostensensitiv, latenzkritisch, große Mengen. Hier die kuratierten Empfehlungen – Modelle und Werkzeuge.

← Alle Aufgaben

Empfohlene Modelle

Alle Modelle →

Reihenfolge: zuerst unsere kuratierte Einstufung ( Spitze zuerst, dann solide, situativ, überholt), bei Gleichstand nach dem Gesamt-Token-Preis aus Input + Output (günstigster zuerst). Der Balken zeigt diesen Wert je Modell (länger = besser); markiert den besten Wert der Liste – er steht ggf. nicht oben, weil die Einstufung zuerst zählt.

DeepSeek · open-weight

DeepSeek-V4-Pro

Open-Weight-Preis-Leistung

Der Preis-Leistungs-Sieger unter den offenen Gewichten: sehr starkes Coding (59) und Agentic (67) seiner Preisklasse, dabei mit Abstand am günstigsten und selbst hostbar. Erste Wahl, wo Kosten, Datenhoheit oder lange Generierungen zählen – allerdings reine Text-Modalität.

Token-Preis$1.30 / Mio.

Google · proprietär

Gemini 3.5 Flash

Preis-Leistungs-Tipp

Der Preis-Leistungs-Ausreißer: Intelligence-Index 50 (über Sonnet 4.6 und dem teureren Gemini 3.1 Pro) und Agentic 70 – zum Bruchteil des Flaggschiff-Preises. Auch beim Coding stark (70) – die empfehlenswerte Default-Wahl für Tempo und Volumen.

Token-Preis$10.50 / Mio.

OpenAI · proprietär

GPT-5.6 Luna

Schnell & günstig

Schnellste und günstigste 5.6-Stufe, seit 9. Juli 2026 allgemein verfügbar – und seit dem 30. Juli 2026 um 80 Prozent verbilligt: **$0,20 / $1,20** statt $1 / $6 je Million Ein-/Ausgabe-Token. Unabhängig gemessen (AA, max) solide für den Preis: AA-Intelligence-Index 51, AA Coding Index 71 – unter GPT-5.5 (55 / 75), aber nun zu einem Fünfundzwanzigstel des Sol-Eingabepreises und mit rund 231 Tokens/s die schnellste der drei. Die Wahl für Hochvolumen- und latenzkritische Aufgaben.

Token-Preis$1.40 / Mio.

Mistral AI · open-weight

Mistral Large 3

Open-Weight für EU/Souverän

Günstigstes Flaggschiff ($0,50 / $1,50) und Apache-2.0-offen – damit self-hosted und für souveräne EU-Deployments geeignet. Im AA Intelligence Index 16 (AA-Schätzung, vollständige unabhängige Eval ausstehend), AA Coding 20 – solide statt Spitze.

Token-Preis$2.00 / Mio.

OpenAI · proprietär

GPT-5.4

Günstige GPT-Allzweck

Das kostensensitive GPT: halber Input-/Output-Preis von GPT-5.5 bei gleichem 1-Mio.-Kontext. Im unabhängigen AA Intelligence Index 51 (knapp unter GPT-5.5 mit 55), AA Coding Index 71 – eine solide, preisstarke Allzweck-Wahl statt Spitzenreiter.

Token-Preis$17.50 / Mio.

Anthropic · proprietär

Claude Haiku 4.5

Schnell & günstig, aber überholt

Beim reinen Preis-Leistungs-Verhältnis von DeepSeek-V4-Pro überholt – das erreicht alle drei AA-Indizes höher und kostet weniger pro Token. Haiku bleibt sinnvoll, wo niedrige Latenz, ein gemanagter Anbieter oder Bild-Eingabe zählen (die DeepSeek nicht bietet).

Token-Preis$6.00 / Mio.

Google · open-weight

Gemma 4 12B

Lokal & On-Device

Nicht für Spitzenleistung gebaut, sondern für lokalen/Edge-Betrieb: läuft auf Consumer-Laptops, multimodal und Apache-2.0-offen. Empfehlung dort, wo Offline-Betrieb, Datenschutz oder Hardware-Limits wichtiger sind als Benchmark-Spitzen.

Token-Preis: kein Vergleichswert

Passende Werkzeuge

Alle Werkzeuge →