Cohere · Command
Command A+
command-a-plus-05-2026
SituativEnterprise & Souveränität
- Enterprise-/Souveränitäts-Deployments
- mehrsprachige Übersetzung
- agentische Workflows
KontextfensterDie maximale Textmenge (in Tokens), die ein Modell pro Anfrage gleichzeitig „im Blick“ hat – Eingabe plus bisheriger Verlauf. Ist es voll, fällt Älteres aus dem Kontext.Mehr im Wissen → - 128 K
TokenDie kleinste Verarbeitungseinheit eines Sprachmodells – ein Wortstück, kein ganzes Wort. Faustregel: rund 1.000 Tokens entsprechen grob 750 deutschen Wörtern. Preise und Kontextlängen werden in Tokens gerechnet.Mehr im Wissen → - Max. Ausgabe
- 64 K Token
- Preis (Input / Output)
- k. A. je 1 Mio. Token
Stärken
Cohere-Flaggschiff und erstes Mixture-of-Experts-Modell des Anbieters Vision-Eingabe plus agentische, Reasoning- und Übersetzungs-Fähigkeiten Effizientes Deployment: läuft laut Anbieter auf 1× B200 oder 2× H100
Schwächen
Proprietär; kein öffentlicher $/Token-Preis (Enterprise-/Souveränitäts-Vertrieb) KontextfensterDie maximale Textmenge (in Tokens), die ein Modell pro Anfrage gleichzeitig „im Blick“ hat – Eingabe plus bisheriger Verlauf. Ist es voll, fällt Älteres aus dem Kontext.Mehr im Wissen → 128 K – kleiner als das Vorgänger-Flaggschiff Command A (256 K)
Typische Einsatzfälle
Enterprise-/Souveränitäts-Deployments agentische Workflows mehrsprachige Übersetzung
Leistung im Vergleich
Unabhängige Indizes (Artificial Analysis, 0–100), zwei kontaminationsarme Einzel-Benchmarks (Terminal-Bench, agentische Shell-Aufgaben; τ²-bench, Tool-Use-Verlässlichkeit über viele Läufe) und Human-Präferenz-Elo (LMArena). Die dunkle Markierung zeigt den Bestwert im Katalog – so wird der Abstand zur Spitze sichtbar.
AA-IntelligenzZusammengesetzter Intelligenz-Index von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Reasoning-, Wissens- und Mathe-Benchmarks zu einer Zahl. Je höher, desto stärker das allgemeine Reasoning.Mehr im Wissen → 23AA-CodingCoding-Teilindex von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Programmier-Benchmarks zu einem Wert für die Code-Fähigkeit eines Modells.Mehr im Wissen → 28τ²-benchBenchmark für die Verlässlichkeit beim Werkzeug-Einsatz: dieselbe Aufgabe wird viele Male wiederholt, gemessen wird, wie konstant das Modell die Tools korrekt bedient (0–100 %).Mehr im Wissen → 81
Benchmarks im Detail
Kennzahlen aus zitierten Messungen – unabhängige Quellen sind ausgewiesen, Anbieterangaben entsprechend markiert. Werte sind nicht über Skalen hinweg vergleichbar. Wie man Benchmark-Zahlen liest →
Artificial Analysis Intelligence Index
23
unabhängigArtificial Analysis (API), abgerufen 2026-07-09
Artificial Analysis Coding Index
28
unabhängigArtificial Analysis (API), abgerufen 2026-07-09
τ²-bench (Tool-Use-Verlässlichkeit)
81 %
unabhängigArtificial Analysis (API), abgerufen 2026-06-16
Einordnung
Auf souveräne/Enterprise-Deployments ausgelegt: läuft laut Anbieter auf 1× B200 oder 2× H100 (Anbieterangabe) – effizientes Self-Hosting unter der Enterprise-Lizenz. Kleineres Kontextfenster (128 K) als das Vorgänger-Flaggschiff Command A (256 K); kein öffentlicher per- TokenDie kleinste Verarbeitungseinheit eines Sprachmodells – ein Wortstück, kein ganzes Wort. Faustregel: rund 1.000 Tokens entsprechen grob 750 deutschen Wörtern. Preise und Kontextlängen werden in Tokens gerechnet.Mehr im Wissen → -Preis – Konditionen nur über Cohere.Erster unabhängiger Wert: AA Intelligence Index 23 (AA Coding 28) – im Katalog-Mittelfeld, oberhalb der Open-Weight-Kleinmodelle. Beleg · Sekundärquelle
ℹ️