← Alle Modelle

Cohere · Command

Command A+

command-a-plus-05-2026

proprietärModell, das nur über die API oder das Produkt des Anbieters nutzbar ist; die Gewichte werden nicht veröffentlicht. Gegenstück zu open-weight.Mehr im Wissen →TextBild (Eingabe)

SituativEnterprise & Souveränität

Auf souveräne/Enterprise-Deployments zugeschnitten (läuft effizient auf 1× B200 oder 2× H100), mit Vision und mehrsprachiger Stärke. Im unabhängigen AA-IntelligenzZusammengesetzter Intelligenz-Index von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Reasoning-, Wissens- und Mathe-Benchmarks zu einer Zahl. Je höher, desto stärker das allgemeine Reasoning.Mehr im Wissen → 23 (AA-CodingCoding-Teilindex von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Programmier-Benchmarks zu einem Wert für die Code-Fähigkeit eines Modells.Mehr im Wissen → 28); kein öffentlicher Token-Preis – Einordnung über AA-Indizes und die Anbieter-Spezifikation.

  • Enterprise-/Souveränitäts-Deployments
  • mehrsprachige Übersetzung
  • agentische Workflows
KontextfensterDie maximale Textmenge (in Tokens), die ein Modell pro Anfrage gleichzeitig „im Blick“ hat – Eingabe plus bisheriger Verlauf. Ist es voll, fällt Älteres aus dem Kontext.Mehr im Wissen →
128 KTokenDie kleinste Verarbeitungseinheit eines Sprachmodells – ein Wortstück, kein ganzes Wort. Faustregel: rund 1.000 Tokens entsprechen grob 750 deutschen Wörtern. Preise und Kontextlängen werden in Tokens gerechnet.Mehr im Wissen →
Max. Ausgabe
64 K Token
Preis (Input / Output)
k. A. je 1 Mio. Token

Stärken

  • Cohere-Flaggschiff und erstes Mixture-of-Experts-Modell des Anbieters
  • Vision-Eingabe plus agentische, Reasoning- und Übersetzungs-Fähigkeiten
  • Effizientes Deployment: läuft laut Anbieter auf 1× B200 oder 2× H100

Schwächen

  • Proprietär; kein öffentlicher $/Token-Preis (Enterprise-/Souveränitäts-Vertrieb)
  • KontextfensterDie maximale Textmenge (in Tokens), die ein Modell pro Anfrage gleichzeitig „im Blick“ hat – Eingabe plus bisheriger Verlauf. Ist es voll, fällt Älteres aus dem Kontext.Mehr im Wissen → 128 K – kleiner als das Vorgänger-Flaggschiff Command A (256 K)

Typische Einsatzfälle

  • Enterprise-/Souveränitäts-Deployments
  • agentische Workflows
  • mehrsprachige Übersetzung

Leistung im Vergleich

Unabhängige Indizes (Artificial Analysis, 0–100), zwei kontaminationsarme Einzel-Benchmarks (Terminal-Bench, agentische Shell-Aufgaben; τ²-bench, Tool-Use-Verlässlichkeit über viele Läufe) und Human-Präferenz-Elo (LMArena). Die dunkle Markierung zeigt den Bestwert im Katalog – so wird der Abstand zur Spitze sichtbar.

  • AA-IntelligenzZusammengesetzter Intelligenz-Index von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Reasoning-, Wissens- und Mathe-Benchmarks zu einer Zahl. Je höher, desto stärker das allgemeine Reasoning.Mehr im Wissen →23
  • AA-CodingCoding-Teilindex von Artificial Analysis (unabhängig, 0–100): bündelt mehrere Programmier-Benchmarks zu einem Wert für die Code-Fähigkeit eines Modells.Mehr im Wissen →28
  • τ²-benchBenchmark für die Verlässlichkeit beim Werkzeug-Einsatz: dieselbe Aufgabe wird viele Male wiederholt, gemessen wird, wie konstant das Modell die Tools korrekt bedient (0–100 %).Mehr im Wissen →81

Benchmarks im Detail

Kennzahlen aus zitierten Messungen – unabhängige Quellen sind ausgewiesen, Anbieterangaben entsprechend markiert. Werte sind nicht über Skalen hinweg vergleichbar. Wie man Benchmark-Zahlen liest →

  • Artificial Analysis Intelligence Index

    23

    unabhängigArtificial Analysis (API), abgerufen 2026-07-09

  • Artificial Analysis Coding Index

    28

    unabhängigArtificial Analysis (API), abgerufen 2026-07-09

  • τ²-bench (Tool-Use-Verlässlichkeit)

    81 %

    unabhängigArtificial Analysis (API), abgerufen 2026-06-16

Einordnung

  • Auf souveräne/Enterprise-Deployments ausgelegt: läuft laut Anbieter auf 1× B200 oder 2× H100 (Anbieterangabe) – effizientes Self-Hosting unter der Enterprise-Lizenz.
  • Kleineres Kontextfenster (128 K) als das Vorgänger-Flaggschiff Command A (256 K); kein öffentlicher per-TokenDie kleinste Verarbeitungseinheit eines Sprachmodells – ein Wortstück, kein ganzes Wort. Faustregel: rund 1.000 Tokens entsprechen grob 750 deutschen Wörtern. Preise und Kontextlängen werden in Tokens gerechnet.Mehr im Wissen →-Preis – Konditionen nur über Cohere.
  • Erster unabhängiger Wert: AA Intelligence Index 23 (AA Coding 28) – im Katalog-Mittelfeld, oberhalb der Open-Weight-Kleinmodelle.Beleg · Sekundärquelle

ℹ️ MoE (Mixture of Experts)Architektur, bei der je Anfrage nur ein Teil des Modells („Experten“) aktiv wird. So hat das Modell sehr viele Gesamt-Parameter, rechnet aber nur mit wenigen aktiven – das spart Rechenzeit.Mehr im Wissen →-Modell (Mai 2026), auf souveräne/kritische Infrastruktur ausgelegt. Kein öffentlicher per-Token-Preis – Konditionen über Cohere (Enterprise). Vorgänger-Flaggschiff Command A (command-a-03-2025): 256-K-Kontext, $2,50 / $10 je 1 Mio. Token. Cohere veröffentlicht Modellgewichte auf Hugging FaceDie zentrale Plattform, auf der offene KI-Modelle (ihre Gewichte) samt Spezifikation veröffentlicht und heruntergeladen werden – die „GitHub-Drehscheibe“ der open-weight-Szene.Mehr im Wissen → nur unter nicht-kommerzieller Forschungslizenz (kein open-weight im kommerziellen Sinn).