xAIs Imagine Image 2.0 steht auf Platz 2 beider Bild-Arenen – vorläufig, dünn belegt und mit der schnellen Variante
xAI (firmiert als SpaceXAI) hat am 8. August 2026 den Bildgenerator Imagine Image 2.0 veröffentlicht – als „Quality Mode“ auf grok.com/imagine sowie in den Grok-Apps für iOS und Android; ein API-Zugang ist ohne Datum angekündigt. Das Unternehmen beansprucht Platz 2 weltweit sowohl bei der Bilderzeugung als auch beim Bildbearbeiten und beruft sich dafür auf die Arena-Bestenlisten mit Stand 7. August 2026. Wir haben beide Listen selbst geöffnet: Die Platzierung stimmt – im Text-zu-Bild mit 1.320 Elo hinter OpenAIs gpt-image-2 (1.380), beim Bearbeiten mit 1.439 hinter 1.463. Zwei Einschränkungen stehen allerdings direkt daneben in der Tabelle und fehlen in der Meldung.
Der Stand der Arena-Bestenlisten, von uns am 8. August 2026 selbst abgerufen (Listen-Stand 7. August 2026, 5.895.429 Stimmen im Text-zu-Bild-Ranking). Text-zu-Bild: Platz 1 gpt-image-2 (medium) von OpenAI mit 1.380 ± 5 aus 69.194 Stimmen, Platz 2 grok-imagine-image-2.0 (low) von SpaceXAI mit 1.320 ± 12 aus 2.722 Stimmen (als vorläufig markiert), Platz 3 reve-2.1 mit 1.302 ± 8 aus 7.598 Stimmen (ebenfalls vorläufig). Bildbearbeitung: Platz 1 gpt-image-2 (medium) mit 1.463 ± 4 aus 184.189 Stimmen, Platz 2 grok-imagine-image-2.0 (low) mit 1.439 ± 8 aus 5.931 Stimmen (vorläufig).
Getrennt davon führen beide Listen Einträge unter dem Namen grok-imagine-image-quality, die deutlich tiefer stehen: beim Bearbeiten auf Platz 7 mit 1.390 ± 6 (35.613 Stimmen, Versionskennung 20260519) und auf Platz 13 mit 1.362 ± 4 (155.532 Stimmen), im Text-zu-Bild auf Platz 14 mit 1.228 ± 4 (48.786 Stimmen). Beide tragen ältere Stände – der eine ausdrücklich auf den 19. Mai 2026 datiert, also vor dieser Veröffentlichung. Ob und wie sie zu dem jetzt angekündigten „Quality Mode“ gehören, geht aus der Tabelle nicht hervor; wir schreiben es ihnen deshalb nicht zu.
Zu den Funktionen, die beide von uns geöffneten Wiedergaben übereinstimmend nennen: „Magic Wand“ bearbeitet nur den markierten Bildbereich, eine Segmentierung grenzt Bereiche präzise ab, dazu kommen Hintergrundentfernung, „Multi-Ref Editing“ mit bis zu fünf Eingabebildern in einer Generierung sowie vorkonfigurierte Vorlagen für E-Commerce und Marketing. Bei „Smart Resize“ – ein bestehendes Bild wird auf ein anderes Seitenverhältnis gerechnet und der Zuwachs vom Modell selbst gefüllt – weichen die Quellen voneinander ab: Unite.AI nennt neun vorgegebene Seitenverhältnisse, The Decoder spricht von beliebigen. Wir führen die Funktion ohne Zahl.
⚠️ Zur Beleglage: `x.ai` weist unseren Abruf mit HTTP 403 ab – die Primärquelle ist real, gelesen haben wir sie nicht; die URL steht als Herkunftsnachweis in den Quellen. Alle Angaben zu Modell, Funktionen und Verfügbarkeit stammen daher aus zwei unabhängig voneinander geöffneten Wiedergaben (The Decoder, Unite.AI); die Elo-Werte, Stimmenzahlen und Konfidenzintervalle haben wir dagegen nicht übernommen, sondern an den beiden Bestenlisten selbst nachgesehen. Zur Natur dieser Messung gehört, dass sie ein Blindvergleich menschlicher Präferenz ist – sie misst, welches Bild Nutzern besser gefällt, nicht Instruktionstreue, Faktentreue oder Textwiedergabe im Bild. Preise für Imagine Image 2.0 nennt keine Quelle; ein Datum für den API-Zugang ebenfalls nicht. Ein Katalogeintrag für Grok Imagine entsteht daraus vorerst nicht: Für Tarif, Plattform-Umfang und Grenzen fehlt uns eine abrufbare Anbieterquelle.