Direktvergleich
GPT Image 1.5 vs. Grok Imagine Image 2.0
Vergleiche gemeinsame Fähigkeitstests, Arena-Werte mit dokumentiertem Abrufdatum, aufgabenspezifische Bildpreise und geprüfte technische Daten. Forschungs-Benchmarks, Präferenz-Arenen und unsere Stichproben mit n = 1 bleiben getrennt.
- gemeinsame Messreihen
- 2
- gemeinsame Bildmotive
- 0
- jüngster Arena-Abruf
- 22.09.2026
Bildmodellauswahl ändern
Steckbrief und Kosten
Allgemeine Daten und aufgabenspezifische Preise
Ein Modell kann für neue Bilder einen anderen Preis haben als für Bearbeitungen. Deshalb bleibt der Preis an die jeweilige Arena-Konfiguration gebunden.
| Merkmal | GPT Image 1.5 | Grok Imagine Image 2.0 |
|---|---|---|
| Anbieter | OpenAI | xAI |
| Erschienen | Dezember 2025 | 7. August 2026 |
| Zugang | API, Web-App | API, Web-App |
| Lebenszyklus | Von OpenAI als veraltet markiert; Abschaltung aus der API am 1. Dezember 2026 Statusquelle | Kein gesonderter Statushinweis hinterlegt |
| Gewichte | Proprietär | Proprietär |
| Parameter | Nicht veröffentlicht | Nicht veröffentlicht |
| Maximale Ausgabe | 1.536 × 1.024 Pixel | 2K |
| Arena-Konfiguration | High | Keine separate Konfiguration benannt |
| Text-zu-Bild-Preis | 133 $ pro 1.000 Bilder | 60 $ pro 1.000 Bilder |
| Editing-Preis | 133 $ pro 1.000 Bilder | 60 $ pro 1.000 Bilder |
| Technische Quelle | ModellquelleGeprüft 15.08.2026 | ModellquelleGeprüft 28.09.2026 |
Zeichenerklärung:besserer Wertbesser, aber nicht eindeutigGleichstand
Prompt-Treue und Fachtests
Gemeinsame Fähigkeits-Benchmarks
Diese exakten Checkpoints haben das feste Gradually-Stichprobenprotokoll noch nicht beide absolviert. Frühere Modellstände dienen nicht als Ersatz. Für dieses Paar liegt aus den eingebundenen Forschungs-Benchmarks kein exakt gemeinsamer Modellstand vor.
Noch kein gemeinsames Gradually-Ranking
Ein Wert erscheint erst, wenn beide exakten Checkpoints alle vier festen Prompts und dieselbe verblindete Auswertung abgeschlossen haben.
Unabhängige Präferenztests
Gemeinsame Arena-Benchmarks
Artificial Analysis und Arena ermitteln Bewertungswerte aus Blindvergleichen. Personen sehen Ausgaben zum gleichen Prompt und wählen ihr bevorzugtes Bild. Neben Gesamtwerten findest du hier getrennte Messreihen für Textdarstellung, Fotorealismus, Porträts, Kunst, kommerzielles Design und Bildbearbeitung. Die Konfidenzintervalle zeigen, wie sicher der jeweilige Vorsprung ist.
Zeichenerklärung:besserer Wertbesser, aber nicht eindeutigGleichstand
| Benchmark | GPT Image 1.5 | Grok Imagine Image 2.0 | Quelle |
|---|---|---|---|
| Text to Image Arena | 1.102 Elo Platz 9, 95-%-Konfidenzintervall: ±9, 14.748 Bewertungen | Höherer Wert1.157 Elo Platz 4, 95-%-Konfidenzintervall: ±11, 6.270 Bewertungen | Artificial AnalysisAbruf 22.09.2026 |
| Image Editing Arena | 1.103 Elo Platz 12, 95-%-Konfidenzintervall: ±9, 12.789 Bewertungen | Kein klarer Vorsprung1.105 Elo Platz 11, 95-%-Konfidenzintervall: ±9, 6.441 Bewertungen | Artificial AnalysisAbruf 22.09.2026 |
Zeichenerklärung:besserer Wertbesser, aber nicht eindeutigGleichstand | |||
Visueller Vergleich
Beispielbilder
Eigene Bilder ergänzen die Präferenzdaten, ersetzen sie aber nicht. Prompt, Anzahl der Aufträge und Auswahlregel sind gleich. Anbieterabhängige Auflösung, Qualitätsstufe, Zufall und Prompt-Verarbeitung bleiben sichtbar und verhindern eine vollständig kontrollierte Labormessung.
Noch kein gemeinsamer dokumentierter Lauf
Die feste Testsuite umfasst Typografie, Produktfoto, Figurendetails und Infografik. Ein Motiv erscheint erst, wenn für beide Modelle ein überprüfbarer erster Lauf vorliegt.
Fehlender Bildlauf für Grok Imagine Image 2.0
Fehlende Motive. Typografie und Layout, Produktfotografie, Figur und Details, Infografik.
Für dieses Modell liegen noch keine Ergebnisse mit den vier festen Testprompts vor.
Nächster Schritt. Die vier festen Prompts mit diesem Modell ausführen, die ersten Ergebnisse archivieren und verblindet auswerten.
DokumentationSo liest du den Vergleich
Ein Elo-Wert ist kein Kreativurteil
Ein höherer Arena-Wert bedeutet, dass diese konkrete Konfiguration in Blindwahlen häufiger bevorzugt wurde.
Typografie, Charakterkonsistenz, lokale Ausführung, Lizenz und Preis können für deinen Einsatz wichtiger sein als der Gesamteindruck.
Preise gelten für 1.000 Bilder mit 1.024 × 1.024 Pixeln und den von Artificial Analysis dokumentierten Standardeinstellungen. Abos und Sondertarife sind nicht eingerechnet.
Weitere Duelle
Ähnliche Bildmodell-Vergleiche
Vergleiche GPT Image 1.5 und Grok Imagine Image 2.0 mit weiteren wichtigen Bildmodellen nach denselben Evidenzregeln. Jede Seite zeigt nur exakte gemeinsame Messwerte und Testbilder.
Zum vollständigen Bildmodelle-Vergleich