Zum Hauptinhalt springen
BildmodellKeine Statusangabe

GPT Image 2

OpenAI

Veröffentlicht
April 2026
Datenstand
15. August 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.

Position
Platz 2 von 28
Indexwert
71 / 100
Abdeckung
4 / 4

Bestenliste

1MAI-Image-2.5 Flash76,6 / 100
2GPT Image 2, Aktuelles Modell71 / 100
3MAI-Image-2.567,6 / 100
28Stable Diffusion 3.5 Large2,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

Text to Image Arena

1.371 Elo · Platz 1 von 25

Stichprobe: 14.328 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell1.371 Elo
2.Reve 2.11.322 Elo
3.Nano Banana 21.321 Elo
25.FLUX.2 Klein 9B1.144 Elo

4 von 25 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Image Editing Arena

1.257 Elo · Platz 2 von 19

Stichprobe: 18.356 · Datenstand: 26. August 2026

1.Reve 2.11.263 Elo
2.GPT Image 2, Aktuelles Modell1.257 Elo
2.MAI-Image-2.51.257 Elo
4.GPT Image 1.51.251 Elo
19.FLUX.2 Flex1.162 Elo

5 von 19 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

GenExam Mathematik, streng

50,3 % · Platz 3 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 256,3 %
2.Nano Banana Pro55,6 %
3.GPT Image 2, Aktuelles Modell50,3 %
4.GPT Image 1.526,5 %
5.FLUX.2 Max6,6 %
6.Seedream 4.02,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, streng

79,6 % · Platz 1 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell79,6 %
2.Nano Banana Pro75,2 %
3.Nano Banana 274,3 %
4.GPT Image 1.546 %
5.FLUX.2 Max8,8 %
6.Seedream 4.03,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, streng

69,5 % · Platz 1 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell69,5 %
2.Nano Banana Pro60,2 %
3.Nano Banana 252,5 %
4.GPT Image 1.539 %
5.FLUX.2 Max6,8 %
6.Seedream 4.05,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, streng

89,1 % · Platz 1 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell89,1 %
2.Nano Banana Pro75,6 %
3.Nano Banana 266 %
4.GPT Image 1.556,4 %
5.Seedream 4.018,6 %
6.FLUX.2 Max11,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, streng

84,8 % · Platz 1 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell84,8 %
2.Nano Banana Pro75,8 %
3.Nano Banana 269,7 %
4.GPT Image 1.560,6 %
5.FLUX.2 Max15,2 %
6.Seedream 4.010,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, streng

73,5 % · Platz 1 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell73,5 %
2.Nano Banana Pro65,7 %
3.Nano Banana 256,9 %
4.GPT Image 1.536,3 %
5.FLUX.2 Max8,8 %
6.Seedream 4.06,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, streng

79,3 % · Platz 1 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell79,3 %
2.Nano Banana Pro71,2 %
3.Nano Banana 267,6 %
4.GPT Image 1.544,1 %
5.Seedream 4.011,7 %
6.FLUX.2 Max10,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, streng

83,1 % · Platz 2 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.Nano Banana Pro88,3 %
2.GPT Image 2, Aktuelles Modell83,1 %
3.Nano Banana 263,6 %
4.GPT Image 1.542,9 %
5.Seedream 4.05,2 %
6.FLUX.2 Max2,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, streng

64,6 % · Platz 1 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell64,6 %
2.Nano Banana Pro61,5 %
3.Nano Banana 250,8 %
4.GPT Image 1.529,2 %
5.FLUX.2 Max6,2 %
6.Seedream 4.00 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, streng

82,9 % · Platz 2 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro97,6 %
2.GPT Image 2, Aktuelles Modell82,9 %
2.Nano Banana 282,9 %
4.GPT Image 1.551,2 %
5.FLUX.2 Max7,3 %
5.Seedream 4.07,3 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, streng

74,6 % · Platz 1 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell74,6 %
2.Nano Banana Pro72,7 %
3.Nano Banana 264,1 %
4.GPT Image 1.543,2 %
5.FLUX.2 Max8,5 %
6.Seedream 4.07,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Mathematik, gelockert

85,2 % · Platz 3 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 287,8 %
2.Nano Banana Pro86,3 %
3.GPT Image 2, Aktuelles Modell85,2 %
4.GPT Image 1.565,8 %
5.FLUX.2 Max49,1 %
6.Seedream 4.039,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, gelockert

95,6 % · Platz 2 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.Nano Banana 295,7 %
2.GPT Image 2, Aktuelles Modell95,6 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.585,4 %
5.FLUX.2 Max63,2 %
6.Seedream 4.049 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, gelockert

92 % · Platz 1 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell92 %
2.Nano Banana 290 %
3.Nano Banana Pro88,7 %
4.GPT Image 1.578,1 %
5.FLUX.2 Max54 %
6.Seedream 4.046,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, gelockert

97,5 % · Platz 1 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell97,5 %
2.Nano Banana Pro95,9 %
3.Nano Banana 295,2 %
4.GPT Image 1.591,9 %
5.FLUX.2 Max74,5 %
6.Seedream 4.071 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, gelockert

97,6 % · Platz 1 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell97,6 %
2.Nano Banana Pro96,5 %
3.Nano Banana 294,8 %
4.GPT Image 1.592,5 %
5.FLUX.2 Max76,3 %
6.Seedream 4.065,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, gelockert

93,3 % · Platz 1 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell93,3 %
2.Nano Banana Pro91,7 %
3.Nano Banana 288,8 %
4.GPT Image 1.575,8 %
5.FLUX.2 Max56,5 %
6.Seedream 4.052,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, gelockert

96,5 % · Platz 1 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell96,5 %
2.Nano Banana 295,8 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.586,4 %
5.FLUX.2 Max68,9 %
6.Seedream 4.060 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, gelockert

97,7 % · Platz 1 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell97,7 %
2.Nano Banana Pro97,2 %
3.Nano Banana 294,2 %
4.GPT Image 1.585,5 %
5.FLUX.2 Max61,5 %
6.Seedream 4.056 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, gelockert

89,1 % · Platz 2 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.Nano Banana Pro91 %
2.GPT Image 2, Aktuelles Modell89,1 %
3.Nano Banana 286,9 %
4.GPT Image 1.570,8 %
5.FLUX.2 Max47 %
6.Seedream 4.034,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, gelockert

97,1 % · Platz 3 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro99,9 %
2.Nano Banana 297,3 %
3.GPT Image 2, Aktuelles Modell97,1 %
4.GPT Image 1.590,9 %
5.FLUX.2 Max68 %
6.Seedream 4.056,7 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, gelockert

93,8 % · Platz 1 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell93,8 %
2.Nano Banana Pro93,7 %
3.Nano Banana 292,6 %
4.GPT Image 1.582,3 %
5.FLUX.2 Max61,9 %
6.Seedream 4.053 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

Qwen Image Bench Qualität

58,65 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell58,65 Punkte
2.Nano Banana Pro55,67 Punkte
3.GPT Image 1.555,14 Punkte
4.Nano Banana 254,77 Punkte
5.Qwen Image 2.0 Pro54,39 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Ästhetik

67,53 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell67,53 Punkte
2.Nano Banana 261,08 Punkte
3.GPT Image 1.560,88 Punkte
4.Nano Banana Pro60,26 Punkte
5.Qwen Image 2.0 Pro58,67 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Prompt-Treue

65,85 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell65,85 Punkte
2.Nano Banana 262,4 Punkte
3.GPT Image 1.561,72 Punkte
4.Nano Banana Pro61,25 Punkte
5.Qwen Image 2.0 Pro59,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Realitätsnähe

57,38 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell57,38 Punkte
2.Nano Banana 254,28 Punkte
3.Nano Banana Pro54,07 Punkte
4.GPT Image 1.553,95 Punkte
5.Qwen Image 2.0 Pro51,83 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Kreativität

75,23 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell75,23 Punkte
2.Nano Banana 267,05 Punkte
3.GPT Image 1.566,35 Punkte
4.Nano Banana Pro66,23 Punkte
5.Qwen Image 2.0 Pro64,94 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Gesamtwert

64,69 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell64,69 Punkte
2.Nano Banana 259,82 Punkte
3.GPT Image 1.559,65 Punkte
4.Nano Banana Pro59,45 Punkte
5.Qwen Image 2.0 Pro57,84 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

GRADE Schlussfolgern

82,2 Punkte · Platz 1 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell82,2 Punkte
2.Nano Banana Pro77,5 Punkte
3.Nano Banana 272,6 Punkte
4.GPT Image 1.554,5 Punkte
5.FLUX.2 Max47,8 Punkte
6.FLUX.2 Pro38,9 Punkte
7.Seedream 4.032,4 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Konsistenz

94,4 Punkte · Platz 1 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell94,4 Punkte
2.Nano Banana Pro89,5 Punkte
3.Nano Banana 286,4 Punkte
4.GPT Image 1.582,3 Punkte
5.FLUX.2 Max67,2 Punkte
6.FLUX.2 Pro55,5 Punkte
7.Seedream 4.053,2 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Lesbarkeit

98,8 Punkte · Platz 1 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell98,8 Punkte
2.Nano Banana 295,9 Punkte
3.Nano Banana Pro95,8 Punkte
4.GPT Image 1.590,7 Punkte
5.Seedream 4.077 Punkte
6.FLUX.2 Pro70,3 Punkte
7.FLUX.2 Max68,6 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE fachliche Genauigkeit

56 Punkte · Platz 1 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 2, Aktuelles Modell56 Punkte
2.Nano Banana Pro46,2 Punkte
3.Nano Banana 239,6 Punkte
4.GPT Image 1.516 Punkte
5.FLUX.2 Max11,9 Punkte
6.FLUX.2 Pro4,4 Punkte
7.Seedream 4.03,1 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

Gradually-Bildtest: Typografie und Layout

35,8 Rangpunkte · Platz 20 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.593,8 Rangpunkte
18.Seedream 5.0 Pro40,7 Rangpunkte
19.Krea 2 Medium Turbo39,5 Rangpunkte
20.GPT Image 2, Aktuelles Modell35,8 Rangpunkte
20.Reve 2.135,8 Rangpunkte
22.GPT Image 1.533,3 Rangpunkte
28.Stable Diffusion 3.5 Large0 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Produktfotografie

95,1 Rangpunkte · Platz 1 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.GPT Image 2, Aktuelles Modell95,1 Rangpunkte
2.MAI-Image-2.5 Flash93,8 Rangpunkte
3.MAI-Image-2.586,4 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

4 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Figur und Details

76,6 Rangpunkte · Platz 5 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.5 Flash86,4 Rangpunkte
3.FLUX.2 Max80,3 Rangpunkte
4.HiDream-O1-Image-1.579 Rangpunkte
5.GPT Image 2, Aktuelles Modell76,6 Rangpunkte
5.Qwen Image 2.0 Pro76,6 Rangpunkte
7.Recraft V4.1 Utility72,9 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Infografik

76,6 Rangpunkte · Platz 7 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.Reve 2.197,5 Rangpunkte
5.Krea 2 Medium Turbo82,7 Rangpunkte
6.MAI-Image-2.5 Flash80,3 Rangpunkte
7.GPT Image 2, Aktuelles Modell76,6 Rangpunkte
8.HiDream-O1-Image-1.574,1 Rangpunkte
9.Seedream 4.067,9 Rangpunkte
28.Firefly Image Model 51,2 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Gewichte
ProprietärQuelle
Zugang
API, WebQuelle
Maximale Ausgabe
4KQuelle
Benchmark-Konfiguration
HighQuelle
Generator
gpt-image-2Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

Repräsentativer Preis
0,21 $ pro BildQuelle
Together AI (openai/gpt-image-2)
0,05 $ pro BildQuelle

Messwerte

Weitere veröffentlichte Benchmarks

Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.

LMArena Text to Image: 3D modeling

1.360,37 Punkte

Rang 1 · 6.635 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Art

1.370,44 Punkte

Rang 1 · 8.762 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Cartoon

1.396,03 Punkte

Rang 1 · 28.210 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Commercial design

1.389,56 Punkte

Rang 1 · 27.138 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Overall

1.380,47 Punkte

Rang 1 · 69.194 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Photorealism

1.378,29 Punkte

Rang 1 · 26.719 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Portraits

1.428,87 Punkte

Rang 1 · 13.521 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Text rendering

1.424,05 Punkte

Rang 1 · 26.226 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Multi-image editing

1.454,12 Punkte

Rang 1 · 72.134 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Overall

1.462,8 Punkte

Rang 1 · 199.275 Beobachtungen · Abgerufen 26. August 2026

LMArena

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • OpenAIQuelle
  • Bildmodell-PreiseQuelle
  • Together AIQuelle
  • Artificial Analysis (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • GenExam (abgerufen 26. August 2026)Quelle
  • Qwen Image Bench (abgerufen 26. August 2026)Quelle
  • GRADE (abgerufen 26. August 2026)Quelle
  • Gradually-Bildtest (abgerufen 18. August 2026)Quelle