Zum Hauptinhalt springen
BildmodellVeraltet

GPT Image 1.5

OpenAI

Veröffentlicht
Dezember 2025
Datenstand
15. August 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.

Position
Platz 17 von 28
Indexwert
51,2 / 100
Abdeckung
4 / 4

Bestenliste

1MAI-Image-2.5 Flash76,6 / 100
2GPT Image 271 / 100
3MAI-Image-2.567,6 / 100
16Ideogram 4.051,9 / 100
17GPT Image 1.5, Aktuelles Modell51,2 / 100
18FLUX.2 Flex47,2 / 100
28Stable Diffusion 3.5 Large2,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

Text to Image Arena

1.310 Elo · Platz 4 von 25

Stichprobe: 13.674 · Datenstand: 26. August 2026

1.GPT Image 21.371 Elo
2.Reve 2.11.322 Elo
3.Nano Banana 21.321 Elo
4.GPT Image 1.5, Aktuelles Modell1.310 Elo
5.MAI-Image-2.51.303 Elo
6.Nano Banana Pro1.298 Elo
25.FLUX.2 Klein 9B1.144 Elo

7 von 25 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Image Editing Arena

1.251 Elo · Platz 4 von 19

Stichprobe: 11.694 · Datenstand: 26. August 2026

1.Reve 2.11.263 Elo
2.GPT Image 21.257 Elo
2.MAI-Image-2.51.257 Elo
4.GPT Image 1.5, Aktuelles Modell1.251 Elo
5.Nano Banana 21.250 Elo
6.Seedream 5.0 Pro1.248 Elo
19.FLUX.2 Flex1.162 Elo

7 von 19 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

GenExam Mathematik, streng

26,5 % · Platz 4 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 256,3 %
2.Nano Banana Pro55,6 %
3.GPT Image 250,3 %
4.GPT Image 1.5, Aktuelles Modell26,5 %
5.FLUX.2 Max6,6 %
6.Seedream 4.02,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, streng

46 % · Platz 4 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.GPT Image 279,6 %
2.Nano Banana Pro75,2 %
3.Nano Banana 274,3 %
4.GPT Image 1.5, Aktuelles Modell46 %
5.FLUX.2 Max8,8 %
6.Seedream 4.03,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, streng

39 % · Platz 4 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 269,5 %
2.Nano Banana Pro60,2 %
3.Nano Banana 252,5 %
4.GPT Image 1.5, Aktuelles Modell39 %
5.FLUX.2 Max6,8 %
6.Seedream 4.05,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, streng

56,4 % · Platz 4 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 289,1 %
2.Nano Banana Pro75,6 %
3.Nano Banana 266 %
4.GPT Image 1.5, Aktuelles Modell56,4 %
5.Seedream 4.018,6 %
6.FLUX.2 Max11,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, streng

60,6 % · Platz 4 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 284,8 %
2.Nano Banana Pro75,8 %
3.Nano Banana 269,7 %
4.GPT Image 1.5, Aktuelles Modell60,6 %
5.FLUX.2 Max15,2 %
6.Seedream 4.010,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, streng

36,3 % · Platz 4 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 273,5 %
2.Nano Banana Pro65,7 %
3.Nano Banana 256,9 %
4.GPT Image 1.5, Aktuelles Modell36,3 %
5.FLUX.2 Max8,8 %
6.Seedream 4.06,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, streng

44,1 % · Platz 4 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 279,3 %
2.Nano Banana Pro71,2 %
3.Nano Banana 267,6 %
4.GPT Image 1.5, Aktuelles Modell44,1 %
5.Seedream 4.011,7 %
6.FLUX.2 Max10,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, streng

42,9 % · Platz 4 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.Nano Banana Pro88,3 %
2.GPT Image 283,1 %
3.Nano Banana 263,6 %
4.GPT Image 1.5, Aktuelles Modell42,9 %
5.Seedream 4.05,2 %
6.FLUX.2 Max2,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, streng

29,2 % · Platz 4 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.GPT Image 264,6 %
2.Nano Banana Pro61,5 %
3.Nano Banana 250,8 %
4.GPT Image 1.5, Aktuelles Modell29,2 %
5.FLUX.2 Max6,2 %
6.Seedream 4.00 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, streng

51,2 % · Platz 4 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro97,6 %
2.GPT Image 282,9 %
2.Nano Banana 282,9 %
4.GPT Image 1.5, Aktuelles Modell51,2 %
5.FLUX.2 Max7,3 %
5.Seedream 4.07,3 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, streng

43,2 % · Platz 4 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 274,6 %
2.Nano Banana Pro72,7 %
3.Nano Banana 264,1 %
4.GPT Image 1.5, Aktuelles Modell43,2 %
5.FLUX.2 Max8,5 %
6.Seedream 4.07,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Mathematik, gelockert

65,8 % · Platz 4 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 287,8 %
2.Nano Banana Pro86,3 %
3.GPT Image 285,2 %
4.GPT Image 1.5, Aktuelles Modell65,8 %
5.FLUX.2 Max49,1 %
6.Seedream 4.039,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, gelockert

85,4 % · Platz 4 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.Nano Banana 295,7 %
2.GPT Image 295,6 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.5, Aktuelles Modell85,4 %
5.FLUX.2 Max63,2 %
6.Seedream 4.049 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, gelockert

78,1 % · Platz 4 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 292 %
2.Nano Banana 290 %
3.Nano Banana Pro88,7 %
4.GPT Image 1.5, Aktuelles Modell78,1 %
5.FLUX.2 Max54 %
6.Seedream 4.046,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, gelockert

91,9 % · Platz 4 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 297,5 %
2.Nano Banana Pro95,9 %
3.Nano Banana 295,2 %
4.GPT Image 1.5, Aktuelles Modell91,9 %
5.FLUX.2 Max74,5 %
6.Seedream 4.071 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, gelockert

92,5 % · Platz 4 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 297,6 %
2.Nano Banana Pro96,5 %
3.Nano Banana 294,8 %
4.GPT Image 1.5, Aktuelles Modell92,5 %
5.FLUX.2 Max76,3 %
6.Seedream 4.065,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, gelockert

75,8 % · Platz 4 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 293,3 %
2.Nano Banana Pro91,7 %
3.Nano Banana 288,8 %
4.GPT Image 1.5, Aktuelles Modell75,8 %
5.FLUX.2 Max56,5 %
6.Seedream 4.052,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, gelockert

86,4 % · Platz 4 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 296,5 %
2.Nano Banana 295,8 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.5, Aktuelles Modell86,4 %
5.FLUX.2 Max68,9 %
6.Seedream 4.060 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, gelockert

85,5 % · Platz 4 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.GPT Image 297,7 %
2.Nano Banana Pro97,2 %
3.Nano Banana 294,2 %
4.GPT Image 1.5, Aktuelles Modell85,5 %
5.FLUX.2 Max61,5 %
6.Seedream 4.056 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, gelockert

70,8 % · Platz 4 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.Nano Banana Pro91 %
2.GPT Image 289,1 %
3.Nano Banana 286,9 %
4.GPT Image 1.5, Aktuelles Modell70,8 %
5.FLUX.2 Max47 %
6.Seedream 4.034,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, gelockert

90,9 % · Platz 4 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro99,9 %
2.Nano Banana 297,3 %
3.GPT Image 297,1 %
4.GPT Image 1.5, Aktuelles Modell90,9 %
5.FLUX.2 Max68 %
6.Seedream 4.056,7 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, gelockert

82,3 % · Platz 4 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 293,8 %
2.Nano Banana Pro93,7 %
3.Nano Banana 292,6 %
4.GPT Image 1.5, Aktuelles Modell82,3 %
5.FLUX.2 Max61,9 %
6.Seedream 4.053 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

Qwen Image Bench Qualität

55,14 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 258,65 Punkte
2.Nano Banana Pro55,67 Punkte
3.GPT Image 1.5, Aktuelles Modell55,14 Punkte
4.Nano Banana 254,77 Punkte
5.Qwen Image 2.0 Pro54,39 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Ästhetik

60,88 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 267,53 Punkte
2.Nano Banana 261,08 Punkte
3.GPT Image 1.5, Aktuelles Modell60,88 Punkte
4.Nano Banana Pro60,26 Punkte
5.Qwen Image 2.0 Pro58,67 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Prompt-Treue

61,72 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 265,85 Punkte
2.Nano Banana 262,4 Punkte
3.GPT Image 1.5, Aktuelles Modell61,72 Punkte
4.Nano Banana Pro61,25 Punkte
5.Qwen Image 2.0 Pro59,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Realitätsnähe

53,95 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.GPT Image 257,38 Punkte
2.Nano Banana 254,28 Punkte
3.Nano Banana Pro54,07 Punkte
4.GPT Image 1.5, Aktuelles Modell53,95 Punkte
5.Qwen Image 2.0 Pro51,83 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Kreativität

66,35 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 275,23 Punkte
2.Nano Banana 267,05 Punkte
3.GPT Image 1.5, Aktuelles Modell66,35 Punkte
4.Nano Banana Pro66,23 Punkte
5.Qwen Image 2.0 Pro64,94 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

Qwen Image Bench Gesamtwert

59,65 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 264,69 Punkte
2.Nano Banana 259,82 Punkte
3.GPT Image 1.5, Aktuelles Modell59,65 Punkte
4.Nano Banana Pro59,45 Punkte
5.Qwen Image 2.0 Pro57,84 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.

WISE Verified Gesamtwert

82,5 % · Platz 2 von 4

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.Nano Banana Pro87,6 %
2.GPT Image 1.5, Aktuelles Modell82,5 %
3.FLUX.2 Klein 9B44 %
4.Stable Diffusion 3.5 Large40,4 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Kultur

89 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro89,75 %
2.GPT Image 1.5, Aktuelles Modell89 %
3.FLUX.2 Klein 9B49 %
3.Stable Diffusion 3.5 Large49 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Zeit

69,17 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro81,67 %
2.GPT Image 1.5, Aktuelles Modell69,17 %
3.Stable Diffusion 3.5 Large40,83 %
4.FLUX.2 Klein 9B39,17 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Raum

88,33 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro93,33 %
2.GPT Image 1.5, Aktuelles Modell88,33 %
3.FLUX.2 Klein 9B55 %
4.Stable Diffusion 3.5 Large44,17 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Biologie

80 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro81,67 %
2.GPT Image 1.5, Aktuelles Modell80 %
3.FLUX.2 Klein 9B38,33 %
4.Stable Diffusion 3.5 Large30 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Physik

75,83 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro86,67 %
2.GPT Image 1.5, Aktuelles Modell75,83 %
3.FLUX.2 Klein 9B48,33 %
4.Stable Diffusion 3.5 Large37,5 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

WISE Chemie

77,5 % · Platz 2 von 4

Datenstand: 26. August 2026

1.Nano Banana Pro87,5 %
2.GPT Image 1.5, Aktuelles Modell77,5 %
3.FLUX.2 Klein 9B22,5 %
4.Stable Diffusion 3.5 Large20,83 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.

GRADE Schlussfolgern

54,5 Punkte · Platz 4 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 282,2 Punkte
2.Nano Banana Pro77,5 Punkte
3.Nano Banana 272,6 Punkte
4.GPT Image 1.5, Aktuelles Modell54,5 Punkte
5.FLUX.2 Max47,8 Punkte
6.FLUX.2 Pro38,9 Punkte
7.Seedream 4.032,4 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Konsistenz

82,3 Punkte · Platz 4 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 294,4 Punkte
2.Nano Banana Pro89,5 Punkte
3.Nano Banana 286,4 Punkte
4.GPT Image 1.5, Aktuelles Modell82,3 Punkte
5.FLUX.2 Max67,2 Punkte
6.FLUX.2 Pro55,5 Punkte
7.Seedream 4.053,2 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Lesbarkeit

90,7 Punkte · Platz 4 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 298,8 Punkte
2.Nano Banana 295,9 Punkte
3.Nano Banana Pro95,8 Punkte
4.GPT Image 1.5, Aktuelles Modell90,7 Punkte
5.Seedream 4.077 Punkte
6.FLUX.2 Pro70,3 Punkte
7.FLUX.2 Max68,6 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE fachliche Genauigkeit

16 Punkte · Platz 4 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 256 Punkte
2.Nano Banana Pro46,2 Punkte
3.Nano Banana 239,6 Punkte
4.GPT Image 1.5, Aktuelles Modell16 Punkte
5.FLUX.2 Max11,9 Punkte
6.FLUX.2 Pro4,4 Punkte
7.Seedream 4.03,1 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GEBench Chinesisch, Einzelschritt

83,79 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,5 Punkte
2.GPT Image 1.5, Aktuelles Modell83,79 Punkte
3.FLUX.2 Pro68,83 Punkte
4.Wan 2.6 Text to Image64,2 Punkte
5.Seedream 4.062,04 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Mehrschritt

56,97 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro68,65 Punkte
2.GPT Image 1.5, Aktuelles Modell56,97 Punkte
3.FLUX.2 Pro55,07 Punkte
4.Wan 2.6 Text to Image50,11 Punkte
5.Seedream 4.048,64 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, fiktive App

60,11 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro65,75 Punkte
2.GPT Image 1.5, Aktuelles Modell60,11 Punkte
3.FLUX.2 Pro58,13 Punkte
4.Wan 2.6 Text to Image52,72 Punkte
5.Seedream 4.049,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, reale App

55,65 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,35 Punkte
2.GPT Image 1.5, Aktuelles Modell55,65 Punkte
3.FLUX.2 Pro55,41 Punkte
4.Seedream 4.050,93 Punkte
5.Wan 2.6 Text to Image50,4 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Verankerung

53,33 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,83 Punkte
2.Wan 2.6 Text to Image59,58 Punkte
3.Seedream 4.053,53 Punkte
4.GPT Image 1.5, Aktuelles Modell53,33 Punkte
5.FLUX.2 Pro50,24 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Gesamtwert

63,22 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,62 Punkte
2.GPT Image 1.5, Aktuelles Modell63,22 Punkte
3.FLUX.2 Pro57,54 Punkte
4.Wan 2.6 Text to Image55,4 Punkte
5.Seedream 4.052,88 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Einzelschritt

80,8 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,32 Punkte
2.GPT Image 1.5, Aktuelles Modell80,8 Punkte
3.FLUX.2 Pro61 Punkte
4.Wan 2.6 Text to Image60,17 Punkte
5.Seedream 4.053,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Mehrschritt

58,87 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,51 Punkte
2.GPT Image 1.5, Aktuelles Modell58,87 Punkte
3.FLUX.2 Pro52,17 Punkte
4.Wan 2.6 Text to Image44,36 Punkte
5.Seedream 4.037,57 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, fiktive App

63,68 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 1.5, Aktuelles Modell63,68 Punkte
2.FLUX.2 Pro49,92 Punkte
3.Wan 2.6 Text to Image49,55 Punkte
4.Seedream 4.047,92 Punkte
5.Nano Banana Pro46,33 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, reale App

58,93 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 1.5, Aktuelles Modell58,93 Punkte
2.Seedream 4.049,36 Punkte
3.Nano Banana Pro47,2 Punkte
4.FLUX.2 Pro47,16 Punkte
5.Wan 2.6 Text to Image44,8 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Verankerung

49,23 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro58,64 Punkte
2.Wan 2.6 Text to Image53,36 Punkte
3.GPT Image 1.5, Aktuelles Modell49,23 Punkte
4.FLUX.2 Pro45,67 Punkte
5.Seedream 4.044,17 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Gesamtwert

63,16 Punkte · Platz 1 von 5

Datenstand: 26. August 2026

1.GPT Image 1.5, Aktuelles Modell63,16 Punkte
2.Nano Banana Pro61,2 Punkte
3.FLUX.2 Pro51,18 Punkte
4.Wan 2.6 Text to Image50,45 Punkte
5.Seedream 4.046,46 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GenAI-Bench Gesamtpräferenz

1.047 Elo · Platz 2 von 3

Datenstand: 26. August 2026

1.Nano Banana 21.073 Elo
2.GPT Image 1.5, Aktuelles Modell1.047 Elo
3.Nano Banana Pro1.021 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

GenAI-Bench Bildqualität

975 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana 21.129 Elo
2.Nano Banana Pro1.043 Elo
3.GPT Image 1.5, Aktuelles Modell975 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Infografiken, Faktentreue

985 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.102 Elo
2.Nano Banana 21.074 Elo
3.GPT Image 1.5, Aktuelles Modell985 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Allgemeine Bildbearbeitung

995 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.051 Elo
2.Nano Banana 21.047 Elo
3.GPT Image 1.5, Aktuelles Modell995 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Figurenbearbeitung

1.025 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.050 Elo
2.Nano Banana 21.049 Elo
3.GPT Image 1.5, Aktuelles Modell1.025 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Kreative Bildbearbeitung

1.017 Elo · Platz 2 von 3

Datenstand: 26. August 2026

1.Nano Banana 21.031 Elo
2.GPT Image 1.5, Aktuelles Modell1.017 Elo
3.Nano Banana Pro1.004 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Objekt- und Umgebungsbearbeitung

976 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.042 Elo
2.Nano Banana 21.018 Elo
3.GPT Image 1.5, Aktuelles Modell976 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Bearbeitung mit 1-3 Eingabebildern

1.014 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.056 Elo
2.Nano Banana 21.016 Elo
3.GPT Image 1.5, Aktuelles Modell1.014 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Stilisierung

996 Elo · Platz 3 von 3

Datenstand: 26. August 2026

1.Nano Banana Pro1.045 Elo
2.Nano Banana 21.031 Elo
3.GPT Image 1.5, Aktuelles Modell996 Elo

3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.

Gradually-Bildtest: Typografie und Layout

33,3 Rangpunkte · Platz 22 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.593,8 Rangpunkte
20.GPT Image 235,8 Rangpunkte
20.Reve 2.135,8 Rangpunkte
22.GPT Image 1.5, Aktuelles Modell33,3 Rangpunkte
23.Seedream 4.018,5 Rangpunkte
24.Wan 2.6 Text to Image14,8 Rangpunkte
28.Stable Diffusion 3.5 Large0 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Produktfotografie

37 Rangpunkte · Platz 19 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.GPT Image 295,1 Rangpunkte
17.Qwen Image 2.0 Pro42 Rangpunkte
18.Midjourney V8.140,7 Rangpunkte
19.GPT Image 1.5, Aktuelles Modell37 Rangpunkte
20.Nano Banana 229,6 Rangpunkte
21.Wan 2.6 Text to Image25,9 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Figur und Details

85,2 Rangpunkte · Platz 2 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.5 Flash86,4 Rangpunkte
2.GPT Image 1.5, Aktuelles Modell85,2 Rangpunkte
3.FLUX.2 Max80,3 Rangpunkte
4.HiDream-O1-Image-1.579 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

5 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Infografik

49,4 Rangpunkte · Platz 14 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.Reve 2.197,5 Rangpunkte
12.Nano Banana 2 Lite58 Rangpunkte
13.Qwen Image 2.0 Pro53,1 Rangpunkte
14.GPT Image 1.5, Aktuelles Modell49,4 Rangpunkte
14.Nano Banana 249,4 Rangpunkte
14.Wan 2.6 Text to Image49,4 Rangpunkte
28.Firefly Image Model 51,2 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Gewichte
ProprietärQuelle
Zugang
API, WebQuelle
Maximale Ausgabe
1.536 × 1.024 PixelQuelle
Benchmark-Konfiguration
HighQuelle
Generator
gpt-image-1.5Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

Repräsentativer Preis
0,13 $ pro BildQuelle
Together AI (openai/gpt-image-1.5)
0,03 $ pro BildQuelle

Messwerte

Weitere veröffentlichte Benchmarks

Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.

LMArena Text to Image: 3D modeling

1.215,44 Punkte

Rang 11 · 14.763 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Art

1.223,91 Punkte

Rang 11 · 19.937 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Cartoon

1.243,08 Punkte

Rang 10 · 55.661 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Commercial design

1.240,91 Punkte

Rang 10 · 55.926 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Overall

1.238,66 Punkte

Rang 11 · 142.427 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Photorealism

1.248,78 Punkte

Rang 11 · 57.631 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Portraits

1.261,42 Punkte

Rang 9 · 28.153 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Text rendering

1.254,59 Punkte

Rang 10 · 51.503 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Multi-image editing

1.341,51 Punkte

Rang 9 · 164.316 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Overall

1.370,21 Punkte

Rang 13 · 531.138 Beobachtungen · Abgerufen 26. August 2026

LMArena

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • OpenAIQuelle
  • Bildmodell-PreiseQuelle
  • Together AIQuelle
  • Artificial Analysis (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • GenExam (abgerufen 26. August 2026)Quelle
  • Qwen Image Bench (abgerufen 26. August 2026)Quelle
  • WISE Verified (abgerufen 26. August 2026)Quelle
  • GRADE (abgerufen 26. August 2026)Quelle
  • GEBench (abgerufen 26. August 2026)Quelle
  • Gemini 3.1 Flash Image model card (abgerufen 26. August 2026)Quelle
  • Gradually-Bildtest (abgerufen 18. August 2026)Quelle