Zum Hauptinhalt springen
BildmodellKeine Statusangabe

Seedream 4.0

ByteDance

Veröffentlicht
September 2025
Datenstand
15. August 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.

Position
Platz 25 von 28
Indexwert
29,9 / 100
Abdeckung
4 / 4

Bestenliste

1MAI-Image-2.5 Flash76,6 / 100
2GPT Image 271 / 100
3MAI-Image-2.567,6 / 100
24FLUX.2 Klein 9B35,2 / 100
25Seedream 4.0, Aktuelles Modell29,9 / 100
26Midjourney V8.125,3 / 100
28Stable Diffusion 3.5 Large2,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

Text to Image Arena

1.227 Elo · Platz 13 von 25

Stichprobe: 4.603 · Datenstand: 26. August 2026

1.GPT Image 21.371 Elo
11.MAI-Image-2.5 Flash1.229 Elo
12.HiDream-O1-Image-1.51.228 Elo
13.Seedream 4.0, Aktuelles Modell1.227 Elo
14.FLUX.2 Max1.226 Elo
15.FLUX.2 Flex1.224 Elo
25.FLUX.2 Klein 9B1.144 Elo

7 von 25 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Image Editing Arena

1.185 Elo · Platz 15 von 19

Stichprobe: 10.984 · Datenstand: 26. August 2026

1.Reve 2.11.263 Elo
13.FLUX.2 Max1.201 Elo
14.HiDream-O1-Image1.190 Elo
15.Seedream 4.0, Aktuelles Modell1.185 Elo
16.FLUX.2 Pro1.170 Elo
17.FLUX.2 Klein 9B1.166 Elo
19.FLUX.2 Flex1.162 Elo

7 von 19 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

GenExam Mathematik, streng

2,6 % · Platz 6 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 256,3 %
2.Nano Banana Pro55,6 %
3.GPT Image 250,3 %
4.GPT Image 1.526,5 %
5.FLUX.2 Max6,6 %
6.Seedream 4.0, Aktuelles Modell2,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, streng

3,5 % · Platz 6 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.GPT Image 279,6 %
2.Nano Banana Pro75,2 %
3.Nano Banana 274,3 %
4.GPT Image 1.546 %
5.FLUX.2 Max8,8 %
6.Seedream 4.0, Aktuelles Modell3,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, streng

5,9 % · Platz 6 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 269,5 %
2.Nano Banana Pro60,2 %
3.Nano Banana 252,5 %
4.GPT Image 1.539 %
5.FLUX.2 Max6,8 %
6.Seedream 4.0, Aktuelles Modell5,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, streng

18,6 % · Platz 5 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 289,1 %
2.Nano Banana Pro75,6 %
3.Nano Banana 266 %
4.GPT Image 1.556,4 %
5.Seedream 4.0, Aktuelles Modell18,6 %
6.FLUX.2 Max11,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, streng

10,6 % · Platz 6 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 284,8 %
2.Nano Banana Pro75,8 %
3.Nano Banana 269,7 %
4.GPT Image 1.560,6 %
5.FLUX.2 Max15,2 %
6.Seedream 4.0, Aktuelles Modell10,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, streng

6,9 % · Platz 6 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 273,5 %
2.Nano Banana Pro65,7 %
3.Nano Banana 256,9 %
4.GPT Image 1.536,3 %
5.FLUX.2 Max8,8 %
6.Seedream 4.0, Aktuelles Modell6,9 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, streng

11,7 % · Platz 5 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 279,3 %
2.Nano Banana Pro71,2 %
3.Nano Banana 267,6 %
4.GPT Image 1.544,1 %
5.Seedream 4.0, Aktuelles Modell11,7 %
6.FLUX.2 Max10,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, streng

5,2 % · Platz 5 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.Nano Banana Pro88,3 %
2.GPT Image 283,1 %
3.Nano Banana 263,6 %
4.GPT Image 1.542,9 %
5.Seedream 4.0, Aktuelles Modell5,2 %
6.FLUX.2 Max2,6 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, streng

0 % · Platz 6 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.GPT Image 264,6 %
2.Nano Banana Pro61,5 %
3.Nano Banana 250,8 %
4.GPT Image 1.529,2 %
5.FLUX.2 Max6,2 %
6.Seedream 4.0, Aktuelles Modell0 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, streng

7,3 % · Platz 5 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro97,6 %
2.GPT Image 282,9 %
2.Nano Banana 282,9 %
4.GPT Image 1.551,2 %
5.FLUX.2 Max7,3 %
5.Seedream 4.0, Aktuelles Modell7,3 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, streng

7,2 % · Platz 6 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 274,6 %
2.Nano Banana Pro72,7 %
3.Nano Banana 264,1 %
4.GPT Image 1.543,2 %
5.FLUX.2 Max8,5 %
6.Seedream 4.0, Aktuelles Modell7,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Mathematik, gelockert

39,8 % · Platz 6 von 6

Stichprobe: 151 · Datenstand: 26. August 2026

1.Nano Banana 287,8 %
2.Nano Banana Pro86,3 %
3.GPT Image 285,2 %
4.GPT Image 1.565,8 %
5.FLUX.2 Max49,1 %
6.Seedream 4.0, Aktuelles Modell39,8 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Physik, gelockert

49 % · Platz 6 von 6

Stichprobe: 113 · Datenstand: 26. August 2026

1.Nano Banana 295,7 %
2.GPT Image 295,6 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.585,4 %
5.FLUX.2 Max63,2 %
6.Seedream 4.0, Aktuelles Modell49 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Chemie, gelockert

46,1 % · Platz 6 von 6

Stichprobe: 118 · Datenstand: 26. August 2026

1.GPT Image 292 %
2.Nano Banana 290 %
3.Nano Banana Pro88,7 %
4.GPT Image 1.578,1 %
5.FLUX.2 Max54 %
6.Seedream 4.0, Aktuelles Modell46,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Biologie, gelockert

71 % · Platz 6 von 6

Stichprobe: 156 · Datenstand: 26. August 2026

1.GPT Image 297,5 %
2.Nano Banana Pro95,9 %
3.Nano Banana 295,2 %
4.GPT Image 1.591,9 %
5.FLUX.2 Max74,5 %
6.Seedream 4.0, Aktuelles Modell71 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geografie, gelockert

65,1 % · Platz 6 von 6

Stichprobe: 66 · Datenstand: 26. August 2026

1.GPT Image 297,6 %
2.Nano Banana Pro96,5 %
3.Nano Banana 294,8 %
4.GPT Image 1.592,5 %
5.FLUX.2 Max76,3 %
6.Seedream 4.0, Aktuelles Modell65,1 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Informatik, gelockert

52,2 % · Platz 6 von 6

Stichprobe: 102 · Datenstand: 26. August 2026

1.GPT Image 293,3 %
2.Nano Banana Pro91,7 %
3.Nano Banana 288,8 %
4.GPT Image 1.575,8 %
5.FLUX.2 Max56,5 %
6.Seedream 4.0, Aktuelles Modell52,2 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Ingenieurwesen, gelockert

60 % · Platz 6 von 6

Stichprobe: 111 · Datenstand: 26. August 2026

1.GPT Image 296,5 %
2.Nano Banana 295,8 %
3.Nano Banana Pro95,1 %
4.GPT Image 1.586,4 %
5.FLUX.2 Max68,9 %
6.Seedream 4.0, Aktuelles Modell60 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Wirtschaft, gelockert

56 % · Platz 6 von 6

Stichprobe: 77 · Datenstand: 26. August 2026

1.GPT Image 297,7 %
2.Nano Banana Pro97,2 %
3.Nano Banana 294,2 %
4.GPT Image 1.585,5 %
5.FLUX.2 Max61,5 %
6.Seedream 4.0, Aktuelles Modell56 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Musik, gelockert

34,5 % · Platz 6 von 6

Stichprobe: 65 · Datenstand: 26. August 2026

1.Nano Banana Pro91 %
2.GPT Image 289,1 %
3.Nano Banana 286,9 %
4.GPT Image 1.570,8 %
5.FLUX.2 Max47 %
6.Seedream 4.0, Aktuelles Modell34,5 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Geschichte, gelockert

56,7 % · Platz 6 von 6

Stichprobe: 41 · Datenstand: 26. August 2026

1.Nano Banana Pro99,9 %
2.Nano Banana 297,3 %
3.GPT Image 297,1 %
4.GPT Image 1.590,9 %
5.FLUX.2 Max68 %
6.Seedream 4.0, Aktuelles Modell56,7 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GenExam Gesamtwert, gelockert

53 % · Platz 6 von 6

Stichprobe: 1.000 · Datenstand: 26. August 2026

1.GPT Image 293,8 %
2.Nano Banana Pro93,7 %
3.Nano Banana 292,6 %
4.GPT Image 1.582,3 %
5.FLUX.2 Max61,9 %
6.Seedream 4.0, Aktuelles Modell53 %

6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.

Quelle: GenExamTeilnehmer: 6

GRADE Schlussfolgern

32,4 Punkte · Platz 7 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 282,2 Punkte
2.Nano Banana Pro77,5 Punkte
3.Nano Banana 272,6 Punkte
4.GPT Image 1.554,5 Punkte
5.FLUX.2 Max47,8 Punkte
6.FLUX.2 Pro38,9 Punkte
7.Seedream 4.0, Aktuelles Modell32,4 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Konsistenz

53,2 Punkte · Platz 7 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 294,4 Punkte
2.Nano Banana Pro89,5 Punkte
3.Nano Banana 286,4 Punkte
4.GPT Image 1.582,3 Punkte
5.FLUX.2 Max67,2 Punkte
6.FLUX.2 Pro55,5 Punkte
7.Seedream 4.0, Aktuelles Modell53,2 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Lesbarkeit

77 Punkte · Platz 5 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 298,8 Punkte
2.Nano Banana 295,9 Punkte
3.Nano Banana Pro95,8 Punkte
4.GPT Image 1.590,7 Punkte
5.Seedream 4.0, Aktuelles Modell77 Punkte
6.FLUX.2 Pro70,3 Punkte
7.FLUX.2 Max68,6 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE fachliche Genauigkeit

3,1 Punkte · Platz 7 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 256 Punkte
2.Nano Banana Pro46,2 Punkte
3.Nano Banana 239,6 Punkte
4.GPT Image 1.516 Punkte
5.FLUX.2 Max11,9 Punkte
6.FLUX.2 Pro4,4 Punkte
7.Seedream 4.0, Aktuelles Modell3,1 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GEBench Chinesisch, Einzelschritt

62,04 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,5 Punkte
2.GPT Image 1.583,79 Punkte
3.FLUX.2 Pro68,83 Punkte
4.Wan 2.6 Text to Image64,2 Punkte
5.Seedream 4.0, Aktuelles Modell62,04 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Mehrschritt

48,64 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro68,65 Punkte
2.GPT Image 1.556,97 Punkte
3.FLUX.2 Pro55,07 Punkte
4.Wan 2.6 Text to Image50,11 Punkte
5.Seedream 4.0, Aktuelles Modell48,64 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, fiktive App

49,28 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro65,75 Punkte
2.GPT Image 1.560,11 Punkte
3.FLUX.2 Pro58,13 Punkte
4.Wan 2.6 Text to Image52,72 Punkte
5.Seedream 4.0, Aktuelles Modell49,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, reale App

50,93 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,35 Punkte
2.GPT Image 1.555,65 Punkte
3.FLUX.2 Pro55,41 Punkte
4.Seedream 4.0, Aktuelles Modell50,93 Punkte
5.Wan 2.6 Text to Image50,4 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Verankerung

53,53 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,83 Punkte
2.Wan 2.6 Text to Image59,58 Punkte
3.Seedream 4.0, Aktuelles Modell53,53 Punkte
4.GPT Image 1.553,33 Punkte
5.FLUX.2 Pro50,24 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Gesamtwert

52,88 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,62 Punkte
2.GPT Image 1.563,22 Punkte
3.FLUX.2 Pro57,54 Punkte
4.Wan 2.6 Text to Image55,4 Punkte
5.Seedream 4.0, Aktuelles Modell52,88 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Einzelschritt

53,28 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,32 Punkte
2.GPT Image 1.580,8 Punkte
3.FLUX.2 Pro61 Punkte
4.Wan 2.6 Text to Image60,17 Punkte
5.Seedream 4.0, Aktuelles Modell53,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Mehrschritt

37,57 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,51 Punkte
2.GPT Image 1.558,87 Punkte
3.FLUX.2 Pro52,17 Punkte
4.Wan 2.6 Text to Image44,36 Punkte
5.Seedream 4.0, Aktuelles Modell37,57 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, fiktive App

47,92 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.GPT Image 1.563,68 Punkte
2.FLUX.2 Pro49,92 Punkte
3.Wan 2.6 Text to Image49,55 Punkte
4.Seedream 4.0, Aktuelles Modell47,92 Punkte
5.Nano Banana Pro46,33 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, reale App

49,36 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.GPT Image 1.558,93 Punkte
2.Seedream 4.0, Aktuelles Modell49,36 Punkte
3.Nano Banana Pro47,2 Punkte
4.FLUX.2 Pro47,16 Punkte
5.Wan 2.6 Text to Image44,8 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Verankerung

44,17 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro58,64 Punkte
2.Wan 2.6 Text to Image53,36 Punkte
3.GPT Image 1.549,23 Punkte
4.FLUX.2 Pro45,67 Punkte
5.Seedream 4.0, Aktuelles Modell44,17 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Gesamtwert

46,46 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.GPT Image 1.563,16 Punkte
2.Nano Banana Pro61,2 Punkte
3.FLUX.2 Pro51,18 Punkte
4.Wan 2.6 Text to Image50,45 Punkte
5.Seedream 4.0, Aktuelles Modell46,46 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

Gradually-Bildtest: Typografie und Layout

18,5 Rangpunkte · Platz 23 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.593,8 Rangpunkte
20.Reve 2.135,8 Rangpunkte
22.GPT Image 1.533,3 Rangpunkte
23.Seedream 4.0, Aktuelles Modell18,5 Rangpunkte
24.Wan 2.6 Text to Image14,8 Rangpunkte
25.FLUX.2 Klein 9B9,9 Rangpunkte
28.Stable Diffusion 3.5 Large0 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Produktfotografie

19,7 Rangpunkte · Platz 23 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.GPT Image 295,1 Rangpunkte
21.Wan 2.6 Text to Image25,9 Rangpunkte
22.Recraft V4.1 Utility22,2 Rangpunkte
23.Seedream 4.0, Aktuelles Modell19,7 Rangpunkte
24.HiDream-O1-Image13,6 Rangpunkte
25.Firefly Image Model 512,3 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Figur und Details

13,6 Rangpunkte · Platz 27 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.5 Flash86,4 Rangpunkte
25.Nano Banana 218,5 Rangpunkte
26.Nano Banana 2 Lite17,3 Rangpunkte
27.Seedream 4.0, Aktuelles Modell13,6 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

5 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Infografik

67,9 Rangpunkte · Platz 9 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.Reve 2.197,5 Rangpunkte
7.GPT Image 276,6 Rangpunkte
8.HiDream-O1-Image-1.574,1 Rangpunkte
9.Seedream 4.0, Aktuelles Modell67,9 Rangpunkte
10.MAI-Image-2.565,4 Rangpunkte
11.Luma UNI 1 Max64,2 Rangpunkte
28.Firefly Image Model 51,2 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Gewichte
ProprietärQuelle
Zugang
API, WebQuelle
Maximale Ausgabe
4KQuelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

Repräsentativer Preis
0,03 $ pro BildQuelle
Together AI (ByteDance-Seed/Seedream-4.0)
0,03 $ pro MegapixelQuelle

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • ByteDanceQuelle
  • Bildmodell-PreiseQuelle
  • Together AIQuelle
  • Artificial Analysis (abgerufen 26. August 2026)Quelle
  • GenExam (abgerufen 26. August 2026)Quelle
  • GRADE (abgerufen 26. August 2026)Quelle
  • GEBench (abgerufen 26. August 2026)Quelle
  • Gradually-Bildtest (abgerufen 18. August 2026)Quelle