Zum Hauptinhalt springen
BildmodellKeine Statusangabe

FLUX.2 Pro

Black Forest Labs

Veröffentlicht
November 2025
Datenstand
15. August 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.

Position
Platz 18 von 28
Indexwert
47,2 / 100
Abdeckung
4 / 4

Bestenliste

1MAI-Image-2.5 Flash76,6 / 100
2GPT Image 271 / 100
3MAI-Image-2.567,6 / 100
18FLUX.2 Flex47,2 / 100
18FLUX.2 Pro, Aktuelles Modell47,2 / 100
20Nano Banana 246 / 100
28Stable Diffusion 3.5 Large2,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

Text to Image Arena

1.208 Elo · Platz 22 von 25

Stichprobe: 8.915 · Datenstand: 26. August 2026

1.GPT Image 21.371 Elo
20.Krea 2 Medium Turbo1.215 Elo
21.Wan 2.6 Text to Image1.210 Elo
22.FLUX.2 Pro, Aktuelles Modell1.208 Elo
23.HiDream-O1-Image1.175 Elo
24.HunyuanImage 3.0 Instruct1.150 Elo
25.FLUX.2 Klein 9B1.144 Elo

7 von 25 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Image Editing Arena

1.170 Elo · Platz 16 von 19

Stichprobe: 11.529 · Datenstand: 26. August 2026

1.Reve 2.11.263 Elo
14.HiDream-O1-Image1.190 Elo
15.Seedream 4.01.185 Elo
16.FLUX.2 Pro, Aktuelles Modell1.170 Elo
17.FLUX.2 Klein 9B1.166 Elo
18.Qwen Image 2.0 Pro1.164 Elo
19.FLUX.2 Flex1.162 Elo

7 von 19 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

GRADE Schlussfolgern

38,9 Punkte · Platz 6 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 282,2 Punkte
2.Nano Banana Pro77,5 Punkte
3.Nano Banana 272,6 Punkte
4.GPT Image 1.554,5 Punkte
5.FLUX.2 Max47,8 Punkte
6.FLUX.2 Pro, Aktuelles Modell38,9 Punkte
7.Seedream 4.032,4 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Konsistenz

55,5 Punkte · Platz 6 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 294,4 Punkte
2.Nano Banana Pro89,5 Punkte
3.Nano Banana 286,4 Punkte
4.GPT Image 1.582,3 Punkte
5.FLUX.2 Max67,2 Punkte
6.FLUX.2 Pro, Aktuelles Modell55,5 Punkte
7.Seedream 4.053,2 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE Lesbarkeit

70,3 Punkte · Platz 6 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 298,8 Punkte
2.Nano Banana 295,9 Punkte
3.Nano Banana Pro95,8 Punkte
4.GPT Image 1.590,7 Punkte
5.Seedream 4.077 Punkte
6.FLUX.2 Pro, Aktuelles Modell70,3 Punkte
7.FLUX.2 Max68,6 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GRADE fachliche Genauigkeit

4,4 Punkte · Platz 6 von 7

Stichprobe: 520 · Datenstand: 26. August 2026

1.GPT Image 256 Punkte
2.Nano Banana Pro46,2 Punkte
3.Nano Banana 239,6 Punkte
4.GPT Image 1.516 Punkte
5.FLUX.2 Max11,9 Punkte
6.FLUX.2 Pro, Aktuelles Modell4,4 Punkte
7.Seedream 4.03,1 Punkte

7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.

Quelle: GRADETeilnehmer: 7

GEBench Chinesisch, Einzelschritt

68,83 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,5 Punkte
2.GPT Image 1.583,79 Punkte
3.FLUX.2 Pro, Aktuelles Modell68,83 Punkte
4.Wan 2.6 Text to Image64,2 Punkte
5.Seedream 4.062,04 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Mehrschritt

55,07 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro68,65 Punkte
2.GPT Image 1.556,97 Punkte
3.FLUX.2 Pro, Aktuelles Modell55,07 Punkte
4.Wan 2.6 Text to Image50,11 Punkte
5.Seedream 4.048,64 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, fiktive App

58,13 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro65,75 Punkte
2.GPT Image 1.560,11 Punkte
3.FLUX.2 Pro, Aktuelles Modell58,13 Punkte
4.Wan 2.6 Text to Image52,72 Punkte
5.Seedream 4.049,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, reale App

55,41 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,35 Punkte
2.GPT Image 1.555,65 Punkte
3.FLUX.2 Pro, Aktuelles Modell55,41 Punkte
4.Seedream 4.050,93 Punkte
5.Wan 2.6 Text to Image50,4 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Verankerung

50,24 Punkte · Platz 5 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro64,83 Punkte
2.Wan 2.6 Text to Image59,58 Punkte
3.Seedream 4.053,53 Punkte
4.GPT Image 1.553,33 Punkte
5.FLUX.2 Pro, Aktuelles Modell50,24 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Chinesisch, Gesamtwert

57,54 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,62 Punkte
2.GPT Image 1.563,22 Punkte
3.FLUX.2 Pro, Aktuelles Modell57,54 Punkte
4.Wan 2.6 Text to Image55,4 Punkte
5.Seedream 4.052,88 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Einzelschritt

61 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro84,32 Punkte
2.GPT Image 1.580,8 Punkte
3.FLUX.2 Pro, Aktuelles Modell61 Punkte
4.Wan 2.6 Text to Image60,17 Punkte
5.Seedream 4.053,28 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Mehrschritt

52,17 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro69,51 Punkte
2.GPT Image 1.558,87 Punkte
3.FLUX.2 Pro, Aktuelles Modell52,17 Punkte
4.Wan 2.6 Text to Image44,36 Punkte
5.Seedream 4.037,57 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, fiktive App

49,92 Punkte · Platz 2 von 5

Datenstand: 26. August 2026

1.GPT Image 1.563,68 Punkte
2.FLUX.2 Pro, Aktuelles Modell49,92 Punkte
3.Wan 2.6 Text to Image49,55 Punkte
4.Seedream 4.047,92 Punkte
5.Nano Banana Pro46,33 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, reale App

47,16 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.GPT Image 1.558,93 Punkte
2.Seedream 4.049,36 Punkte
3.Nano Banana Pro47,2 Punkte
4.FLUX.2 Pro, Aktuelles Modell47,16 Punkte
5.Wan 2.6 Text to Image44,8 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Verankerung

45,67 Punkte · Platz 4 von 5

Datenstand: 26. August 2026

1.Nano Banana Pro58,64 Punkte
2.Wan 2.6 Text to Image53,36 Punkte
3.GPT Image 1.549,23 Punkte
4.FLUX.2 Pro, Aktuelles Modell45,67 Punkte
5.Seedream 4.044,17 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

GEBench Englisch, Gesamtwert

51,18 Punkte · Platz 3 von 5

Datenstand: 26. August 2026

1.GPT Image 1.563,16 Punkte
2.Nano Banana Pro61,2 Punkte
3.FLUX.2 Pro, Aktuelles Modell51,18 Punkte
4.Wan 2.6 Text to Image50,45 Punkte
5.Seedream 4.046,46 Punkte

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Zweisprachiger Test für grafische Benutzeroberflächen. Chinesische und englische Aufgaben sowie Einzelschritt, Mehrschritt, fiktive App, reale App und räumliche Verankerung bleiben getrennt.

Quelle: GEBenchTeilnehmer: 5

Gradually-Bildtest: Typografie und Layout

50,6 Rangpunkte · Platz 11 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.593,8 Rangpunkte
9.Firefly Image Model 575,3 Rangpunkte
10.Grok Imagine Image Quality65,4 Rangpunkte
11.FLUX.2 Pro, Aktuelles Modell50,6 Rangpunkte
11.Luma UNI 1 Max50,6 Rangpunkte
13.HiDream-O1-Image-1.549,4 Rangpunkte
28.Stable Diffusion 3.5 Large0 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Produktfotografie

43,2 Rangpunkte · Platz 16 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.GPT Image 295,1 Rangpunkte
14.Reve 2.151,9 Rangpunkte
15.FLUX.2 Flex46,9 Rangpunkte
16.FLUX.2 Pro, Aktuelles Modell43,2 Rangpunkte
17.Qwen Image 2.0 Pro42 Rangpunkte
18.Midjourney V8.140,7 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Figur und Details

70,4 Rangpunkte · Platz 8 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.MAI-Image-2.5 Flash86,4 Rangpunkte
5.Qwen Image 2.0 Pro76,6 Rangpunkte
7.Recraft V4.1 Utility72,9 Rangpunkte
8.FLUX.2 Pro, Aktuelles Modell70,4 Rangpunkte
9.Firefly Image Model 566,7 Rangpunkte
9.Wan 2.6 Text to Image66,7 Rangpunkte
28.Stable Diffusion 3.5 Large3,7 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Gradually-Bildtest: Infografik

24,7 Rangpunkte · Platz 22 von 28

Stichprobe: 1 · Datenstand: 18. August 2026

1.Reve 2.197,5 Rangpunkte
20.FLUX.2 Max29,6 Rangpunkte
21.FLUX.2 Flex25,9 Rangpunkte
22.FLUX.2 Pro, Aktuelles Modell24,7 Rangpunkte
23.Grok Imagine Image Quality21 Rangpunkte
24.FLUX.2 Klein 9B12,3 Rangpunkte
28.Firefly Image Model 51,2 Rangpunkte

7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Gewichte
ProprietärQuelle
Zugang
API, WebQuelle
Maximale Ausgabe
4 MegapixelQuelle
Benchmark-Konfiguration
ProQuelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

Repräsentativer Preis
0,03 $ pro BildQuelle
Together AI (black-forest-labs/FLUX.2-pro)
0,03 $ pro BildQuelle

Messwerte

Weitere veröffentlichte Benchmarks

Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.

LMArena Text to Image: 3D modeling

1.149,39 Punkte

Rang 28 · 17.241 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Art

1.163,05 Punkte

Rang 26 · 25.069 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Cartoon

1.161,02 Punkte

Rang 27 · 66.010 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Commercial design

1.156,46 Punkte

Rang 26 · 64.392 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Overall

1.154,79 Punkte

Rang 26 · 175.196 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Photorealism

1.151,5 Punkte

Rang 30 · 74.515 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Portraits

1.146,51 Punkte

Rang 31 · 39.262 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Text to Image: Text rendering

1.156,45 Punkte

Rang 27 · 59.326 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Multi-image editing

1.238,24 Punkte

Rang 20 · 171.464 Beobachtungen · Abgerufen 26. August 2026

LMArena

LMArena Image Editing: Overall

1.244,29 Punkte

Rang 30 · 497.149 Beobachtungen · Abgerufen 26. August 2026

LMArena

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • Black Forest LabsQuelle
  • Bildmodell-PreiseQuelle
  • Together AIQuelle
  • Artificial Analysis (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • LMArena (abgerufen 26. August 2026)Quelle
  • GRADE (abgerufen 26. August 2026)Quelle
  • GEBench (abgerufen 26. August 2026)Quelle
  • Gradually-Bildtest (abgerufen 18. August 2026)Quelle