LMArena Text to Image: 3D modeling
1.258,7 Punkte
Rang 3 · 2.907 Beobachtungen · Abgerufen 26. August 2026
LMArenaEinordnung
Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.
Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.
Messreihen
Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.
1.321 Elo · Platz 3 von 25
Stichprobe: 15.335 · Datenstand: 26. August 2026
6 von 25 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.250 Elo · Platz 5 von 19
Stichprobe: 12.690 · Datenstand: 26. August 2026
7 von 19 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
56,3 % · Platz 1 von 6
Stichprobe: 151 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
74,3 % · Platz 3 von 6
Stichprobe: 113 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
52,5 % · Platz 3 von 6
Stichprobe: 118 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
66 % · Platz 3 von 6
Stichprobe: 156 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
69,7 % · Platz 3 von 6
Stichprobe: 66 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
56,9 % · Platz 3 von 6
Stichprobe: 102 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
67,6 % · Platz 3 von 6
Stichprobe: 111 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
63,6 % · Platz 3 von 6
Stichprobe: 77 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
50,8 % · Platz 3 von 6
Stichprobe: 65 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
82,9 % · Platz 2 von 6
Stichprobe: 41 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
64,1 % · Platz 3 von 6
Stichprobe: 1.000 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
87,8 % · Platz 1 von 6
Stichprobe: 151 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
95,7 % · Platz 1 von 6
Stichprobe: 113 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
90 % · Platz 2 von 6
Stichprobe: 118 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
95,2 % · Platz 3 von 6
Stichprobe: 156 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
94,8 % · Platz 3 von 6
Stichprobe: 66 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
88,8 % · Platz 3 von 6
Stichprobe: 102 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
95,8 % · Platz 2 von 6
Stichprobe: 111 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
94,2 % · Platz 3 von 6
Stichprobe: 77 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
86,9 % · Platz 3 von 6
Stichprobe: 65 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
97,3 % · Platz 2 von 6
Stichprobe: 41 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
92,6 % · Platz 3 von 6
Stichprobe: 1.000 · Datenstand: 26. August 2026
6 von 6 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 fachübergreifende Zeichenaufgaben mit Referenzbildern und feingranularen Bewertungspunkten. Strenge und gelockerte Bewertung bleiben getrennt.
54,77 Punkte · Platz 4 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
61,08 Punkte · Platz 2 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
62,4 Punkte · Platz 2 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
54,28 Punkte · Platz 2 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
67,05 Punkte · Platz 2 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
59,82 Punkte · Platz 2 von 5
Datenstand: 26. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Prompts, fünf Hauptdimensionen und 56 Detailkriterien. Die veröffentlichten Top-5-Werte stammen aus derselben deterministischen Prüferkonfiguration.
72,6 Punkte · Platz 3 von 7
Stichprobe: 520 · Datenstand: 26. August 2026
7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.
86,4 Punkte · Platz 3 von 7
Stichprobe: 520 · Datenstand: 26. August 2026
7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.
95,9 Punkte · Platz 2 von 7
Stichprobe: 520 · Datenstand: 26. August 2026
7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.
39,6 Punkte · Platz 3 von 7
Stichprobe: 520 · Datenstand: 26. August 2026
7 von 7 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
520 wissenschaftliche Bildbearbeitungsaufgaben aus zehn Fachgebieten. GRADE bewertet Schlussfolgern, Konsistenz, Lesbarkeit und fachliche Genauigkeit getrennt.
1.073 Elo · Platz 1 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.129 Elo · Platz 1 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.074 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.047 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.049 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.031 Elo · Platz 1 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.018 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.016 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
1.031 Elo · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Googles Modellkarte veröffentlicht Elo-Werte mit Unsicherheitsintervallen für Text zu Bild und Bildbearbeitung. Verwendet wird die Standardkonfiguration von Gemini 3.1 Flash Image ohne Werkzeuge.
30 % · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Blindtest von ContraLabs zur Typografie. Die Hersteller-Modellkarte veröffentlicht die Erstplatzierungsquote von zehn professionellen Designerinnen und Designern.
2,84 Bewertung von 5 · Platz 2 von 3
Datenstand: 26. August 2026
3 von 3 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Blindtest von ContraLabs zur Typografie. Zehn professionelle Designerinnen und Designer bewerteten auf einer Skala von 1 bis 5, ob sie das Ergebnis in echter Kundenarbeit einsetzen würden.
86,4 Rangpunkte · Platz 4 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
29,6 Rangpunkte · Platz 20 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
18,5 Rangpunkte · Platz 25 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
49,4 Rangpunkte · Platz 14 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
7 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
Steckbrief
Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.
Kosten
Preise bleiben an die dokumentierte Einheit und Quelle gebunden.
Messwerte
Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.
1.258,7 Punkte
Rang 3 · 2.907 Beobachtungen · Abgerufen 26. August 2026
LMArena1.250,51 Punkte
Rang 8 · 4.154 Beobachtungen · Abgerufen 26. August 2026
LMArena1.266,73 Punkte
Rang 8 · 10.445 Beobachtungen · Abgerufen 26. August 2026
LMArena1.272,16 Punkte
Rang 4 · 10.316 Beobachtungen · Abgerufen 26. August 2026
LMArena1.263,06 Punkte
Rang 5 · 27.910 Beobachtungen · Abgerufen 26. August 2026
LMArena1.269,81 Punkte
Rang 6 · 11.229 Beobachtungen · Abgerufen 26. August 2026
LMArena1.266,8 Punkte
Rang 7 · 5.554 Beobachtungen · Abgerufen 26. August 2026
LMArena1.294,78 Punkte
Rang 5 · 9.489 Beobachtungen · Abgerufen 26. August 2026
LMArena1.364,76 Punkte
Rang 5 · 37.577 Beobachtungen · Abgerufen 26. August 2026
LMArena1.386,27 Punkte
Rang 10 · 117.943 Beobachtungen · Abgerufen 26. August 2026
LMArenaDirekte Vergleiche
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Weitere Modelle
Alle KI-Modelle
Nachweise
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.