LMArena Text to Image: 3D modeling
963,91 Punkte
Rang 73 · 1.629 Beobachtungen · Abgerufen 26. August 2026
LMArenaStability AI
Einordnung
Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.
Diese Position mittelt 4 feste Gradually-Bildtests gleich. Pro Modell und Aufgabe fließt ein archiviertes erstes Ergebnis ein.
Messreihen
Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.
40,4 % · Platz 4 von 4
Stichprobe: 1.000 · Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
49 % · Platz 3 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
40,83 % · Platz 3 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
44,17 % · Platz 4 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
30 % · Platz 4 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
37,5 % · Platz 4 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
20,83 % · Platz 4 von 4
Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 Wissens- und Realismusaufgaben. Binäre Einzelurteile werden je Kategorie gemittelt, der Gesamtwert folgt der veröffentlichten Gewichtung.
0 Rangpunkte · Platz 28 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
4 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
3,7 Rangpunkte · Platz 28 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
4 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
3,7 Rangpunkte · Platz 28 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
4 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
2,5 Rangpunkte · Platz 27 von 28
Stichprobe: 1 · Datenstand: 18. August 2026
5 von 28 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Ein archiviertes, ungefiltertes Erstbild je Modell. Alle 28 Bilder werden in drei modellblinden, unterschiedlich sortierten Durchläufen gerankt. Der Wert von 0 bis 100 normalisiert den mittleren Rang. Das bleibt eine Stichprobe mit n = 1. Ein automatisches Prüfmodell kann eigene visuelle Präferenzen haben.
Steckbrief
Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.
Kosten
Preise bleiben an die dokumentierte Einheit und Quelle gebunden.
Messwerte
Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.
963,91 Punkte
Rang 73 · 1.629 Beobachtungen · Abgerufen 26. August 2026
LMArena997,69 Punkte
Rang 70 · 5.340 Beobachtungen · Abgerufen 26. August 2026
LMArena945,6 Punkte
Rang 73 · 12.274 Beobachtungen · Abgerufen 26. August 2026
LMArena937,14 Punkte
Rang 74 · 3.051 Beobachtungen · Abgerufen 26. August 2026
LMArena938,3 Punkte
Rang 74 · 23.396 Beobachtungen · Abgerufen 26. August 2026
LMArena928,09 Punkte
Rang 74 · 9.405 Beobachtungen · Abgerufen 26. August 2026
LMArena941,13 Punkte
Rang 73 · 5.704 Beobachtungen · Abgerufen 26. August 2026
LMArena921,4 Punkte
Rang 74 · 3.222 Beobachtungen · Abgerufen 26. August 2026
LMArenaDirekte Vergleiche
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Weitere Modelle
Alle KI-Modelle
Nachweise
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.