Zum Hauptinhalt springen
SprachmodellAktiv

GPT-5.6 Luna

OpenAI

Veröffentlicht
26. Juni 2026
Datenstand
11. August 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.

Position
Platz 8 von 26
Indexwert
66,8 / 100
Abdeckung
4 / 4

Bestenliste

1Claude Opus 588,9 / 100
2Gemini 3.8 Flash88,5 / 100
3Claude Fable 583,2 / 100
7Grok 4.670,2 / 100
8GPT-5.6 Luna, Aktuelles Modell66,8 / 100
9Gemini 3.6 Flash63 / 100
25MiMo-V2.5-Pro12,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

BrowseComp

83,3 % · Platz 5 von 5

Vergleichskohorte: browsecomp-openai-gpt-5-6-table · Datenstand: 2. September 2026

1.Claude Mythos 588 %
2.GPT-5.6 Terra87,5 %
3.Gemini 3.1 Pro Preview85,9 %
4.GPT-5.584,4 %
5.GPT-5.6 Luna, Aktuelles Modell83,3 %

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Herstellerübergreifende Vergleichstabelle mit Browser-Werkzeugen. Die genauen Agentensysteme unterscheiden sich.

Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.

Quelle: OpenAITeilnehmer: 5

SWE-Bench Pro

62,7 % · Platz 5 von 5

Vergleichskohorte: swe-pro-openai-gpt-5-6-release · Datenstand: 2. September 2026

1.Claude Mythos 580,3 %
2.Claude Fable 580 %
3.GPT-5.6 Sol64,6 %
4.GPT-5.6 Terra63,4 %
5.GPT-5.6 Luna, Aktuelles Modell62,7 %

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Von OpenAI veröffentlichte Vergleichstabelle. Kein Gradually-Test.

OpenAI schätzt nach einer Prüfung, dass rund 30 % der öffentlichen Aufgaben fehlerhaft sind. Der Wert bleibt deshalb ein umstrittenes Zusatzsignal. Die Zeilen sind eine redaktionelle Auswahl aus der jeweiligen Vergleichstabelle.

Quelle: OpenAITeilnehmer: 5

Einzelwerte

Veröffentlichte Einzelwerte

Für diese Messwerte liegt keine exakt passende veröffentlichte Vergleichskohorte vor. Der Balken zeigt nur die dokumentierte Skala, keine Rangposition.

ARC-AGI-3

Aufgabe: RHAE-Gesamtscore · Datenstand: 26. August 2026

ARC-AGI-30,18 %

Skala 0 bis 100. Kein Rang

Offizieller ARC-Prize-Harness auf unbekannten interaktiven Umgebungen. Reasoning-Stufen bleiben getrennt.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Modelltyp
ProprietärQuelle
Kontextfenster
1.050.000 TokenQuelle
Knowledge Cutoff
16. Februar 2026Quelle
Hinweise
Schnelle und günstigste Stufe der GPT-5.6-Familie. Allgemein verfügbar seit dem 9. Juli 2026. Bei ChatGPT Work und Codex ist die Effort-Stufe für Plus-, Pro-, Business- und Enterprise-Nutzer wählbar. $1 Input / $6 Output pro 1M Tokens. Terminal-Bench 2.1 84,3 %.Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

API-Eingabe
0,2 $ pro 1 Mio. TokenQuelle
API-Eingabe
0,4 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
API-Ausgabe
1,2 $ pro 1 Mio. TokenQuelle
API-Ausgabe
1,8 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
Cache schreiben
0,25 $ pro 1 Mio. TokenQuelle
Cache schreiben
0,5 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
Cache lesen
0,02 $ pro 1 Mio. TokenQuelle
Cache lesen
0,04 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle

Messwerte

Weitere veröffentlichte Benchmarks

Für diese Werte liegt im gespeicherten Datenbestand keine exakt gleiche Vergleichskohorte vor.

ARC-AGI-2

59,5 %

Abgerufen 2. September 2026

ARC Prize

ARC-AGI-2

47,6 %

Abgerufen 2. September 2026

ARC Prize

ARC-AGI-2

29,3 %

Abgerufen 2. September 2026

ARC Prize

ARC-AGI-2

7,4 %

Abgerufen 2. September 2026

ARC Prize

ARC-AGI-2

5,1 %

Abgerufen 2. September 2026

ARC Prize

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.