Zum Hauptinhalt springen

Direktvergleich

Claude Mythos 5 vs. GPT-5.6 Sol

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

2

gemeinsame Messreihen

1

verschiedene Benchmarks

02.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von Claude Mythos 5 und GPT-5.6 Sol
MerkmalClaude Mythos 5GPT-5.6 Sol
AnbieterAnthropicOpenAI
Erschienen9. Juni 202626. Juni 2026
VerfügbarkeitEingeschränkter ZugangAktiv
ModelltypProprietärProprietär
ParameterNicht veröffentlichtNicht veröffentlicht
ArchitekturNicht veröffentlichtNicht veröffentlicht
Kontextfenster1.000.000 Token1.050.000 Token
WissensstandJanuar 202616. Februar 2026
Technische QuellenModell, Kontext, WissensstandModell, Kontext, Wissensstand
API-Preise pro 1 Mio. Token
API-Eingabe10 $5 $ ≤272K / 10 $ >272K
API-Ausgabe50 $30 $ ≤272K / 45 $ >272K
Cache lesen1 $0,5 $ ≤272K / 1 $ >272K
Cache schreiben (5 Min.)12,5 $6,25 $ ≤272K / 12,5 $ >272K
Cache schreiben (1 Std.)20 $Nicht ausgewiesen
Preis geprüft30.07.2026Quelle11.08.2026Quelle
Claude Mythos 5GPT-5.6 Sol
API-EingabeUSD pro 1 Mio. Token, Basistarif
Claude Mythos 510 $
GPT-5.6 Sol5 $Günstiger
API-AusgabeUSD pro 1 Mio. Token, Basistarif
Claude Mythos 550 $
GPT-5.6 Sol30 $Günstiger
Cache lesenUSD pro 1 Mio. Token, Basistarif
Claude Mythos 51 $
GPT-5.6 Sol0,5 $Günstiger

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

2 gemeinsame Messreihen
Claude Mythos 5GPT-5.6 Sol
BrowseCompOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Mythos 588 %
GPT-5.6 Sol90,4 %Gewinner
BrowseCompOverall. Mehr ist besser. Testaufbau nicht identisch dokumentiert
Claude Mythos 588 %
GPT-5.6 Sol92,2 %Höherer Messwert
Benchmarkwerte von Claude Mythos 5 und GPT-5.6 Sol
Benchmark und AufgabeClaude Mythos 5GPT-5.6 SolVergleichbarkeitQuelle
BrowseCompOverall
88 %
Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.
90,4 %Gewinner
Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.
1,266 tasksaccuracyMehr ist besserKohorte: browsecomp-openai-gpt-5-6-tableKein dokumentierter Setup-UnterschiedSieger: GPT-5.6 SolClaude Mythos 5: Keine weiteren Einstellungen ausgewiesen
GPT-5.6 Sol: Keine weiteren Einstellungen ausgewiesen
Herstellerübergreifende Vergleichstabelle mit Browser-Werkzeugen. Die genauen Agentensysteme unterscheiden sich.
OpenAITyp: AnbieterangabeMessstand: 09.07.2026Import-ID: curated-openai-2026-08-02-55280172a0ed / curated-openai-2026-08-02-3d2469516088Abgerufen am 02.08.2026
BrowseCompOverall
88 %
Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.
92,2 %Höherer Messwert
Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.
1,266 tasksaccuracyMehr ist besserKohorte: browsecomp-openai-gpt-5-6-tableTestaufbau nicht identisch dokumentiertKein direkter SiegerClaude Mythos 5: Keine weiteren Einstellungen ausgewiesen
GPT-5.6 Sol: Reasoning: ultra
Herstellerübergreifende Vergleichstabelle mit Browser-Werkzeugen. Die genauen Agentensysteme unterscheiden sich.
OpenAITyp: AnbieterangabeMessstand: 09.07.2026Import-ID: curated-openai-2026-08-02-55280172a0ed / curated-openai-2026-08-02-aa55a6a6c756Abgerufen am 02.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.