- Startseite
- KI-Modelle
- Claude Opus 5
Claude Opus 5
Anthropic
- Veröffentlicht
- 24. Juli 2026
- Datenstand
- 30. Juli 2026
Einordnung
Position in der Kategorie
Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.
Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.
- Position
- Platz 1 von 26
- Indexwert
- 88,9 / 100
- Abdeckung
- 4 / 4
Bestenliste
Messreihen
Vergleichbare Benchmarkwerte
Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.
SimpleQA Verified v2
63,3 % · Platz 4 von 5
Aufgabe: Kaggle-Score · Vergleichskohorte: simpleqa-verified-v2:official:overall · Datenstand: 9. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.000 verifizierte Prompts ohne Werkzeuge. Kaggle hat die Ergebnisse unabhängig reproduziert.
AlmanBench v0.1
94,95 % · Platz 3 von 5
Aufgabe: Akzeptierte Fälle · Vergleichskohorte: almanbench-v0-1:official:overall · Datenstand: 9. August 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
1.029 öffentliche Aufgaben, ein direkter Lauf je Zeile. Gemessen wird die Alman-Sprachspezifikation.
Einzelwerte
Veröffentlichte Einzelwerte
Für diese Messwerte liegt keine exakt passende veröffentlichte Vergleichskohorte vor. Der Balken zeigt nur die dokumentierte Skala, keine Rangposition.
ARC-AGI-3
Aufgabe: RHAE-Gesamtscore · Datenstand: 26. August 2026
Skala 0 bis 100. Kein Rang
Offizieller ARC-Prize-Harness auf unbekannten interaktiven Umgebungen. Reasoning-Stufen bleiben getrennt.
Steckbrief
Technische Daten und Zugang
Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.
- Modelltyp
- ProprietärQuelle
- Kontextfenster
- 1.000.000 TokenQuelle
- Knowledge Cutoff
- Mai 2026Quelle
- Hinweise
- Veröffentlicht am 24. Juli 2026. Intelligenz nahe der damaligen Spitzenklasse, nah an Fable 5 zum halben Preis ($5/$25). 1M Kontext, 128K Output und Wissensstand Mai 2026. War bei Erscheinen das neue Standardmodell auf Claude Max und das stärkste Modell auf Claude Pro. Führte bei Frontier-Bench v0.1, übertraf Fable 5 bei OSWorld 2.0, lag bei CursorBench 3.2 innerhalb von 0,5 % von Fable 5 und bei Cybersicherheit hinter Mythos 5. Die Werte beschreiben die damalige Testkohorte vor Fable 5.1 und Mythos 5.1.Quelle
Kosten
Veröffentlichte Preise
Preise bleiben an die dokumentierte Einheit und Quelle gebunden.
Direkte Vergleiche
Dieses Modell im Vergleich
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Weitere Modelle
Modelle derselben Auswahl
Alle KI-Modelle
Nachweise
Primärquellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.