Zum Hauptinhalt springen
SprachmodellAktiv

Claude Opus 5

Anthropic

Veröffentlicht
24. Juli 2026
Datenstand
30. Juli 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.

Position
Platz 1 von 26
Indexwert
88,9 / 100
Abdeckung
4 / 4

Bestenliste

1Claude Opus 5, Aktuelles Modell88,9 / 100
2Gemini 3.8 Flash88,5 / 100
3Claude Fable 583,2 / 100
25MiMo-V2.5-Pro12,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

SimpleQA Verified v2

63,3 % · Platz 4 von 5

Aufgabe: Kaggle-Score · Vergleichskohorte: simpleqa-verified-v2:official:overall · Datenstand: 9. August 2026

1.Gemini 3.1 Pro Preview77,5 %
2.Gemini 3.5 Flash70,4 %
3.GPT-5.6 Sol69,2 %
4.Claude Opus 5, Aktuelles Modell63,3 %
5.Grok 4.553,8 %

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.000 verifizierte Prompts ohne Werkzeuge. Kaggle hat die Ergebnisse unabhängig reproduziert.

Quelle: KaggleTeilnehmer: 5

AlmanBench v0.1

94,95 % · Platz 3 von 5

Aufgabe: Akzeptierte Fälle · Vergleichskohorte: almanbench-v0-1:official:overall · Datenstand: 9. August 2026

1.GPT-5.595,43 %
2.GPT-5.6 Sol95,14 %
3.Claude Opus 5, Aktuelles Modell94,95 %
4.DeepSeek-V4-Flash93 %
5.Kimi K390,96 %

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

1.029 öffentliche Aufgaben, ein direkter Lauf je Zeile. Gemessen wird die Alman-Sprachspezifikation.

Einzelwerte

Veröffentlichte Einzelwerte

Für diese Messwerte liegt keine exakt passende veröffentlichte Vergleichskohorte vor. Der Balken zeigt nur die dokumentierte Skala, keine Rangposition.

ARC-AGI-3

Aufgabe: RHAE-Gesamtscore · Datenstand: 26. August 2026

ARC-AGI-330,16 %

Skala 0 bis 100. Kein Rang

Offizieller ARC-Prize-Harness auf unbekannten interaktiven Umgebungen. Reasoning-Stufen bleiben getrennt.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Modelltyp
ProprietärQuelle
Kontextfenster
1.000.000 TokenQuelle
Knowledge Cutoff
Mai 2026Quelle
Hinweise
Veröffentlicht am 24. Juli 2026. Intelligenz nahe der damaligen Spitzenklasse, nah an Fable 5 zum halben Preis ($5/$25). 1M Kontext, 128K Output und Wissensstand Mai 2026. War bei Erscheinen das neue Standardmodell auf Claude Max und das stärkste Modell auf Claude Pro. Führte bei Frontier-Bench v0.1, übertraf Fable 5 bei OSWorld 2.0, lag bei CursorBench 3.2 innerhalb von 0,5 % von Fable 5 und bei Cybersicherheit hinter Mythos 5. Die Werte beschreiben die damalige Testkohorte vor Fable 5.1 und Mythos 5.1.Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

API-Eingabe
5 $ pro 1 Mio. TokenQuelle
API-Ausgabe
25 $ pro 1 Mio. TokenQuelle
Cache schreiben
6,25 $ pro 1 Mio. TokenQuelle
Cache schreiben, 1 Stunde
10 $ pro 1 Mio. TokenQuelle
Cache lesen
0,5 $ pro 1 Mio. TokenQuelle

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • ModellmetadatenQuelle
  • Wissensstand-DatenQuelle
  • API-PreiseQuelle
  • ARC Prize (abgerufen 26. August 2026)Quelle
  • Kaggle (abgerufen 9. August 2026)Quelle
  • Alman Institut (abgerufen 9. August 2026)Quelle