- Startseite
- KI-Modelle
- Claude Fable 5
Claude Fable 5
Anthropic
- Veröffentlicht
- 9. Juni 2026
- Datenstand
- 30. Juli 2026
Einordnung
Position in der Kategorie
Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.
Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.
- Position
- Platz 3 von 26
- Indexwert
- 83,2 / 100
- Abdeckung
- 4 / 4
Bestenliste
Messreihen
Vergleichbare Benchmarkwerte
Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.
SWE-Marathon v1.0
24 % · Platz 2 von 4
Aufgabe: Binäre Lösung, Pass@1 · Vergleichskohorte: swe-marathon-v1-0:official:pass1 · Datenstand: 9. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
20 mehrstündige Aufgaben. Der benannte Coding-Agent ist Teil jeder Ergebniszeile.
Zwei Ablehnungen und drei nicht verfügbare Versuche wurden als null gewertet.
LiveBench
82,97 Punkte · Platz 1 von 4
Vergleichskohorte: livebench-2026-06-25-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
23 objektiv bewertete Aufgaben in sieben Kategorien.
LiveBench
89,7 Punkte · Platz 3 von 4
Aufgabe: Reasoning · Vergleichskohorte: livebench-2026-06-25-reasoning-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Reasoning innerhalb desselben LiveBench-Releases.
LiveBench
86 Punkte · Platz 1 von 4
Aufgabe: Coding · Vergleichskohorte: livebench-2026-06-25-coding-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Coding innerhalb desselben LiveBench-Releases.
LiveBench
62,2 Punkte · Platz 1 von 4
Aufgabe: Agentisches Coding · Vergleichskohorte: livebench-2026-06-25-agentic-coding-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Agentisches Coding innerhalb desselben LiveBench-Releases.
LiveBench
96 Punkte · Platz 2 von 4
Aufgabe: Mathematik · Vergleichskohorte: livebench-2026-06-25-mathematics-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Mathematik innerhalb desselben LiveBench-Releases.
LiveBench
80,5 Punkte · Platz 2 von 4
Aufgabe: Datenanalyse · Vergleichskohorte: livebench-2026-06-25-data-analysis-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Datenanalyse innerhalb desselben LiveBench-Releases.
LiveBench
90,7 Punkte · Platz 1 von 4
Aufgabe: Sprache · Vergleichskohorte: livebench-2026-06-25-language-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Sprache innerhalb desselben LiveBench-Releases.
LiveBench
75,8 Punkte · Platz 1 von 4
Aufgabe: Anweisungsbefolgung · Vergleichskohorte: livebench-2026-06-25-instruction-following-max · Datenstand: 2. September 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Kategorie Anweisungsbefolgung innerhalb desselben LiveBench-Releases.
SWE-Bench Pro
80 % · Platz 2 von 5
Vergleichskohorte: swe-pro-openai-gpt-5-6-release · Datenstand: 2. September 2026
5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Von OpenAI veröffentlichte Vergleichstabelle. Kein Gradually-Test.
OpenAI schätzt nach einer Prüfung, dass rund 30 % der öffentlichen Aufgaben fehlerhaft sind. Der Wert bleibt deshalb ein umstrittenes Zusatzsignal. Die Zeilen sind eine redaktionelle Auswahl aus der jeweiligen Vergleichstabelle.
PRBench Finance
53,86 % · Platz 1 von 4
Aufgabe: Gesamt · Vergleichskohorte: scale-prbench-finance-full · Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
600 Finanzaufgaben mit aufgabenspezifischen Rubriken und o4-mini als Juror.
PRBench Legal
52,56 % · Platz 1 von 4
Aufgabe: Gesamt · Vergleichskohorte: scale-prbench-legal-full · Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
500 Rechtsaufgaben mit aufgabenspezifischen Rubriken und o4-mini als Juror.
EnigmaEval
39,28 % · Platz 1 von 4
Aufgabe: Gesamt · Vergleichskohorte: scale-enigma-eval-2026-07-23 · Datenstand: 26. August 2026
4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.
Komplexe multimodale Rätsel mit exaktem Antwortabgleich und einem Versuch.
Steckbrief
Technische Daten und Zugang
Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.
- Modelltyp
- ProprietärQuelle
- Kontextfenster
- 1.000.000 TokenQuelle
- Knowledge Cutoff
- Januar 2026Quelle
- Hinweise
- Mythos-Klasse oberhalb von Opus, das leistungsfähigste breit veröffentlichte Modell, 1M Kontext (neuer Tokenizer, ca. 30 % mehr Tokens pro Text im Vergleich zu Modellen vor Opus 4.7), 128K Output, ausschließlich adaptives Denken, Sicherheitsklassifizierer mit Rückgriff auf Opus 4.8 bei Verweigerung. Vorübergehend ausgesetzt vom 12. bis 30. Juni 2026 unter einer US-Exportkontrollverordnung, nachdem ein Jailbreak entdeckt wurde; seit dem 1. Juli 2026 wieder allgemein verfügbar.Quelle
Kosten
Veröffentlichte Preise
Preise bleiben an die dokumentierte Einheit und Quelle gebunden.
Direkte Vergleiche
Dieses Modell im Vergleich
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Weitere Modelle
Modelle derselben Auswahl
Alle KI-Modelle
Nachweise
Primärquellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
- ModellmetadatenQuelle
- Kontextfenster-DatenQuelle
- Wissensstand-DatenQuelle
- API-PreiseQuelle
- SWE-Marathon (abgerufen 9. August 2026)Quelle
- LiveBench (abgerufen 2. September 2026)Quelle
- OpenAI (abgerufen 2. September 2026)Quelle
- Scale AI (abgerufen 26. August 2026)Quelle
- Scale AI (abgerufen 26. August 2026)Quelle
- Scale AI (abgerufen 26. August 2026)Quelle