Zum Hauptinhalt springen
SprachmodellAktiv

Claude Fable 5

Anthropic

Veröffentlicht
9. Juni 2026
Datenstand
30. Juli 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.

Position
Platz 3 von 26
Indexwert
83,2 / 100
Abdeckung
4 / 4

Bestenliste

1Claude Opus 588,9 / 100
2Gemini 3.8 Flash88,5 / 100
3Claude Fable 5, Aktuelles Modell83,2 / 100
4GPT-5.6 Sol81,7 / 100
25MiMo-V2.5-Pro12,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

SWE-Marathon v1.0

24 % · Platz 2 von 4

Aufgabe: Binäre Lösung, Pass@1 · Vergleichskohorte: swe-marathon-v1-0:official:pass1 · Datenstand: 9. August 2026

1.Grok 4.529 %
2.Claude Fable 5, Aktuelles Modell24 %
3.GPT-5.512 %
4.Gemini 3.5 Flash7 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

20 mehrstündige Aufgaben. Der benannte Coding-Agent ist Teil jeder Ergebniszeile.

Zwei Ablehnungen und drei nicht verfügbare Versuche wurden als null gewertet.

LiveBench

82,97 Punkte · Platz 1 von 4

Vergleichskohorte: livebench-2026-06-25-max · Datenstand: 2. September 2026

1.Claude Fable 5, Aktuelles Modell82,97 Punkte
2.GPT-5.6 Sol81,05 Punkte
3.GPT-5.580,19 Punkte
4.GPT-5.6 Terra77,94 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

23 objektiv bewertete Aufgaben in sieben Kategorien.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

89,7 Punkte · Platz 3 von 4

Aufgabe: Reasoning · Vergleichskohorte: livebench-2026-06-25-reasoning-max · Datenstand: 2. September 2026

1.GPT-5.6 Sol91,7 Punkte
2.GPT-5.6 Terra90,6 Punkte
3.Claude Fable 5, Aktuelles Modell89,7 Punkte
3.GPT-5.589,7 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Reasoning innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

86 Punkte · Platz 1 von 4

Aufgabe: Coding · Vergleichskohorte: livebench-2026-06-25-coding-max · Datenstand: 2. September 2026

1.Claude Fable 5, Aktuelles Modell86 Punkte
2.GPT-5.6 Sol83,9 Punkte
3.GPT-5.582,1 Punkte
4.GPT-5.6 Terra78,2 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Coding innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

62,2 Punkte · Platz 1 von 4

Aufgabe: Agentisches Coding · Vergleichskohorte: livebench-2026-06-25-agentic-coding-max · Datenstand: 2. September 2026

1.Claude Fable 5, Aktuelles Modell62,2 Punkte
2.GPT-5.6 Sol56,2 Punkte
3.GPT-5.6 Terra54,9 Punkte
4.GPT-5.554 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Agentisches Coding innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

96 Punkte · Platz 2 von 4

Aufgabe: Mathematik · Vergleichskohorte: livebench-2026-06-25-mathematics-max · Datenstand: 2. September 2026

1.GPT-5.6 Sol96,2 Punkte
2.Claude Fable 5, Aktuelles Modell96 Punkte
3.GPT-5.595,9 Punkte
4.GPT-5.6 Terra94,9 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Mathematik innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

80,5 Punkte · Platz 2 von 4

Aufgabe: Datenanalyse · Vergleichskohorte: livebench-2026-06-25-data-analysis-max · Datenstand: 2. September 2026

1.GPT-5.581,6 Punkte
2.Claude Fable 5, Aktuelles Modell80,5 Punkte
3.GPT-5.6 Sol79,8 Punkte
4.GPT-5.6 Terra79,3 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Datenanalyse innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

90,7 Punkte · Platz 1 von 4

Aufgabe: Sprache · Vergleichskohorte: livebench-2026-06-25-language-max · Datenstand: 2. September 2026

1.Claude Fable 5, Aktuelles Modell90,7 Punkte
2.GPT-5.6 Sol87,7 Punkte
3.GPT-5.587,4 Punkte
4.GPT-5.6 Terra82,9 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Sprache innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

LiveBench

75,8 Punkte · Platz 1 von 4

Aufgabe: Anweisungsbefolgung · Vergleichskohorte: livebench-2026-06-25-instruction-following-max · Datenstand: 2. September 2026

1.Claude Fable 5, Aktuelles Modell75,8 Punkte
2.GPT-5.6 Sol71,8 Punkte
3.GPT-5.570,7 Punkte
4.GPT-5.6 Terra64,6 Punkte

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Kategorie Anweisungsbefolgung innerhalb desselben LiveBench-Releases.

Quelle: LiveBenchTeilnehmer: 4

SWE-Bench Pro

80 % · Platz 2 von 5

Vergleichskohorte: swe-pro-openai-gpt-5-6-release · Datenstand: 2. September 2026

1.Claude Mythos 580,3 %
2.Claude Fable 5, Aktuelles Modell80 %
3.GPT-5.6 Sol64,6 %
4.GPT-5.6 Terra63,4 %
5.GPT-5.6 Luna62,7 %

5 von 5 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Von OpenAI veröffentlichte Vergleichstabelle. Kein Gradually-Test.

OpenAI schätzt nach einer Prüfung, dass rund 30 % der öffentlichen Aufgaben fehlerhaft sind. Der Wert bleibt deshalb ein umstrittenes Zusatzsignal. Die Zeilen sind eine redaktionelle Auswahl aus der jeweiligen Vergleichstabelle.

Quelle: OpenAITeilnehmer: 5

PRBench Finance

53,86 % · Platz 1 von 4

Aufgabe: Gesamt · Vergleichskohorte: scale-prbench-finance-full · Datenstand: 26. August 2026

1.Claude Fable 5, Aktuelles Modell53,86 %
2.GPT-5.6 Sol50,45 %
3.GPT-5.445,63 %
4.Gemini 3.1 Pro Preview41,87 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

600 Finanzaufgaben mit aufgabenspezifischen Rubriken und o4-mini als Juror.

Quelle: Scale AITeilnehmer: 4

52,56 % · Platz 1 von 4

Aufgabe: Gesamt · Vergleichskohorte: scale-prbench-legal-full · Datenstand: 26. August 2026

1.Claude Fable 5, Aktuelles Modell52,56 %
2.GPT-5.6 Sol50,5 %
3.GPT-5.444,35 %
4.Gemini 3.1 Pro Preview44,02 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

500 Rechtsaufgaben mit aufgabenspezifischen Rubriken und o4-mini als Juror.

Quelle: Scale AITeilnehmer: 4

EnigmaEval

39,28 % · Platz 1 von 4

Aufgabe: Gesamt · Vergleichskohorte: scale-enigma-eval-2026-07-23 · Datenstand: 26. August 2026

1.Claude Fable 5, Aktuelles Modell39,28 %
2.GPT-5.6 Sol37,12 %
3.Gemini 3.1 Pro Preview36,78 %
4.Gemini 3.5 Flash25,41 %

4 von 4 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Komplexe multimodale Rätsel mit exaktem Antwortabgleich und einem Versuch.

Quelle: Scale AITeilnehmer: 4

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Modelltyp
ProprietärQuelle
Kontextfenster
1.000.000 TokenQuelle
Knowledge Cutoff
Januar 2026Quelle
Hinweise
Mythos-Klasse oberhalb von Opus, das leistungsfähigste breit veröffentlichte Modell, 1M Kontext (neuer Tokenizer, ca. 30 % mehr Tokens pro Text im Vergleich zu Modellen vor Opus 4.7), 128K Output, ausschließlich adaptives Denken, Sicherheitsklassifizierer mit Rückgriff auf Opus 4.8 bei Verweigerung. Vorübergehend ausgesetzt vom 12. bis 30. Juni 2026 unter einer US-Exportkontrollverordnung, nachdem ein Jailbreak entdeckt wurde; seit dem 1. Juli 2026 wieder allgemein verfügbar.Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

API-Eingabe
10 $ pro 1 Mio. TokenQuelle
API-Ausgabe
50 $ pro 1 Mio. TokenQuelle
Cache schreiben
12,5 $ pro 1 Mio. TokenQuelle
Cache schreiben, 1 Stunde
20 $ pro 1 Mio. TokenQuelle
Cache lesen
1 $ pro 1 Mio. TokenQuelle

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.

  • ModellmetadatenQuelle
  • Kontextfenster-DatenQuelle
  • Wissensstand-DatenQuelle
  • API-PreiseQuelle
  • SWE-Marathon (abgerufen 9. August 2026)Quelle
  • LiveBench (abgerufen 2. September 2026)Quelle
  • OpenAI (abgerufen 2. September 2026)Quelle
  • Scale AI (abgerufen 26. August 2026)Quelle
  • Scale AI (abgerufen 26. August 2026)Quelle
  • Scale AI (abgerufen 26. August 2026)Quelle