- Startseite
- KI-Modelle
- Claude Opus 5.5
Claude Opus 5.5
Anthropic
- Veröffentlicht
- 22. September 2026
- Datenstand
- 22. September 2026
- Vorgängermodell
- Claude Opus 5
- Intelligenz
- Gesamtwertung
- Preis
- Eingabe · Ausgabe / 1 Mio. Token
- Eingabe
- Text, Bild
- Ausgabe
- Text
- Position
- Platz 5 von 85
- Indexwert
- 85,3 / 100
Methodik und Quelle
Der Index mittelt Rangperzentile aus 10 dokumentierten Vergleichskohorten.
Seite 1 von 3
Veröffentlichte Benchmarks
Allgemeine Aufgaben
BioMysteryBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 13
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Harness: Terminus 2. Latenz in Sekunden: 739.252. Kosten je Aufgabe in USD: 2.972555. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-23-1da8cd6684f0. Prüfsumme der Quelldaten: 1da8cd6684f0e235fa297f17a076add04c169bb4739ba048aa3300d9e5028eaa. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MysteryMechanism
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-mysterymechanism:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 13
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1178.454. Kosten je Aufgabe in USD: 4.059711. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-mysterymechanism-2026-09-23-63be0832dc5b. Prüfsumme der Quelldaten: 63be0832dc5bfc3769dae7055df0a6f6c1b46b0da25663f9022faff971e28703. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Programmieren
Code Migration
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-code-migration:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 55
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 11925.532. Kosten je Aufgabe in USD: 69.480849. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-23-c7fade0e4383. Prüfsumme der Quelldaten: c7fade0e4383b27bca9fb2e591abb1b60950f35fca099c1ae51cad7c14fb7292. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
IOI
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-ioi:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 25
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1035.191. Kosten je Aufgabe in USD: 4.382385. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-23-81487e138796. Prüfsumme der Quelldaten: 81487e1387966f49c2cce85653523e20447fd6ca8cee8e30372da5b934f8fa0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProgramBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-programbench:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 42
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 8660.211. Kosten je Aufgabe in USD: 42.65866. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-programbench-2026-09-23-083c733e7512. Prüfsumme der Quelldaten: 083c733e7512bc651ac31bb15b24fc2b0e6881e24a20748e847265e5556a012a. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finanzen
EMB
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-emb:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 52
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2106.434. Kosten je Aufgabe in USD: 9.330415. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-23-0e761c761c4e. Prüfsumme der Quelldaten: 0e761c761c4e6aa3d255a9a37e58f22915cd69f36faede07660f9a663ff4a6dc. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finance Agent (v2)
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 53
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1987.81. Kosten je Aufgabe in USD: 9.025984. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-23-8253d7a09218. Prüfsumme der Quelldaten: 8253d7a092188677e18f64165f4f338e5b99be804498c7d5476f877cd246914b. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Recht
Harvey's Legal Agent Benchmark
Overall · Task fully resolved
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Messgröße
- task resolution rate
- Skala
- 0-100
- Teilnehmer
- 54
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2939.571. Kosten je Aufgabe in USD: 17.569061. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-23-507154b1cf0d. Prüfsumme der Quelldaten: 507154b1cf0dcf67b4d36cb1325228e600b8f727addbed9e862cdc0b61b3af0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Legal Research Bench
Overall · All-pass
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-research:1:overall
- Messgröße
- all-pass rate
- Skala
- 0-100
- Teilnehmer
- 53
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 6749.531. Kosten je Aufgabe in USD: 23.610262. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-23-c163b99e1a0e. Prüfsumme der Quelldaten: c163b99e1a0e2be1a20e1f44d2914a932e31049d0b5c6767a7803cb35e0b3a74. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Gesundheit
MedCode
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medcode:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 62
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 246.876. Kosten je Aufgabe in USD: 0.658237. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-23-f51ab09f75f1. Prüfsumme der Quelldaten: f51ab09f75f1f2a43e4795332d87d10d469da5713ee9e294dfd8a018c22ed0b0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedScribe
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medscribe:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 63
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 441.582. Kosten je Aufgabe in USD: 1.154156. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-23-57321027150b. Prüfsumme der Quelldaten: 57321027150b04b875133d62749af33afaf3506f3c2f125e8b1b8707f46c4eaf. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProofBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 31
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 351.035. Kosten je Aufgabe in USD: 0.924063. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-23-323050c29bf5. Prüfsumme der Quelldaten: 323050c29bf5c9f0fca38f6a87aec1f91b031cf350e783c60a892de3e2671cb0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Dokumentierte Messdetails
Jede Beobachtung enthält den Quellwert und die veröffentlichten Testbedingungen.
BioMysteryBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 79.259
- Bewertung
- 79.259
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- general
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Harness: Terminus 2. Latenz in Sekunden: 739.252. Kosten je Aufgabe in USD: 2.972555. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-23-1da8cd6684f0. Prüfsumme der Quelldaten: 1da8cd6684f0e235fa297f17a076add04c169bb4739ba048aa3300d9e5028eaa. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
- Vergleichsmethodik
- Harness: Terminus 2
Code Migration: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 66.646
- Bewertung
- 66.646
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-code-migration:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 11925.532. Kosten je Aufgabe in USD: 69.480849. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-23-c7fade0e4383. Prüfsumme der Quelldaten: c7fade0e4383b27bca9fb2e591abb1b60950f35fca099c1ae51cad7c14fb7292. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
EMB: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 75.938
- Bewertung
- 75.938
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-emb:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2106.434. Kosten je Aufgabe in USD: 9.330415. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-23-0e761c761c4e. Prüfsumme der Quelldaten: 0e761c761c4e6aa3d255a9a37e58f22915cd69f36faede07660f9a663ff4a6dc. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finance Agent (v2): Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 58.587
- Bewertung
- 58.587
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1987.81. Kosten je Aufgabe in USD: 9.025984. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-23-8253d7a09218. Prüfsumme der Quelldaten: 8253d7a092188677e18f64165f4f338e5b99be804498c7d5476f877cd246914b. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
IOI: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 95.056
- Bewertung
- 95.056
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-ioi:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1035.191. Kosten je Aufgabe in USD: 4.382385. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-23-81487e138796. Prüfsumme der Quelldaten: 81487e1387966f49c2cce85653523e20447fd6ca8cee8e30372da5b934f8fa0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Harvey's Legal Agent Benchmark: Overall · Task fully resolved (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 3.75
- Bewertung
- 3.75
- Messgröße
- task resolution rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · Task fully resolved
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2939.571. Kosten je Aufgabe in USD: 17.569061. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-23-507154b1cf0d. Prüfsumme der Quelldaten: 507154b1cf0dcf67b4d36cb1325228e600b8f727addbed9e862cdc0b61b3af0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Legal Research Bench: Overall · All-pass (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 50.481
- Bewertung
- 50.481
- Messgröße
- all-pass rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · All-pass
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-research:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 6749.531. Kosten je Aufgabe in USD: 23.610262. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-23-c163b99e1a0e. Prüfsumme der Quelldaten: c163b99e1a0e2be1a20e1f44d2914a932e31049d0b5c6767a7803cb35e0b3a74. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedCode: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 49.797
- Bewertung
- 49.797
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medcode:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 246.876. Kosten je Aufgabe in USD: 0.658237. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-23-f51ab09f75f1. Prüfsumme der Quelldaten: f51ab09f75f1f2a43e4795332d87d10d469da5713ee9e294dfd8a018c22ed0b0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedScribe: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 91.43
- Bewertung
- 91.43
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medscribe:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 441.582. Kosten je Aufgabe in USD: 1.154156. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-23-57321027150b. Prüfsumme der Quelldaten: 57321027150b04b875133d62749af33afaf3506f3c2f125e8b1b8707f46c4eaf. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MysteryMechanism: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 49.55
- Bewertung
- 49.55
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- general
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-mysterymechanism:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1178.454. Kosten je Aufgabe in USD: 4.059711. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-mysterymechanism-2026-09-23-63be0832dc5b. Prüfsumme der Quelldaten: 63be0832dc5bfc3769dae7055df0a6f6c1b46b0da25663f9022faff971e28703. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProgramBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 18.5
- Bewertung
- 18.5
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-programbench:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 8660.211. Kosten je Aufgabe in USD: 42.65866. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-programbench-2026-09-23-083c733e7512. Prüfsumme der Quelldaten: 083c733e7512bc651ac31bb15b24fc2b0e6881e24a20748e847265e5556a012a. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProofBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 100
- Bewertung
- 100
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1.1
- Kategorie
- math
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: anthropic/claude-opus-5-5. Name des Quellmodells: Claude Opus 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 351.035. Kosten je Aufgabe in USD: 0.924063. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-23-323050c29bf5. Prüfsumme der Quelldaten: 323050c29bf5c9f0fca38f6a87aec1f91b031cf350e783c60a892de3e2671cb0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Seite 1 von 3
Steckbrief
Technische Daten und Zugang
Veröffentlichte Angaben zum Modell. Vorhandene Schätzungen sind ausdrücklich gekennzeichnet.
Datierte Angaben aus Dokumentation und Modellkarten. Anbieterlimits sowie native und erweiterte Kontextfenster können sich unterscheiden. Konfigurationshinweise bleiben im Original erhalten.
| Angabe | Wert und Quelle |
|---|---|
| Gewichte | ProprietärQuelle |
| Zugang | APIQuelle |
| Kontextfenster | 1.000.000 TokenQuelle |
| Knowledge Cutoff | Juni 2026Quelle |
| Hinweise | Veröffentlicht am 22. September 2026. Anthropic positioniert Opus 5.5 für lang laufende agentische Programmierung und Wissensarbeit, zu 4 $ / 20 $ pro Million Input- und Output-Token. 1M Kontext, 128K Output, Wissensstand Juni 2026, adaptives Denken ist immer aktiv und der Standard-Effort ist medium. Offizielle API-ID: claude-opus-5-5.Quelle |
| API-Modellkennung | claude-opus-5-5Quelle |
| Status laut Quelle | activeQuelle |
| Veröffentlichung | 2026-09-22Quelle |
| Maximale Ausgabe | 128.000 TokenQuelle |
| Eingabe | Text, imagesQuelle |
| Ausgabe | TextQuelle |
| Reasoning-Modus | adaptive (always on); default mediumQuelle |
| Wissensstand | 2026-06Quelle |
Kosten
Veröffentlichte Preise
Die Preise gelten für die jeweils genannte Einheit. Auflösung, Ausgabelänge und Anbieter können die Kosten verändern.
Direkte Vergleiche
Dieses Modell im Vergleich
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Alle Vergleiche anzeigen (47)
Modellgenerationen
Vorgänger und Nachfolger
Jede Zuordnung nennt ihre Art, ihre Einschränkung und die datierte Quelle, auf der sie beruht.
- Vorgänger
- Claude Opus 5
Beleg zur Modellfolge
Anthropic writes "Opus 5.5 is a major step up from Opus 5." and benchmarks Opus 5.5 directly against Opus 5; the Opus 5 model overview adds "Although Claude Opus 5 is still available, you should consider migrating to Claude Opus 5.5 for improved performance.".
Anthropic "Introducing Claude Opus 5.5" announcement (2026-09-22)
Nachweise
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Preis | API-Basispreise ohne Cache- oder Batch-Rabatt. Höhere Kontextstufen und weitere Tarife stehen unter Kosten. |
| Eingabe | Dokumentierte Modalitäten. Abgerufen am 22. September 2026. |
| Ausgabe | Dokumentierte Modalitäten. Abgerufen am 22. September 2026. |
| Recherchestand | Recherchestand 22. September 2026. 2 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| In den geprüften Quellen nicht gefunden | parameters-billions Originalwortlaut Anthropic does not publish parameter counts for this model. |
| In den geprüften Quellen nicht gefunden | active-parameters-billions Originalwortlaut Anthropic does not publish active parameter counts for this model. |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Anthropic (abgerufen 22. September 2026) |