- Startseite
- KI-Modelle
- Claude Sonnet 5.5
Claude Sonnet 5.5
Anthropic
- Veröffentlicht
- 28. September 2026
- Datenstand
- 28. September 2026
- Vorgängermodell
- Claude Sonnet 5
- Intelligenz
- Gesamtwertung
- Preis
- Eingabe · Ausgabe / 1 Mio. Token
- Eingabe
- Text, Bild
- Ausgabe
- Text
- Position
- Platz 4 von 86
- Indexwert
- 87,9 / 100
Methodik und Quelle
Der Index mittelt Rangperzentile aus 10 dokumentierten Vergleichskohorten.
Seite 1 von 4
Veröffentlichte Benchmarks
Allgemeine Aufgaben
BioMysteryBench
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 15
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Harness: Terminus 2. Latenz in Sekunden: 1086.061. Kosten je Aufgabe in USD: 3.736494. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-29-ae8417ff089d. Prüfsumme der Quelldaten: ae8417ff089d100a7fe142b979f417441381dcedfb13f35f1e2a2f4d06f31aec. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
MysteryMechanism
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-mysterymechanism:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 16
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 1410.236. Kosten je Aufgabe in USD: 3.45323. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-mysterymechanism-2026-09-29-258cfbb1bd2e. Prüfsumme der Quelldaten: 258cfbb1bd2e39fcae6d5a1181c9808368bbc3987691d3d1b32b5d193fc465a7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Programmieren
Code Migration
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-code-migration:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 56
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 12004.483. Kosten je Aufgabe in USD: 75.826721. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-29-f0b317d5bed3. Prüfsumme der Quelldaten: f0b317d5bed3a2654a9ea39762d5e57f4649306adce3e6103e845ee1b9b94add. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
IOI
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-ioi:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 27
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2751.084. Kosten je Aufgabe in USD: 7.524252. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-29-14c4f2dcc872. Prüfsumme der Quelldaten: 14c4f2dcc872d5e07bce234aebe4932202931d7f5b05f9bcd02e7695b5664750. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
CyberBench v1.1
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-cyberbench:1.1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 28
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2032.625. Kosten je Aufgabe in USD: 4.417372. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-cyber-2026-09-29-36ddb5f67bc8. Prüfsumme der Quelldaten: 36ddb5f67bc8725a7ff9d1cc1349f89d29e0e907ad313eb5ac277b42b3d275e1. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Finanzen
EMB
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-emb:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 53
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2204.991. Kosten je Aufgabe in USD: 8.792863. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-29-90535b2fd4dc. Prüfsumme der Quelldaten: 90535b2fd4dc213540eac0aff8ae769e34b6b1ba54e1ed6d0a51dcfe307d5598. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Finance Agent (v2)
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 54
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 1903.336. Kosten je Aufgabe in USD: 6.552431. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-29-addcd124c670. Prüfsumme der Quelldaten: addcd124c6706893659c1ae26698bf6ffa29c91018ee95b98ab15b9d4b6edcdb. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Recht
Harvey's Legal Agent Benchmark
Overall · Task fully resolved
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Messgröße
- task resolution rate
- Skala
- 0-100
- Teilnehmer
- 55
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 3463.508. Kosten je Aufgabe in USD: 16.612583. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-29-d6fb708e5bcc. Prüfsumme der Quelldaten: d6fb708e5bccec56c7a5e5ad97918d9cc47c5ebefb88af4a1a5771493dadba2f. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Legal Research Bench
Overall · All-pass
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-research:1:overall
- Messgröße
- all-pass rate
- Skala
- 0-100
- Teilnehmer
- 54
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 5588.989. Kosten je Aufgabe in USD: 14.826571. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-29-b15acd492114. Prüfsumme der Quelldaten: b15acd492114174e151eff7ff17a38d547d5a1e93d2d598c153066542bbc56b7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Gesundheit
MedCode
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medcode:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 63
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-26. Latenz in Sekunden: 239.171. Kosten je Aufgabe in USD: 0.391592. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-29-7062229b5ab4. Prüfsumme der Quelldaten: 7062229b5ab4a5e16f014a78fd550f9f34e7147be6be796b610ab1ca3de055ab. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
MedScribe
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medscribe:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 64
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-26. Latenz in Sekunden: 306.811. Kosten je Aufgabe in USD: 0.508604. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-29-6533d95c8055. Prüfsumme der Quelldaten: 6533d95c80553d2dd26927f7269ab6454c589d2181f1858c662a4f493b5685c7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
ProofBench
Overall
höhere Werte sind besserStand 29. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 33
- Methodik und Einordnung
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-28. Latenz in Sekunden: 347.583. Kosten je Aufgabe in USD: 0.558327. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-29-95d190db7be5. Prüfsumme der Quelldaten: 95d190db7be508012399269386113bf7df88cf108a8647fae6d361d15c60126b. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Dokumentierte Messdetails
Jede Beobachtung enthält den Quellwert und die veröffentlichten Testbedingungen.
BioMysteryBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 81.111
- Bewertung
- 81.111
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- general
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Harness: Terminus 2. Latenz in Sekunden: 1086.061. Kosten je Aufgabe in USD: 3.736494. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-29-ae8417ff089d. Prüfsumme der Quelldaten: ae8417ff089d100a7fe142b979f417441381dcedfb13f35f1e2a2f4d06f31aec. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
- Vergleichsmethodik
- Harness: Terminus 2
Code Migration: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 69.825
- Bewertung
- 69.825
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-code-migration:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 12004.483. Kosten je Aufgabe in USD: 75.826721. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-29-f0b317d5bed3. Prüfsumme der Quelldaten: f0b317d5bed3a2654a9ea39762d5e57f4649306adce3e6103e845ee1b9b94add. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
CyberBench v1.1: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 59.584
- Bewertung
- 59.584
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1.1
- Kategorie
- cybersecurity
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-cyberbench:1.1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2032.625. Kosten je Aufgabe in USD: 4.417372. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-cyber-2026-09-29-36ddb5f67bc8. Prüfsumme der Quelldaten: 36ddb5f67bc8725a7ff9d1cc1349f89d29e0e907ad313eb5ac277b42b3d275e1. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
EMB: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 75.713
- Bewertung
- 75.713
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-emb:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2204.991. Kosten je Aufgabe in USD: 8.792863. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-29-90535b2fd4dc. Prüfsumme der Quelldaten: 90535b2fd4dc213540eac0aff8ae769e34b6b1ba54e1ed6d0a51dcfe307d5598. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Finance Agent (v2): Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 58.103
- Bewertung
- 58.103
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 1903.336. Kosten je Aufgabe in USD: 6.552431. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-29-addcd124c670. Prüfsumme der Quelldaten: addcd124c6706893659c1ae26698bf6ffa29c91018ee95b98ab15b9d4b6edcdb. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
IOI: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 83.056
- Bewertung
- 83.056
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-ioi:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 2751.084. Kosten je Aufgabe in USD: 7.524252. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-29-14c4f2dcc872. Prüfsumme der Quelldaten: 14c4f2dcc872d5e07bce234aebe4932202931d7f5b05f9bcd02e7695b5664750. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Harvey's Legal Agent Benchmark: Overall · Task fully resolved (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 2.917
- Bewertung
- 2.917
- Messgröße
- task resolution rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · Task fully resolved
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 3463.508. Kosten je Aufgabe in USD: 16.612583. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-29-d6fb708e5bcc. Prüfsumme der Quelldaten: d6fb708e5bccec56c7a5e5ad97918d9cc47c5ebefb88af4a1a5771493dadba2f. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Legal Research Bench: Overall · All-pass (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 48.077
- Bewertung
- 48.077
- Messgröße
- all-pass rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · All-pass
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-research:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 5588.989. Kosten je Aufgabe in USD: 14.826571. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-29-b15acd492114. Prüfsumme der Quelldaten: b15acd492114174e151eff7ff17a38d547d5a1e93d2d598c153066542bbc56b7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
MedCode: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 52.92
- Bewertung
- 52.92
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medcode:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-26. Latenz in Sekunden: 239.171. Kosten je Aufgabe in USD: 0.391592. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-29-7062229b5ab4. Prüfsumme der Quelldaten: 7062229b5ab4a5e16f014a78fd550f9f34e7147be6be796b610ab1ca3de055ab. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
MedScribe: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 91.101
- Bewertung
- 91.101
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medscribe:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-26. Latenz in Sekunden: 306.811. Kosten je Aufgabe in USD: 0.508604. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-29-6533d95c8055. Prüfsumme der Quelldaten: 6533d95c80553d2dd26927f7269ab6454c589d2181f1858c662a4f493b5685c7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
MysteryMechanism: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 49.099
- Bewertung
- 49.099
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- general
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-mysterymechanism:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-27. Latenz in Sekunden: 1410.236. Kosten je Aufgabe in USD: 3.45323. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-mysterymechanism-2026-09-29-258cfbb1bd2e. Prüfsumme der Quelldaten: 258cfbb1bd2e39fcae6d5a1181c9808368bbc3987691d3d1b32b5d193fc465a7. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
ProofBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 100
- Bewertung
- 100
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1.1
- Kategorie
- math
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-29
- Methodik
- Kennung des Quellmodells: anthropic/claude-sonnet-5-5. Name des Quellmodells: Claude Sonnet 5.5. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-28. Latenz in Sekunden: 347.583. Kosten je Aufgabe in USD: 0.558327. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-29-95d190db7be5. Prüfsumme der Quelldaten: 95d190db7be508012399269386113bf7df88cf108a8647fae6d361d15c60126b. Parserversion: vals-astro-v2. Importiert am: 2026-09-29
Seite 1 von 4
Steckbrief
Technische Daten und Zugang
Veröffentlichte Angaben zum Modell. Vorhandene Schätzungen sind ausdrücklich gekennzeichnet.
Datierte Angaben aus Dokumentation und Modellkarten. Anbieterlimits sowie native und erweiterte Kontextfenster können sich unterscheiden. Konfigurationshinweise bleiben im Original erhalten.
| Angabe | Wert und Quelle |
|---|---|
| Gewichte | ProprietärQuelle |
| Zugang | APIQuelle |
| Kontextfenster | 1.000.000 TokenQuelle |
| Knowledge Cutoff | Juni 2026Quelle |
| Hinweise | Veröffentlicht am 28. September 2026. Anthropic positioniert Sonnet 5.5 als schnellere und günstigere Ergänzung zu Opus 5.5 für klar umrissene Alltagsaufgaben, Fehlerbehebung sowie Dokumente, Präsentationen und Tabellen, zum unveränderten Sonnet-5-Preis von 2 $ / 10 $ pro Million Input- und Output-Token. 1M Kontext, 128K Output, Wissensstand Juni 2026, adaptives Denken ist standardmäßig aktiv, der Standard-Effort ist high in der API (medium in Claude Code und den Apps). Offizielle API-ID: claude-sonnet-5-5.Quelle |
| API-Modellkennung | claude-sonnet-5-5Quelle |
| Status laut Quelle | activeQuelle |
| Veröffentlichung | 2026-09-28Quelle |
| Maximale Ausgabe | 128.000 TokenQuelle |
| Eingabe | Text, imagesQuelle |
| Ausgabe | TextQuelle |
| Reasoning-Modus | adaptive (on by default; between_tools turns off up-front thinking); default highQuelle |
| Reasoning-Stufe | low, medium, high, xhigh, max; API default highQuelle |
| Wissensstand | 2026-06Quelle |
Kosten
Veröffentlichte Preise
Die Preise gelten für die jeweils genannte Einheit. Auflösung, Ausgabelänge und Anbieter können die Kosten verändern.
- API-Eingabe
- 2 $ pro 1 Mio. TokenQuelle
- API-Ausgabe
- 10 $ pro 1 Mio. TokenQuelle
- Cache schreiben
- 2,5 $ pro 1 Mio. TokenQuelle
- Cache schreiben, 1 Stunde
- 4 $ pro 1 Mio. TokenQuelle
- Cache lesen
- 0,2 $ pro 1 Mio. TokenQuelle
- Preisbedingungen laut Quelle
- Batch-API 50 % günstiger (1 $ Input / 5 $ Output pro Million Token); US-only-Inferenz (inference_geo: us) zum 1,1-Fachen auf alle Token-Kategorien; kein Aufschlag für lange Kontexte (1M Token zum Standardpreis)Quelle
Direkte Vergleiche
Dieses Modell im Vergleich
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Alle Vergleiche anzeigen (48)
Modellgenerationen
Vorgänger und Nachfolger
Jede Zuordnung nennt ihre Art, ihre Einschränkung und die datierte Quelle, auf der sie beruht.
- Vorgänger
- Claude Sonnet 5
Beleg zur Modellfolge
Anthropic writes "It's a clear upgrade over Claude Sonnet 5" and that Sonnet 5.5 "costs up to 30% less per task than its predecessor," directly after stating it is "priced the same as Sonnet 5," identifying Sonnet 5 as that predecessor; the docs page "What's new in Claude Sonnet 5.5" describes "What changes when you move from Claude Sonnet 5 to Claude Sonnet 5.5".
Anthropic "Introducing Claude Sonnet 5.5" announcement (2026-09-28)
Nachweise
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Preis | API-Basispreise ohne Cache- oder Batch-Rabatt. Höhere Kontextstufen und weitere Tarife stehen unter Kosten. |
| Eingabe | Dokumentierte Modalitäten. Abgerufen am 28. September 2026. |
| Ausgabe | Dokumentierte Modalitäten. Abgerufen am 28. September 2026. |
| Recherchestand | Recherchestand 28. September 2026. 5 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| In den geprüften Quellen nicht gefunden | parameters-billions Originalwortlaut Anthropic does not publish parameter counts for this model. |
| In den geprüften Quellen nicht gefunden | active-parameters-billions Originalwortlaut Anthropic does not publish active parameter counts for this model. |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 29. September 2026) |
| Weitere Quelle | Anthropic (abgerufen 28. September 2026) |
| Weitere Quelle | Modellmetadaten (abgerufen 28. September 2026) |
| Weitere Quelle | Modellmetadaten (abgerufen 28. September 2026) |
| Weitere Quelle | Anthropic "Introducing Claude Sonnet 5.5" announcement (2026-09-28) |