- Startseite
- KI-Modelle
- GPT-6 Sol
GPT-6 Sol
OpenAI
- Veröffentlicht
- 22. September 2026
- Datenstand
- 22. September 2026
- Intelligenz
- Gesamtwertung
- Preis
- Eingabe · Ausgabe / 1 Mio. Token
- Eingabe
- Text, Bild
- Ausgabe
- Text
- Position
- Platz 37 von 85
- Indexwert
- 50,4 / 100
Methodik und Quelle
Der Index mittelt Rangperzentile aus 10 dokumentierten Vergleichskohorten.
Seite 1 von 2
Veröffentlichte Benchmarks
BioMysteryBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 13
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Harness: Terminus 2. Latenz in Sekunden: 324.465. Kosten je Aufgabe in USD: 0.662358. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-23-1da8cd6684f0. Prüfsumme der Quelldaten: 1da8cd6684f0e235fa297f17a076add04c169bb4739ba048aa3300d9e5028eaa. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Programmieren
Code Migration
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-code-migration:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 55
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 5136.155. Kosten je Aufgabe in USD: 15.676945. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-23-c7fade0e4383. Prüfsumme der Quelldaten: c7fade0e4383b27bca9fb2e591abb1b60950f35fca099c1ae51cad7c14fb7292. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
IOI
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-ioi:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 25
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1837.553. Kosten je Aufgabe in USD: 2.703348. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-23-81487e138796. Prüfsumme der Quelldaten: 81487e1387966f49c2cce85653523e20447fd6ca8cee8e30372da5b934f8fa0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProgramBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-programbench:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 42
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2771.488. Kosten je Aufgabe in USD: 11.672651. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-programbench-2026-09-23-083c733e7512. Prüfsumme der Quelldaten: 083c733e7512bc651ac31bb15b24fc2b0e6881e24a20748e847265e5556a012a. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finanzen
EMB
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-emb:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 52
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 621.736. Kosten je Aufgabe in USD: 1.276882. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-23-0e761c761c4e. Prüfsumme der Quelldaten: 0e761c761c4e6aa3d255a9a37e58f22915cd69f36faede07660f9a663ff4a6dc. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finance Agent (v2)
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 53
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 539.907. Kosten je Aufgabe in USD: 2.122121. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-23-8253d7a09218. Prüfsumme der Quelldaten: 8253d7a092188677e18f64165f4f338e5b99be804498c7d5476f877cd246914b. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Recht
Harvey's Legal Agent Benchmark
Overall · Task fully resolved
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Messgröße
- task resolution rate
- Skala
- 0-100
- Teilnehmer
- 54
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 820.101. Kosten je Aufgabe in USD: 3.358015. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-23-507154b1cf0d. Prüfsumme der Quelldaten: 507154b1cf0dcf67b4d36cb1325228e600b8f727addbed9e862cdc0b61b3af0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Legal Research Bench
Overall · All-pass
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-legal-research:1:overall
- Messgröße
- all-pass rate
- Skala
- 0-100
- Teilnehmer
- 53
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1449.451. Kosten je Aufgabe in USD: 4.897717. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-23-c163b99e1a0e. Prüfsumme der Quelldaten: c163b99e1a0e2be1a20e1f44d2914a932e31049d0b5c6767a7803cb35e0b3a74. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Gesundheit
MedCode
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medcode:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 62
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 62.714. Kosten je Aufgabe in USD: 0.085827. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-23-f51ab09f75f1. Prüfsumme der Quelldaten: f51ab09f75f1f2a43e4795332d87d10d469da5713ee9e294dfd8a018c22ed0b0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedScribe
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-medscribe:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 63
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 81.135. Kosten je Aufgabe in USD: 0.083138. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-23-57321027150b. Prüfsumme der Quelldaten: 57321027150b04b875133d62749af33afaf3506f3c2f125e8b1b8707f46c4eaf. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProofBench
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 31
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 304.509. Kosten je Aufgabe in USD: 0.476321. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-23-323050c29bf5. Prüfsumme der Quelldaten: 323050c29bf5c9f0fca38f6a87aec1f91b031cf350e783c60a892de3e2671cb0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
SAGE
Overall
höhere Werte sind besserStand 23. September 2026Skala: 0 % - 100 %
Methodik und Einordnung
- Vergleichskohorte
- vals-sage:1:overall
- Messgröße
- accuracy
- Skala
- 0-100
- Teilnehmer
- 56
- Methodik und Einordnung
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 31.419. Kosten je Aufgabe in USD: 0.061332. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-sage-2026-09-23-779524c6f420. Prüfsumme der Quelldaten: 779524c6f4208cd0c81006c6509c3fc7c7cba71bebdea55a2abe98305b00b4a9. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Dokumentierte Messdetails
Jede Beobachtung enthält den Quellwert und die veröffentlichten Testbedingungen.
BioMysteryBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 74.815
- Bewertung
- 74.815
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- general
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-biomysterybench:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Harness: Terminus 2. Latenz in Sekunden: 324.465. Kosten je Aufgabe in USD: 0.662358. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-biomysterybench-2026-09-23-1da8cd6684f0. Prüfsumme der Quelldaten: 1da8cd6684f0e235fa297f17a076add04c169bb4739ba048aa3300d9e5028eaa. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
- Vergleichsmethodik
- Harness: Terminus 2
Code Migration: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 57.195
- Bewertung
- 57.195
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-code-migration:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 5136.155. Kosten je Aufgabe in USD: 15.676945. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-code-migration-2026-09-23-c7fade0e4383. Prüfsumme der Quelldaten: c7fade0e4383b27bca9fb2e591abb1b60950f35fca099c1ae51cad7c14fb7292. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
EMB: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 71.53
- Bewertung
- 71.53
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-emb:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 621.736. Kosten je Aufgabe in USD: 1.276882. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-emb-2026-09-23-0e761c761c4e. Prüfsumme der Quelldaten: 0e761c761c4e6aa3d255a9a37e58f22915cd69f36faede07660f9a663ff4a6dc. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Finance Agent (v2): Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 49.05
- Bewertung
- 49.05
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- finance
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-finance-agent-v2:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 539.907. Kosten je Aufgabe in USD: 2.122121. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-fabv2-2026-09-23-8253d7a09218. Prüfsumme der Quelldaten: 8253d7a092188677e18f64165f4f338e5b99be804498c7d5476f877cd246914b. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
IOI: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 82.611
- Bewertung
- 82.611
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 2
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-ioi:2:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1837.553. Kosten je Aufgabe in USD: 2.703348. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-ioi-2026-09-23-81487e138796. Prüfsumme der Quelldaten: 81487e1387966f49c2cce85653523e20447fd6ca8cee8e30372da5b934f8fa0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Harvey's Legal Agent Benchmark: Overall · Task fully resolved (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 1.667
- Bewertung
- 1.667
- Messgröße
- task resolution rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · Task fully resolved
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-agent-benchmark:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 820.101. Kosten je Aufgabe in USD: 3.358015. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-hlab-2026-09-23-507154b1cf0d. Prüfsumme der Quelldaten: 507154b1cf0dcf67b4d36cb1325228e600b8f727addbed9e862cdc0b61b3af0c. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Legal Research Bench: Overall · All-pass (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 28.846
- Bewertung
- 28.846
- Messgröße
- all-pass rate
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- legal
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall · All-pass
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-legal-research:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 1449.451. Kosten je Aufgabe in USD: 4.897717. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-legal_research-2026-09-23-c163b99e1a0e. Prüfsumme der Quelldaten: c163b99e1a0e2be1a20e1f44d2914a932e31049d0b5c6767a7803cb35e0b3a74. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedCode: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 47.072
- Bewertung
- 47.072
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medcode:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 62.714. Kosten je Aufgabe in USD: 0.085827. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medcode-2026-09-23-f51ab09f75f1. Prüfsumme der Quelldaten: f51ab09f75f1f2a43e4795332d87d10d469da5713ee9e294dfd8a018c22ed0b0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
MedScribe: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 82.034
- Bewertung
- 82.034
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- health
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-medscribe:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 81.135. Kosten je Aufgabe in USD: 0.083138. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-medscribe-2026-09-23-57321027150b. Prüfsumme der Quelldaten: 57321027150b04b875133d62749af33afaf3506f3c2f125e8b1b8707f46c4eaf. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProgramBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 2
- Bewertung
- 2
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- coding
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-programbench:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: public. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 2771.488. Kosten je Aufgabe in USD: 11.672651. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-programbench-2026-09-23-083c733e7512. Prüfsumme der Quelldaten: 083c733e7512bc651ac31bb15b24fc2b0e6881e24a20748e847265e5556a012a. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
ProofBench: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 83
- Bewertung
- 83
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1.1
- Kategorie
- math
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-proof-bench:1.1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 304.509. Kosten je Aufgabe in USD: 0.476321. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-proof_bench-2026-09-23-323050c29bf5. Prüfsumme der Quelldaten: 323050c29bf5c9f0fca38f6a87aec1f91b031cf350e783c60a892de3e2671cb0. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
SAGE: Overall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 44.793
- Bewertung
- 44.793
- Messgröße
- accuracy
- Einheit
- %
- Benchmark-Version
- 1
- Kategorie
- education
- Aufgabe
- overall
- Aufgabenbezeichnung
- Overall
- Richtung
- Mehr ist besser
- Vergleichskohorte
- vals-sage:1:overall
- Quellentyp
- independent-evaluator
- Auswertung
- Vals AI
- Status
- active
- Abrufdatum
- 2026-09-23
- Methodik
- Kennung des Quellmodells: openai/gpt-6-sol. Name des Quellmodells: GPT-6 Sol. Evaluator: Vals AI. Datensatztyp: private. Stand der Rangliste: 2026-09-22. Latenz in Sekunden: 31.419. Kosten je Aufgabe in USD: 0.061332. Quellenkennung: vals-ai. Kennung der Evidenzaufnahme: vals-sage-2026-09-23-779524c6f420. Prüfsumme der Quelldaten: 779524c6f4208cd0c81006c6509c3fc7c7cba71bebdea55a2abe98305b00b4a9. Parserversion: vals-astro-v2. Importiert am: 2026-09-23
Seite 1 von 2
Steckbrief
Technische Daten und Zugang
Veröffentlichte Angaben zum Modell. Vorhandene Schätzungen sind ausdrücklich gekennzeichnet.
Datierte Angaben aus Dokumentation und Modellkarten. Anbieterlimits sowie native und erweiterte Kontextfenster können sich unterscheiden. Konfigurationshinweise bleiben im Original erhalten.
| Angabe | Wert und Quelle |
|---|---|
| Gewichte | ProprietärQuelle |
| Zugang | APIQuelle |
| Kontextfenster | 1.050.000 TokenQuelle |
| Knowledge Cutoff | 20. April 2026Quelle |
| Hinweise | Veröffentlicht am 22. September 2026 als zweite GPT-6-Stufe unterhalb von GPT-6 Astra, laut OpenAI für komplexe Coding- und Agenten-Workflows gebaut. 1,05 Millionen Token Kontext, 128.000 Token maximale Ausgabe und Knowledge Cutoff am 20. April 2026. API-Preis 2 $ / 10 $ pro Million Input- und Output-Token, halb so viel wie der Aktionspreis von GPT-5.6 Sol. Reasoning-Effort von none bis max, Standard ist medium. Offizielle API-ID: gpt-6-sol.Quelle |
| API-Modellkennung | gpt-6-solQuelle |
| Veröffentlichung | 2026-09-22Quelle |
| Maximale Ausgabe | 128.000 TokenQuelle |
| Eingabe | Text, BildQuelle |
| Ausgabe | TextQuelle |
| Reasoning-Modus | none, low, medium, high, xhigh, maxQuelle |
| Werkzeugaufrufe | JaQuelle |
Kosten
Veröffentlichte Preise
Die Preise gelten für die jeweils genannte Einheit. Auflösung, Ausgabelänge und Anbieter können die Kosten verändern.
- API-Eingabe
- 2 $ pro 1 Mio. TokenQuelle
- API-Eingabe
- 4 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
- API-Ausgabe
- 10 $ pro 1 Mio. TokenQuelle
- API-Ausgabe
- 15 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
- Cache schreiben
- 2,5 $ pro 1 Mio. TokenQuelle
- Cache schreiben
- 5 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
- Cache lesen
- 0,2 $ pro 1 Mio. TokenQuelle
- Cache lesen
- 0,4 $ pro 1 Mio. Token (über 272.000 Kontext-Token)Quelle
Direkte Vergleiche
Dieses Modell im Vergleich
Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.
Alle Vergleiche anzeigen (47)
Nachweise
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Preis | API-Basispreise ohne Cache- oder Batch-Rabatt. Höhere Kontextstufen und weitere Tarife stehen unter Kosten. |
| Eingabe | Dokumentierte Modalitäten. Abgerufen am 22. September 2026. |
| Ausgabe | Dokumentierte Modalitäten. Abgerufen am 22. September 2026. |
| Recherchestand | Recherchestand 22. September 2026. 2 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| In den geprüften Quellen nicht gefunden | parameters-billions Originalwortlaut OpenAI does not publish parameter counts. |
| Weitere Quelle | Modellmetadaten (abgerufen 22. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |
| Weitere Quelle | Vals AI (abgerufen 23. September 2026) |