Zum Hauptinhalt springen
Alle LLM-Vergleiche

Direktvergleich

GPT-5.5 vs. DeepSeek-V4-Flash

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

4

gemeinsame Messreihen

2

verschiedene Benchmarks

11.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von GPT-5.5 und DeepSeek-V4-Flash
MerkmalGPT-5.5DeepSeek-V4-Flash
AnbieterOpenAIDeepSeek
ErschienenApr. 202624. Apr. 2026
VerfügbarkeitAktivPreview
ModelltypProprietärOpen Weights
ParameterNicht veröffentlicht284 Mrd., 13 Mrd. aktiv
ArchitekturNicht veröffentlichtMixture of Experts
Kontextfenster1.050.000 Token1.000.000 Token
Wissensstand1. Dezember 2025Nicht veröffentlicht
Technische QuellenModellModell
API-Preise pro 1 Mio. Token
API-Eingabe5 $ ≤272K / 10 $ >272K0,14 $
API-Ausgabe30 $ ≤272K / 45 $ >272K0,28 $
Cache lesen0,5 $ ≤272K / 1 $ >272K0, $
Cache schreiben (5 Min.)Nicht ausgewiesenNicht ausgewiesen
Cache schreiben (1 Std.)Nicht ausgewiesenNicht ausgewiesen
Preis geprüft30.07.2026Quelle30.07.2026Quelle
GPT-5.5DeepSeek-V4-Flash
API-EingabeUSD pro 1 Mio. Token, Basistarif
GPT-5.55 $DeepSeek-V4-Flash0,14 $
API-AusgabeUSD pro 1 Mio. Token, Basistarif
GPT-5.530 $DeepSeek-V4-Flash0,28 $
Cache lesenUSD pro 1 Mio. Token, Basistarif
GPT-5.50,5 $DeepSeek-V4-Flash0,003 $

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

4 gemeinsame Messreihen
GPT-5.5DeepSeek-V4-Flash
AlmanBench v0.1Accepted cases. Mehr ist besser. Testaufbau nicht identisch dokumentiert
GPT-5.595,432 %DeepSeek-V4-Flash93,003 %
CyberBenchOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
GPT-5.580,508 %DeepSeek-V4-Flash66,716 %
CyberBenchPatch. Mehr ist besser. Kein dokumentierter Setup-Unterschied
GPT-5.581,356 %DeepSeek-V4-Flash72,414 %
CyberBenchPoC. Mehr ist besser. Kein dokumentierter Setup-Unterschied
GPT-5.579,661 %DeepSeek-V4-Flash61,017 %
Benchmarkwerte von GPT-5.5 und DeepSeek-V4-Flash
Benchmark und AufgabeGPT-5.5DeepSeek-V4-FlashVergleichbarkeitQuelle
AlmanBench v0.1Accepted cases95,432 %höher93,003 %v0.1, results commit f34ddbfaccepted casesMehr ist besserKohorte: almanbench-v0-1:official:overallTestaufbau nicht identisch dokumentiertGPT-5.5: Reasoning: xhigh
DeepSeek-V4-Flash: Reasoning: max
1.029 öffentliche Aufgaben, ein direkter Lauf je Zeile. Gemessen wird die Alman-Sprachspezifikation.
Alman InstitutTyp: Unabhängige EvaluationMessstand: 05.08.2026Import-ID: curated-alman-institut-2026-08-09-92ad09f6268e / curated-alman-institut-2026-08-09-743e705129f5Abgerufen am 09.08.2026
CyberBenchOverall80,508 %höher66,716 %1accuracyMehr ist besserKohorte: vals-cyberbench:1:overallKein dokumentierter Setup-UnterschiedGPT-5.5: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPatch81,356 %höher72,414 %1accuracyMehr ist besserKohorte: vals-cyberbench:1:patchKein dokumentierter Setup-UnterschiedGPT-5.5: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPoC79,661 %höher61,017 %1accuracyMehr ist besserKohorte: vals-cyberbench:1:pocKein dokumentierter Setup-UnterschiedGPT-5.5: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.