Zum Hauptinhalt springen
Alle LLM-Vergleiche

Direktvergleich

Grok 4.3 vs. DeepSeek-V4-Flash

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

3

gemeinsame Messreihen

1

verschiedene Benchmarks

11.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von Grok 4.3 und DeepSeek-V4-Flash
MerkmalGrok 4.3DeepSeek-V4-Flash
AnbieterxAIDeepSeek
Erschienen6. Mai 202624. Apr. 2026
VerfügbarkeitAktivPreview
ModelltypProprietärOpen Weights
ParameterNicht veröffentlicht284 Mrd., 13 Mrd. aktiv
ArchitekturNicht veröffentlichtMixture of Experts
Kontextfenster1.000.000 Token1.000.000 Token
WissensstandNicht veröffentlichtNicht veröffentlicht
Technische QuellenModellModell
API-Preise pro 1 Mio. Token
API-Eingabe1,25 $ ≤200K / 2,5 $ >200K0,14 $
API-Ausgabe2,5 $ ≤200K / 5 $ >200K0,28 $
Cache lesen0,2 $ ≤200K / 0,4 $ >200K0, $
Cache schreiben (5 Min.)Nicht ausgewiesenNicht ausgewiesen
Cache schreiben (1 Std.)Nicht ausgewiesenNicht ausgewiesen
Preis geprüft11.08.2026Quelle30.07.2026Quelle
Grok 4.3DeepSeek-V4-Flash
API-EingabeUSD pro 1 Mio. Token, Basistarif
Grok 4.31,25 $DeepSeek-V4-Flash0,14 $
API-AusgabeUSD pro 1 Mio. Token, Basistarif
Grok 4.32,5 $DeepSeek-V4-Flash0,28 $
Cache lesenUSD pro 1 Mio. Token, Basistarif
Grok 4.30,2 $DeepSeek-V4-Flash0,003 $

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

3 gemeinsame Messreihen
Grok 4.3DeepSeek-V4-Flash
CyberBenchOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Grok 4.347,457 %DeepSeek-V4-Flash66,716 %
CyberBenchPatch. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Grok 4.364,407 %DeepSeek-V4-Flash72,414 %
CyberBenchPoC. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Grok 4.330,508 %DeepSeek-V4-Flash61,017 %
Benchmarkwerte von Grok 4.3 und DeepSeek-V4-Flash
Benchmark und AufgabeGrok 4.3DeepSeek-V4-FlashVergleichbarkeitQuelle
CyberBenchOverall47,457 %66,716 %höher1accuracyMehr ist besserKohorte: vals-cyberbench:1:overallKein dokumentierter Setup-UnterschiedGrok 4.3: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPatch64,407 %72,414 %höher1accuracyMehr ist besserKohorte: vals-cyberbench:1:patchKein dokumentierter Setup-UnterschiedGrok 4.3: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPoC30,508 %61,017 %höher1accuracyMehr ist besserKohorte: vals-cyberbench:1:pocKein dokumentierter Setup-UnterschiedGrok 4.3: Keine weiteren Einstellungen ausgewiesen
DeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.