Zum Hauptinhalt springen
Alle LLM-Vergleiche

Direktvergleich

DeepSeek-V4-Flash vs. Kimi K2.6

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

3

gemeinsame Messreihen

1

verschiedene Benchmarks

11.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von DeepSeek-V4-Flash und Kimi K2.6
MerkmalDeepSeek-V4-FlashKimi K2.6
AnbieterDeepSeekMoonshot AI
Erschienen24. Apr. 202620. Apr. 2026
VerfügbarkeitPreviewAktiv
ModelltypOpen WeightsOpen Weights
Parameter284 Mrd., 13 Mrd. aktiv1 Billionen, 32 Mrd. aktiv
ArchitekturMixture of ExpertsMixture of Experts
Kontextfenster1.000.000 Token262.144 Token
WissensstandNicht veröffentlichtNicht veröffentlicht
Technische QuellenModellModell, Kontext
API-Preise pro 1 Mio. Token
API-Eingabe0,14 $0,95 $
API-Ausgabe0,28 $4 $
Cache lesen0, $0,16 $
Cache schreiben (5 Min.)Nicht ausgewiesenNicht ausgewiesen
Cache schreiben (1 Std.)Nicht ausgewiesenNicht ausgewiesen
Preis geprüft30.07.2026Quelle30.07.2026Quelle
DeepSeek-V4-FlashKimi K2.6
API-EingabeUSD pro 1 Mio. Token, Basistarif
DeepSeek-V4-Flash0,14 $Kimi K2.60,95 $
API-AusgabeUSD pro 1 Mio. Token, Basistarif
DeepSeek-V4-Flash0,28 $Kimi K2.64 $
Cache lesenUSD pro 1 Mio. Token, Basistarif
DeepSeek-V4-Flash0,003 $Kimi K2.60,16 $

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

3 gemeinsame Messreihen
DeepSeek-V4-FlashKimi K2.6
CyberBenchOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
DeepSeek-V4-Flash66,716 %Kimi K2.674,351 %
CyberBenchPatch. Mehr ist besser. Kein dokumentierter Setup-Unterschied
DeepSeek-V4-Flash72,414 %Kimi K2.671,429 %
CyberBenchPoC. Mehr ist besser. Kein dokumentierter Setup-Unterschied
DeepSeek-V4-Flash61,017 %Kimi K2.677,273 %
Benchmarkwerte von DeepSeek-V4-Flash und Kimi K2.6
Benchmark und AufgabeDeepSeek-V4-FlashKimi K2.6VergleichbarkeitQuelle
CyberBenchOverall66,716 %74,351 %höher1accuracyMehr ist besserKohorte: vals-cyberbench:1:overallKein dokumentierter Setup-UnterschiedDeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPatch72,414 %höher71,429 %1accuracyMehr ist besserKohorte: vals-cyberbench:1:patchKein dokumentierter Setup-UnterschiedDeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026
CyberBenchPoC61,017 %77,273 %höher1accuracyMehr ist besserKohorte: vals-cyberbench:1:pocKein dokumentierter Setup-UnterschiedDeepSeek-V4-Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 03.08.2026Import-ID: vals-cyber-2026-08-11-1f20498a3dc1Abgerufen am 11.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.