Zum Hauptinhalt springen

Direktvergleich

Gemini 3.7 Flash vs. Kimi K2.6

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

7

gemeinsame Messreihen

7

verschiedene Benchmarks

16.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von Gemini 3.7 Flash und Kimi K2.6
MerkmalGemini 3.7 FlashKimi K2.6
AnbieterGoogleMoonshot AI
Erschienen13. Aug. 202620. Apr. 2026
VerfügbarkeitAktivAktiv
ModelltypProprietärOpen Weights
ParameterNicht veröffentlicht1 Billionen, 32 Mrd. aktiv
ArchitekturNicht veröffentlichtMixture of Experts
Kontextfenster1.048.576 Token262.144 Token
WissensstandMärz 2026Nicht veröffentlicht
Technische QuellenModell, WissensstandModell, Kontext
API-Preise pro 1 Mio. Token
API-Eingabe0,75 $0,95 $
API-Ausgabe3,75 $4 $
Cache lesen0,07 $0,16 $
Cache schreiben (5 Min.)Nicht ausgewiesenNicht ausgewiesen
Cache schreiben (1 Std.)Nicht ausgewiesenNicht ausgewiesen
Preis geprüft16.08.2026Quelle30.07.2026Quelle
Gemini 3.7 FlashKimi K2.6
API-EingabeUSD pro 1 Mio. Token, Basistarif
Gemini 3.7 Flash0,75 $Günstiger
Kimi K2.60,95 $
API-AusgabeUSD pro 1 Mio. Token, Basistarif
Gemini 3.7 Flash3,75 $Günstiger
Kimi K2.64 $
Cache lesenUSD pro 1 Mio. Token, Basistarif
Gemini 3.7 Flash0,075 $Günstiger
Kimi K2.60,16 $

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

7 gemeinsame Messreihen
Gemini 3.7 FlashKimi K2.6
EMBOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash71,326 %Gewinner
Kimi K2.657,855 %
Finance Agent (v2)Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash59,042 %Gewinner
Kimi K2.644,899 %
Harvey's Legal Agent BenchmarkOverall · Task fully resolved. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash8,75 %Gewinner
Kimi K2.61,667 %
Legal Research BenchOverall · All-pass. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash34,615 %Gewinner
Kimi K2.615,865 %
Terminal-Bench 2.1Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash77,528 %Gewinner
Kimi K2.653,558 %
Vals IndexOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash59,307 %Gewinner
Kimi K2.643,465 %
Vibe Code Bench v1.1Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Gemini 3.7 Flash70,395 %Gewinner
Kimi K2.637,891 %
Benchmarkwerte von Gemini 3.7 Flash und Kimi K2.6
Benchmark und AufgabeGemini 3.7 FlashKimi K2.6VergleichbarkeitQuelle
EMBOverall
71,326 %Gewinner
57,855 %
1accuracyMehr ist besserKohorte: vals-emb:1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-emb-2026-08-16-68d5d1d47a97Abgerufen am 16.08.2026
Finance Agent (v2)Overall
59,042 %Gewinner
44,899 %
2accuracyMehr ist besserKohorte: vals-finance-agent-v2:2:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-fabv2-2026-08-16-8853da43085dAbgerufen am 16.08.2026
Harvey's Legal Agent BenchmarkOverall · Task fully resolved
8,75 %Gewinner
1,667 %
1task resolution rateMehr ist besserKohorte: vals-legal-agent-benchmark:1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-hlab-2026-08-16-bae90566df2fAbgerufen am 16.08.2026
Legal Research BenchOverall · All-pass
34,615 %Gewinner
15,865 %
1all-pass rateMehr ist besserKohorte: vals-legal-research:1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-legal_research-2026-08-16-af296c00ecaaAbgerufen am 16.08.2026
Terminal-Bench 2.1Overall
77,528 %Gewinner
53,558 %
2.1accuracyMehr ist besserKohorte: vals-terminal-bench-2-1:2.1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-terminal-bench-2-1-2026-08-16-b3f38c18bea4Abgerufen am 16.08.2026
Vals IndexOverall
59,307 %Gewinner
43,465 %
2weighted index scoreMehr ist besserKohorte: vals-vals-index:2:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Kimi K2.6: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-vals_index-2026-08-16-ab641d89d6edAbgerufen am 16.08.2026
Vibe Code Bench v1.1Overall
70,395 %Gewinner
37,891 %
1.1accuracyMehr ist besserKohorte: vals-vibe-code-bench:1.1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashGemini 3.7 Flash: Harness: OpenHands
Kimi K2.6: Harness: OpenHands
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-vibe-code-2026-08-16-a73c9770bcc4Abgerufen am 16.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.