Zum Hauptinhalt springen

Direktvergleich

Claude Sonnet 5 vs. Gemini 3.7 Flash

Veröffentlichte Benchmarkwerte aus derselben Version und Vergleichskohorte, API-Preise und technische Eckdaten. Unterschiedliche Testeinstellungen werden sichtbar ausgewiesen.

8

gemeinsame Messreihen

8

verschiedene Benchmarks

16.08.2026

jüngster Abruf

Modellauswahl ändern

Steckbrief und Kosten

Allgemeine Daten und Standard-API-Preise

Nicht veröffentlichte Parameterzahlen oder Wissensstände bleiben als solche markiert. Die Tabelle zeigt direkte Standardtarife pro Token einschließlich hinterlegter Kontextstufen. Batch, Fast, Priority, regionale Aufschläge, Toolaufrufe und Cloudpreise sind nicht eingerechnet.

Allgemeine Daten und API-Preise von Claude Sonnet 5 und Gemini 3.7 Flash
MerkmalClaude Sonnet 5Gemini 3.7 Flash
AnbieterAnthropicGoogle
Erschienen30. Juni 202613. Aug. 2026
VerfügbarkeitAktivAktiv
ModelltypProprietärProprietär
ParameterNicht veröffentlichtNicht veröffentlicht
ArchitekturNicht veröffentlichtNicht veröffentlicht
Kontextfenster1.000.000 Token1.048.576 Token
WissensstandJanuar 2026März 2026
Technische QuellenModell, KontextModell, Wissensstand
API-Preise pro 1 Mio. Token
API-Eingabe2 $0,75 $
API-Ausgabe10 $3,75 $
Cache lesen0,2 $0,07 $
Cache schreiben (5 Min.)2,5 $Nicht ausgewiesen
Cache schreiben (1 Std.)4 $Nicht ausgewiesen
Preis geprüft11.08.2026Quelle16.08.2026Quelle
Claude Sonnet 5Gemini 3.7 Flash
API-EingabeUSD pro 1 Mio. Token, Basistarif
Claude Sonnet 52 $
Gemini 3.7 Flash0,75 $Günstiger
API-AusgabeUSD pro 1 Mio. Token, Basistarif
Claude Sonnet 510 $
Gemini 3.7 Flash3,75 $Günstiger
Cache lesenUSD pro 1 Mio. Token, Basistarif
Claude Sonnet 50,2 $
Gemini 3.7 Flash0,075 $Günstiger

Leistung

Gemeinsame Benchmarks

Nur veröffentlichte Ergebnisse mit derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte werden gegenübergestellt. Wenn Anbieter unterschiedliche Reasoning-Stufen, Agenten oder Ausgabegrenzen verwendet haben, steht das direkt in der Tabelle.

8 gemeinsame Messreihen
Claude Sonnet 5Gemini 3.7 Flash
EMBOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 566,316 %
Gemini 3.7 Flash71,326 %Gewinner
Finance Agent (v2)Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 553,909 %
Gemini 3.7 Flash59,042 %Gewinner
Harvey's Legal Agent BenchmarkOverall · Task fully resolved. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 55 %
Gemini 3.7 Flash8,75 %Gewinner
Legal Research BenchOverall · All-pass. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 541,827 %Gewinner
Gemini 3.7 Flash34,615 %
ProofBenchOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 577 %Gewinner
Gemini 3.7 Flash58 %
Terminal-Bench 2.1Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 574,532 %
Gemini 3.7 Flash77,528 %Gewinner
Vals IndexOverall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 559,61 %Gewinner
Gemini 3.7 Flash59,307 %
Vibe Code Bench v1.1Overall. Mehr ist besser. Kein dokumentierter Setup-Unterschied
Claude Sonnet 581,325 %Gewinner
Gemini 3.7 Flash70,395 %
Benchmarkwerte von Claude Sonnet 5 und Gemini 3.7 Flash
Benchmark und AufgabeClaude Sonnet 5Gemini 3.7 FlashVergleichbarkeitQuelle
EMBOverall
66,316 %
71,326 %Gewinner
1accuracyMehr ist besserKohorte: vals-emb:1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashClaude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-emb-2026-08-16-68d5d1d47a97Abgerufen am 16.08.2026
Finance Agent (v2)Overall
53,909 %
59,042 %Gewinner
2accuracyMehr ist besserKohorte: vals-finance-agent-v2:2:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashClaude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-fabv2-2026-08-16-8853da43085dAbgerufen am 16.08.2026
Harvey's Legal Agent BenchmarkOverall · Task fully resolved
5 %
8,75 %Gewinner
1task resolution rateMehr ist besserKohorte: vals-legal-agent-benchmark:1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashClaude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-hlab-2026-08-16-bae90566df2fAbgerufen am 16.08.2026
Legal Research BenchOverall · All-pass
41,827 %Gewinner
34,615 %
1all-pass rateMehr ist besserKohorte: vals-legal-research:1:overallKein dokumentierter Setup-UnterschiedSieger: Claude Sonnet 5Claude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-legal_research-2026-08-16-af296c00ecaaAbgerufen am 16.08.2026
ProofBenchOverall
77 %Gewinner
58 %
1.1accuracyMehr ist besserKohorte: vals-proof-bench:1.1:overallKein dokumentierter Setup-UnterschiedSieger: Claude Sonnet 5Claude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-proof_bench-2026-08-16-14232db24de1Abgerufen am 16.08.2026
Terminal-Bench 2.1Overall
74,532 %
77,528 %Gewinner
2.1accuracyMehr ist besserKohorte: vals-terminal-bench-2-1:2.1:overallKein dokumentierter Setup-UnterschiedSieger: Gemini 3.7 FlashClaude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-terminal-bench-2-1-2026-08-16-b3f38c18bea4Abgerufen am 16.08.2026
Vals IndexOverall
59,61 %Gewinner
59,307 %
2weighted index scoreMehr ist besserKohorte: vals-vals-index:2:overallKein dokumentierter Setup-UnterschiedSieger: Claude Sonnet 5Claude Sonnet 5: Keine weiteren Einstellungen ausgewiesen
Gemini 3.7 Flash: Keine weiteren Einstellungen ausgewiesen
Vals AITyp: Unabhängige EvaluationMessstand: 14.08.2026Import-ID: vals-vals_index-2026-08-16-ab641d89d6edAbgerufen am 16.08.2026
Vibe Code Bench v1.1Overall
81,325 %Gewinner
70,395 %
1.1accuracyMehr ist besserKohorte: vals-vibe-code-bench:1.1:overallKein dokumentierter Setup-UnterschiedSieger: Claude Sonnet 5Claude Sonnet 5: Harness: OpenHands
Gemini 3.7 Flash: Harness: OpenHands
Vals AITyp: Unabhängige EvaluationMessstand: 13.08.2026Import-ID: vals-vibe-code-2026-08-16-a73c9770bcc4Abgerufen am 16.08.2026

So liest du den Vergleich

Ein Benchmark-Sieg ist kein Gesamturteil

Entscheidend sind deine Aufgaben, dein Budget und die benötigte Kontextlänge. Ein Coding-Benchmark sagt wenig über Bildverständnis oder Agentenarbeit aus.

Preise beziehen sich auf die offiziellen API-Tarife pro 1 Mio. Token. Web-Abos und Cloud-Aufschläge können davon abweichen.

Jeder Messwert verlinkt seine Messstelle und zeigt den Abrufstand. Je nach Kennzeichnung handelt es sich um eine Anbieterangabe, ein offizielles Benchmark-Leaderboard oder eine unabhängige Evaluation. Strittige oder archivierte Ergebnisse werden nicht verwendet.