Zum Hauptinhalt springen
SprachmodellAktiv

Gemini 3.8 Flash

Google

Veröffentlicht
2. September 2026
Datenstand
2. September 2026

Einordnung

Position in der Kategorie

Die Übersicht nutzt nur veröffentlichte, zusammenpassende Daten. Fehlende Werte verändern keinen Rang.

Der Index mittelt Rangperzentile aus 4 dokumentierten Vergleichskohorten. Nur Modelle mit vollständiger Abdeckung erhalten eine Position.

Position
Platz 2 von 26
Indexwert
88,5 / 100
Abdeckung
4 / 4

Bestenliste

1Claude Opus 588,9 / 100
2Gemini 3.8 Flash, Aktuelles Modell88,5 / 100
3Claude Fable 583,2 / 100
25MiMo-V2.5-Pro12,5 / 100

Messreihen

Vergleichbare Benchmarkwerte

Jedes Diagramm zeigt ausschließlich eine Quelle, eine Messreihe und eine gespeicherte Vergleichskohorte. Die Balken ordnen die Position. Der Messwert steht rechts.

Terminal-Bench 2.1

90,8 % · Platz 1 von 2

Vergleichskohorte: google-gemini-38-terminal-bench-2-1-release · Datenstand: 2. September 2026

1.Gemini 3.8 Flash, Aktuelles Modell90,8 %
2.Gemini 3.7 Flash81,6 %

2 von 2 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Von Google veröffentlichter Vergleich von Gemini 3.8 Flash und 3.7 Flash. Kein Gradually-Test.

Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.

SWE-Bench Pro

61,6 % · Platz 1 von 2

Vergleichskohorte: google-gemini-38-swe-bench-pro-release · Datenstand: 2. September 2026

1.Gemini 3.8 Flash, Aktuelles Modell61,6 %
2.Gemini 3.7 Flash60,4 %

2 von 2 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Von Google veröffentlichter Vergleich von Gemini 3.8 Flash und 3.7 Flash. Kein Gradually-Test.

OpenAI schätzt nach einer Prüfung, dass rund 30 % der öffentlichen Aufgaben fehlerhaft sind. Der Wert bleibt deshalb ein umstrittenes Zusatzsignal. Die Zeilen sind eine redaktionelle Auswahl aus der jeweiligen Vergleichstabelle.

Humanity's Last Exam

45,4 % · Platz 2 von 2

Vergleichskohorte: google-gemini-38-hle-release · Datenstand: 2. September 2026

1.Gemini 3.7 Flash45,7 %
2.Gemini 3.8 Flash, Aktuelles Modell45,4 %

2 von 2 Modellversionen im Diagramm. Ein höherer Wert liegt vorn.

Von Google veröffentlichter Vergleich von Gemini 3.8 Flash und 3.7 Flash. Kein Gradually-Test.

Redaktionelle Auswahl aus der Hersteller-Tabelle, kein vollständiger Auszug der Vergleichsgruppe.

Steckbrief

Technische Daten und Zugang

Veröffentlichte Angaben zum Modell. Nicht bekannte Werte werden nicht geschätzt.

Modelltyp
ProprietärQuelle
Kontextfenster
1.048.576 TokenQuelle
Knowledge Cutoff
März 2026Quelle
Hinweise
Veröffentlicht am 2. September 2026. Multimodales Flash-Modell mit 1.048.576 Token Kontext, bis zu 65.536 Token Ausgabe und drei Reasoning-Stufen. Google veröffentlicht weder Parameterzahl noch Architektur.Quelle

Kosten

Veröffentlichte Preise

Preise bleiben an die dokumentierte Einheit und Quelle gebunden.

API-Eingabe
0,75 $ pro 1 Mio. TokenQuelle
API-Ausgabe
3,75 $ pro 1 Mio. TokenQuelle
Cache lesen
0,08 $ pro 1 Mio. TokenQuelle

Direkte Vergleiche

Dieses Modell im Vergleich

Jedes Duell vergleicht dieses Modell mit genau einem weiteren Modell aus derselben Kategorie.

Weitere Modelle

Modelle derselben Auswahl

Alle KI-Modelle

Nachweise

Primärquellen und Datenstand

Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.