- Startseite
- KI-Modelle
- Gemini 3.8 Flash Cyber
Gemini 3.8 Flash Cyber
Google DeepMind
- Veröffentlicht
- 2. September 2026
- Datenstand
- 3. Oktober 2026
Gemini 3.8 Flash Cyber ist Googles Cyber-Spezialvariante für autonome Schwachstellensuche und automatisiertes Patchen. Google beschreibt eine eigene Ausrichtung auf autorisierte Verteidiger und sicherheitskritische Codebasen. Die Variante ist nicht mit dem allgemein verfügbaren Gemini 3.8 Flash gleichzusetzen.
Der Zugang läuft über Googles Fairwind-Programm für vertrauenswürdige Verteidiger, darunter Behörden, Betreiber kritischer Infrastruktur und Software Maintainer. Eine allgemeine Gemini-API-Freigabe für die Cyber-Variante ist nicht belegt.
Technische Daten und Zugang
| Angabe | Wert und Quelle |
|---|---|
| Modellklasse | Cyber-Spezialmodell für autorisierte SicherheitsarbeitQuelle |
| Zugang | Fairwind-Programm mit priorisiertem Zugang für vertrauenswürdige VerteidigerQuelle |
| Funktionen | Autonome Schwachstellensuche und automatisiertes PatchenQuelle |
| Verfügbarkeit | Keine allgemeine Gemini-API-Freigabe für diese Cyber-Variante belegtQuelle |
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
CyberGym final-submission pass@1 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 86.2
- Bewertung
- 86.2
- Messgröße
- CyberGym final-submission pass@1
- Einheit
- %
- Kategorie
- cybersecurity
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Gemini 3.8 Flash Cyber evaluation methodology
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. September 2026; Schwachstellensuche in C/C++, Pass@1 für die endgültige Einreichung; ein Versuch mit internem, nicht cyberspezialisiertem Antigravity-Harness; Standard-Sampling der Gemini API.
- Einordnung
- Von Google berechnetes Ergebnis mit Agenten-Harness, keine Messung ohne Werkzeuge oder gemeinsame Vergleichsgruppe. Genaues Laufdatum, Stichprobengröße und Thinking-Stufe fehlen.
CWE-Bench pass@1 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 47.2
- Bewertung
- 47.2
- Messgröße
- CWE-Bench pass@1
- Einheit
- %
- Kategorie
- cybersecurity
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Gemini 3.8 Flash Cyber evaluation methodology
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. September 2026; Evaluation von Collinear AI mit Antigravity-Agenten-Harness und Thinking-Stufe high; Pass@1, Standard-Sampling der Gemini API.
- Einordnung
- Google zitiert eine Evaluation des unabhängigen Benchmark-Betreibers. Der ursprüngliche Leaderboard-Eintrag wurde nicht direkt abgerufen; genaues Laufdatum und Stichprobengröße fehlen.
Real-world vulnerability discovery recall (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 71
- Bewertung
- 71
- Messgröße
- Real-world vulnerability discovery recall
- Einheit
- %
- Kategorie
- cybersecurity
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Gemini 3.8 Flash Cyber evaluation methodology
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. September 2026; interner Recall-Test mit über 1.200 bestätigten früheren Schwachstellen in Open-Source-Projekten aus 20 Programmiersprachen; internes, nicht cyberspezialisiertes Antigravity-Harness, Standard-Sampling der Gemini API.
- Einordnung
- Herstellerberichteter interner Datensatz, kein öffentlich reproduzierbarer Benchmark. Genaue Stichprobengröße, Laufdatum und Thinking-Stufe fehlen. Die Untergrenze ist keine exakte Stichprobenzahl.
Gray Swan IPI ASR@15 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 6
- Bewertung
- 6
- Messgröße
- Gray Swan IPI ASR@15
- Einheit
- %
- Kategorie
- cybersecurity
- Richtung
- Weniger ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Gemini 3.8 Flash Cyber evaluation methodology
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. September 2026; unabhängige Evaluation von Gray Swan mit kombiniertem Angriffssatz, nur Transfer-Angriffen und ohne Computernutzung; Angriffserfolg innerhalb von 15 Versuchen, Standard-Sampling der Gemini API.
- Einordnung
- Google zitiert eine unabhängig durchgeführte Gray-Swan-Evaluation, deren Originalergebnis nicht direkt abgerufen wurde. Gemessen wird Angriffserfolg, deshalb sind niedrigere Werte besser. Es handelt sich nicht um Pass@1.
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Recherchestand | Recherchestand 4. Oktober 2026. 3 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| Nicht veröffentlicht | wiz-penetration-test-protocol Originalwortlaut Die aktuelle Modellseite zeigt einen Wiz-Penetration-Test-Wert für das genaue Modell, aber keine Metrikdefinition, Richtung, Harness- oder Sampling-Angaben. Dieser Grafik wird kein Benchmarkwert entnommen. |
| Weitere Quelle | Google Gemini 3.8 Flash Cyber announcement (abgerufen 3. Oktober 2026; 4. Oktober 2026) · Google Gemini 3.8 Flash Cyber announcement · Redaktionelle Beschreibung geprüft am 3. Oktober 2026 |
| Weitere Quelle | Gemini 3.8 Flash Cyber evaluation methodology (abgerufen 4. Oktober 2026) |
| Weitere Quelle | Modellmetadaten (abgerufen 4. Oktober 2026) |