Gemini 3.8 Flash kam drei Wochen nach 3.7. Das Preisschild bewegte sich nicht, die Rechnung schon
Googles dritte Flash-Veröffentlichung in sechs Wochen behält denselben Preis pro Token wie 3.7 Flash, anders als der Preisschnitt davor. Schaut man hinter das Preisschild, wird eine reale Aufgabe trotzdem rund 40% teurer, aus demselben Grund, aus dem 3.7 Flash still und leise teurer wurde, als es aussah. Es gibt in diesem Release auch ein zweites Modell, abgeschottet hinter einem Programm, von dem die meisten Leser noch nie gehört haben, gebaut, um selbstständig Sicherheitslücken zu finden.
Was kam: Gemini 3.8 Flash, allgemein verfügbar seit 2. September 2026, drei Wochen nach 3.7 Flash, plus ein zweites Modell, Gemini 3.8 Flash Cyber, gebaut speziell zum Aufspüren und Patchen von Sicherheitslücken. Google nennt das Paar seine „nächste Generation von Intelligenz für agentische Workflows und Cybersicherheit".
Das Preisschild blieb stehen, die reale Kosten nicht. Die Preise für Input/Output bleiben bei 0,75 $ / 3,75 $ pro Million Token bis zum 31. Dezember 2026, unverändert gegenüber 3.7 Flash, mit weiterhin geplanter Verdopplung auf 1,50 $ / 7,50 $ zum 1. Januar 2027. Doch Artificial Analysis maß in seiner Benchmark-Suite rund 30% mehr Output-Token pro Aufgabe, was die reale Kosten pro erledigter Aufgabe um etwa 40% nach oben trieb, von 0,40 $ auf 0,58 $.
3.8 Flash Cyber ist nichts, wofür man sich einfach anmelden kann. Es ist auf Googles Fairwind Program beschränkt: staatliche Cyberabwehr-Behörden, Betreiber kritischer Infrastruktur und Maintainer von Open-Source-Software. Es gibt keine öffentliche API, keinen Self-Service-Zugang, keinen gelisteten Preis.
Gemini Notebook wird weiterhin nicht erwähnt. Genau wie bei 3.7 Flash listet Googles Launch-Material die Gemini-App, AI Studio, Antigravity, Android Studio, Gemini Enterprise und die Gemini-API auf. Gemini Notebook taucht nicht auf.

Die Zahlen, und wem sie jeweils gehören
Googles eigene Benchmark-Tabelle, veröffentlicht zusammen mit dem Modell, zeigt echte Fortschritte: HLE-Verified klettert auf 54,9%, CWE-Bench pass@1 liegt bei 47,2%. Die unabhängige Messung von Artificial Analysis setzt den Intelligence Index des Modells bei hohem Reasoning-Aufwand auf 59, gegenüber 56 bei 3.7 Flash, und einen Sprung um 12 Punkte auf 45% beim agentischen τ³-Banking-Benchmark. Diese beiden Quellen stimmen eng genug überein, um ihnen zu vertrauen.
Eine dritte Zahl ist eher als Warnhinweis denn als Fakt zu nennen: DataCamps Artikel zitiert Terminal-Bench 2.1 bei 90,8% und SWE-Bench Pro bei 61,6%, beides deutlich höher als alles in Googles eigenem Beitrag oder in 9to5Googles Berichterstattung. Weder Google noch Artificial Analysis veröffentlichen eine passende Zahl. Solange keine zweite unabhängige Quelle das reproduziert, gilt dieses Zahlenpaar als eigener Test eines einzelnen Mediums, nicht als bestätigter Google-Benchmark.
Metric 3.7 Flash 3.8 Flash
--------------------------------------------------------
HLE (plain) 45.7% 45.4%
HLE-Verified n/a 54.9%
CWE-Bench pass@1 n/a 47.2%
AA Intelligence Index (high) 56 59
tau3-Banking (agentic) 33% 45%
Cost per Intelligence Index task $0.40 $0.58
Plain HLE barely moved. The gains concentrate in agentic
and verified-reasoning tasks, not raw knowledge recall,
and they cost more tokens to reach.Warum das stabile Preisschild in die Irre führt
Das ist die zweite Veröffentlichung in Folge, bei der die Schlagzeilen-Zahl beim Preis untertreibt, was eine Aufgabe tatsächlich kostet. Als 3.6 Flash im August zu 3.7 Flash wurde, wurde das Preisschild halbiert, doch unabhängige Tests fanden heraus, dass die schwerere Standard-Reasoning-Stufe des Modells rund 40% mehr abgerechnete Token pro Aufgabe hinzufügte und damit den Großteil dieses Preisschnitts bei hochvolumiger, wenig komplexer Arbeit auffraß. Diesmal gibt es keinen Preisschnitt, der aufgezehrt werden könnte: 3.8 Flashs Preis pro Token ist identisch mit dem von 3.7 Flash, und Artificial Analysis' eigene Messung zeigt trotzdem dasselbe Muster erneut. Das Modell braucht jetzt rund 30% mehr Output-Token, um einen bestimmten Benchmark-Wert zu erreichen, und Denk-Token werden weiterhin zum Output-Satz abgerechnet. Nettoeffekt: Eine Aufgabe, die auf 3.7 Flashs Intelligence-Index-Suite 0,40 $ kostete, kostet auf 3.8 Flash jetzt rund 0,58 $, ein Plus von über 40% bei einem Preisschild, das sich nie bewegt hat. Wenn dein Workload hochvolumig und kostensensibel statt reasoning-lastig ist, ist das die Zahl, gegen die du budgetieren solltest, nicht der Preis pro Token.
3.8 Flash Cyber: ein Modell, das du wahrscheinlich nicht nutzen kannst
Das zweite Modell in diesem Release bekommt deutlich weniger Berichterstattung als die Preisgeschichte, und es ist womöglich die ungewöhnlichere Produktentscheidung. Gemini 3.8 Flash Cyber ist eine Variante, speziell auf Sicherheitsarbeit abgestimmt: Googles eigene Zahlen behaupten eine reale Erkennungsrate von Sicherheitslücken über 70%, 2,6-mal mehr korrekte Patches für einen Satz Chrome-Bugs als kommerzielle Konkurrenztools in Googles eigenen Tests, und einen Fall, in dem es in unter zwei Stunden eine kritische Sicherheitslücke fand, eine Arbeit, für die ein Sicherheitsteam laut Google normalerweise Monate braucht. Im Wiz-Benchmark erzielte es 7,5 bis 9,7 Prozentpunkte höhere Trefferquote bei 2,3- bis 5,2-fach niedrigeren Kosten als die Tools, mit denen Wiz es verglich.
Nichts davon ist etwas, das die meisten Leser einfach ausprobieren können. Cyber läuft nur über Googles Fairwind Program, beschränkt auf staatliche Cyberabwehr-Behörden, Betreiber kritischer Infrastruktur und Maintainer weitverbreiteter Open-Source-Software. Es gibt keinen öffentlichen API-Endpunkt, keine Anmeldung für Verbraucher oder Entwickler, und keinen gelisteten Preis. Wenn du gerade KI-Tools fürs Coden oder für Sicherheit für dein eigenes Team bewertest, ist 3.8 Flash Cyber keine der Optionen auf dem Tisch, egal wie gut die Benchmarks aussehen.
Wo das normale Modell tatsächlich landet
Das reguläre 3.8 Flash läuft live in der Gemini-App (einschließlich Gemini Spark, dem agentischen Assistenten, für Google-AI-Pro- und -Ultra-Abonnenten), den KI-Funktionen von Google Sheets auf denselben Bezahlstufen, Google Antigravity, AI Studio, Android Studio, Stitch, der Gemini Enterprise Agent Platform und der Gemini-API. Das ist dieselbe Liste an Oberflächen, auf die 3.7 Flash drei Wochen zuvor kam, was zeigt: Das ist ein reines Modell-Update für Googles bestehende Flash-Stufen-Oberflächen, kein neuer Integrationsvorstoß.
Die Ermüdung zeigt sich, nicht nur in den Kommentaren
Die eigene Berichterstattung von The Register zu diesem Launch beginnt mit Skepsis statt mit der Benchmark-Tabelle, nennt das Googles dritte Flash-Veröffentlichung in sechs Wochen und die vierte in vier Monaten, und weist darauf hin, dass das Muster in eine Zeit fällt, in der Gemini 3.5 Pro, das Flaggschiff-Modell, weit über sein ursprüngliches Ziel Mitte 2026 hinaus verzögert bleibt. Threads, die den Release auf Hacker News diskutieren, spiegeln dieselbe Lesart wider: echte Beschwerden über „immer noch kein Pro-Modell", und ein Gefühl, wie es ein Medium formulierte, dass das „ein Laufband ist, keine Treppe". Nichts davon ändert, was tatsächlich geliefert wurde, aber es lohnt sich zu wissen, dass man nicht der Einzige ist, der sich fragt, ob ein drittes Flash-Update in sechs Wochen ohne passendes Pro-Release ein Rhythmus ist oder ein Stillstand.
Was weiterhin nicht zu Gemini Notebook führt
Derselbe Befund wie bei 3.7 Flash, den man besser noch einmal ausspricht, statt anzunehmen, er gelte automatisch weiter: Nichts in Googles Ankündigung, im Modell-Datenblatt oder in der Berichterstattung zu diesem Launch erwähnt Gemini Notebook. Der bestätigte Einsatzbereich ist die allgemeine Gemini-App, Sheets, Entwickler-Oberflächen und Enterprise-Tools, nicht speziell das Notebook-Produkt. Unser eigener Leitfaden zur Versionsgeschichte verfolgt, welches Gemini-Modell tatsächlich den Chat und die Studio-Ausgaben von Gemini Notebook über die Zeit antreibt, und der jüngste bestätigte Eintrag dieses Leitfadens liegt heute noch vor diesem Release. Ob ein schnelleres oder günstigeres Flash-Modell in deinen Notebook-Chats etwas an deiner Nutzung ändern würde, ist bislang in keine Richtung bestätigt.
Häufige Fragen
Ist Gemini 3.8 Flash günstiger als 3.7 Flash?
Der Preis pro Token ist identisch: 0,75 $ Input / 3,75 $ Output pro Million Token bis zum 31. Dezember 2026, ansteigend auf 1,50 $ / 7,50 $ zum 1. Januar 2027. Unabhängige Tests fanden jedoch heraus, dass das Modell rund 30% mehr Output-Token pro Aufgabe braucht, was die reale Kosten pro erledigter Aufgabe trotz stabilem Preisschild um etwa 40% erhöht.
Was ist Gemini 3.8 Flash Cyber?
Eine auf Sicherheit spezialisierte Variante von 3.8 Flash, gebaut zum Aufspüren und Patchen von Sicherheitslücken, beschränkt auf Googles Fairwind Program (staatliche Cyberabwehr-Behörden, Betreiber kritischer Infrastruktur und Open-Source-Maintainer). Es hat keine öffentliche API, keine Self-Service-Anmeldung und keinen gelisteten Preis.
Treibt Gemini 3.8 Flash Gemini Notebook an?
Nicht bestätigt. Googles Launch-Material listet die Gemini-App, Sheets, AI Studio, Antigravity, Android Studio, Gemini Enterprise und die Gemini-API als Einsatzorte auf. Gemini Notebook wird in der Ankündigung nirgends genannt, dieselbe Lücke wie beim 3.7-Flash-Release drei Wochen zuvor.
Warum brachte Google so schnell nach 3.7 ein weiteres Flash-Modell heraus?
Google beschreibt das als beschleunigten Release-Rhythmus für seine Flash-Reihe, die dritte Veröffentlichung in sechs Wochen und die vierte in vier Monaten. Das fällt in eine Zeit, in der Gemini 3.5 Pro, das für Mitte 2026 versprochene Flaggschiff-Modell, verzögert bleibt; Google hat beides nicht direkt verknüpft, aber Medien wie The Register haben das Muster bemerkt.
Ist Gemini 3.8 Flash tatsächlich besser als 3.7 Flash?
Bei verifizierten und agentischen Benchmarks ja, um eine echte Marge: Artificial Analysis maß seinen Intelligence Index bei 59 gegenüber 56, und Googles eigene Zahlen zeigen Fortschritte bei HLE-Verified und CWE-Bench. Die reine Faktenwissens-Leistung (HLE) bewegte sich kaum, die Verbesserung konzentriert sich also speziell auf Reasoning- und agentische Aufgaben, nicht auf allgemeines Wissen.
Exportiere dein NotebookLM mit einem Klick
Kostenlose Chrome-Erweiterung. PDF, Word und Markdown. Auf deinem Gerät gerendert — nichts wird hochgeladen.