Gemini-API-Preise, erklärt (September 2026): jedes Text- und Bildmodell, und die Preiserhöhung, die offen sichtbar versteckt ist
Suchst du nach Gemini-API-Preisen, landest du bei Rechner-Seiten und Kostenleitfäden, mehrere davon aus Mitte 2026 datiert, die einen Flash-Preis nennen, der entweder zwei Generationen alt oder aus Versehen der Preis ist, den Google erst ab Januar 2027 verlangt. Hier steht die tatsächliche aktuelle Tabelle, direkt aus Googles eigenen Preis- und Abrechnungsseiten übernommen und Zeile für Zeile gegengeprüft, plus das eine Datum, das sich jeder Entwickler, der gerade auf Gemini aufbaut, im Kalender markieren sollte.
Gemini 3.6, 3.7 und 3.8 Flash kosten aktuell alle 0,75 $ pro Million Input-Token und 3,75 $ pro Million Output-Token. Das ist ein Einführungspreis, der bis zum 31. Dezember 2026 läuft. Am 1. Januar 2027 verdoppeln sich alle drei auf 1,50 $/7,50 $. Wenn du ein Projekt über den Jahreswechsel hinaus budgetierst, rechne mit der höheren Zahl.
Gemini 3.1 Pro Preview, das aktuelle Flaggschiff-Reasoning-Modell, hat überhaupt keine Gratis-Stufe, eine wirklich kontraintuitive Tatsache, da das ältere Gemini 2.5 Pro weiterhin eine hat. Willst du kostenlos gegen ein Pro-Modell prototypen, brauchst du das ältere Modell, nicht das neueste.
Die meisten von uns geprüften Preis-Tracker Dritter sind aktuell falsch oder veraltet, und zwar auf eine Weise, die zählt: Einer listet 3.6 Flashs Preis nach 2027 als heutigen Preis, ein anderer zitiert einen Modellnamen („Gemini 3 Pro Preview"), den Google inzwischen umbenannt hat, und zwei weitere erwähnen die Flash-Generation 3.6/3.7/3.8 überhaupt nicht.
Ein „Budget-Alarm" ist nicht dasselbe wie eine Ausgabenobergrenze. Mehrere Entwickler haben von vierstelligen und fünfstelligen Überraschungsrechnungen berichtet, weil Googles Alarme nur benachrichtigen, aber die Abrechnung nicht stoppen, sofern nicht separat eine harte Projekt-Ausgabenobergrenze eingerichtet wird, eine Option, die Google 2026 nach einer Welle solcher Vorfälle hinzufügte.
Die aktuelle Preistabelle, geprüft gegen Googles eigene Seite
Jede Zahl unten stammt von ai.google.dev/gemini-api/docs/pricing, von Google selbst mit dem Stand 4. September 2026 versehen, gegengeprüft gegen Google Clouds Enterprise-Preisseite für dieselben Modelle. Die Preise gelten für die Standard-Stufe, pro 1 Million Token, in USD. Zwei Multiplikatoren gelten für nahezu jedes Modell dieser Liste: Batch- oder Flex-Verarbeitung läuft zu 50% des Standardsatzes, und Priority-Verarbeitung kostet das 1,8-Fache des Standards.
Model Input $/1M Output $/1M Free tier
------------------------------------------------------------------------
Gemini 3.1 Pro Preview $2.00 (<=200K) $12.00 (<=200K) None
$4.00 (>200K) $18.00 (>200K)
Gemini 3.8 Flash $0.75* $3.75* Yes (limited)
Gemini 3.7 Flash $0.75* $3.75* Yes (limited)
Gemini 3.6 Flash $0.75* $3.75* Yes (limited)
Gemini 3.5 Flash $1.50 $9.00 Yes (limited)
Gemini 3.5 Flash-Lite $0.30 $2.50 Yes (limited)
Gemini 3.1 Flash-Lite $0.25 / $0.50a $1.50 Yes (limited)
Gemini 3 Flash Preview $0.50 / $1.00a $3.00 Yes (limited)
Gemini 2.5 Pro $1.25 (<=200K) $10.00 (<=200K) Yes (limited)
$2.50 (>200K) $15.00 (>200K)
Gemini 2.5 Flash $0.30 / $1.00a $2.50 Yes (limited)
Gemini 2.5 Flash-Lite $0.10 / $0.30a $0.40 Yes (limited)
* Introductory price through 31 Dec 2026. Rises to $1.50 in / $7.50 out
on 1 Jan 2027 for all three Flash 3.6/3.7/3.8 models.
a Audio input is priced separately/higher than text, image, and video
input on these models - the second figure is the audio rate.Diese Tabelle deckt die Text- und Reasoning-Modellreihe ab; Geminis Echtzeit-Varianten Live, Omni, Transcribe und TTS-Preview werden separat abgerechnet und sind hier nicht Thema. Context Caching steht bei jedem Modell oben mit rund 90% Rabatt auf den Input-Satz zur Verfügung, plus einer stündlichen Speichergebühr (typischerweise 0,50 $ bis 4,50 $ pro Million Token und Stunde, höher bei den Pro-Modellen). Keine der Preis- oder Abrechnungsseiten, die Google für Entwickler veröffentlicht, nennt explizite Requests-per-Minute- oder Tokens-per-Minute-Zahlen; die stehen auf einer separaten Rate-Limits-Seite und ändern sich häufig genug, dass wir hier keine konkrete Zahl abdrucken, sondern nur darauf hinweisen, dass RPM-/TPM-Obergrenzen für Gratis- und Bezahlstufen real sind und sich lohnen, direkt geprüft zu werden, bevor du auf einen angenommenen Durchsatz baust.

Die Preisklippe im Januar 2027, die kaum jemand anspricht
Das ist die mit Abstand nützlichste Tatsache für alle, die ein Gemini-gestütztes Projekt über den Jahreswechsel hinaus budgetieren, und es ist genau die Zahl, bei der jeder von uns geprüfte Tracker Dritter entweder falschlag oder sie ganz ausließ. Gemini 3.6, 3.7 und 3.8 Flash, die drei Modelle, auf denen die meisten Entwickler gerade tatsächlich aufbauen, sind bis zum 31. Dezember 2026 alle zu einem Einführungspreis von 0,75 $ Input / 3,75 $ Output pro Million Token angesetzt. Am 1. Januar 2027 verdoppelt sich dieser Satz bei allen dreien auf 1,50 $/7,50 $. Das ist keine Preiserhöhung, die Google im Stillen plant; sie steht bereits auf der aktuellen Preisseite, direkt neben dem aktuellen Satz, und man übersieht sie leicht, weil die Seite sie eher als Fußnote präsentiert statt als Schlagzeile. Geht das Kostenmodell deines Projekts davon aus, dass der heutige Flash-Preis unbegrenzt hält, stimmt das nicht, und die Verdopplung ist nicht klein: Ein Workload, der heute 750 $ im Monat an Flash-Output-Token kostet, kostet ab Januar 1.500 $ im Monat.
Die Lücke bei der Gratis-Stufe: Das neueste Pro-Modell hat keine
Die Verfügbarkeit der Gratis-Stufe folgt nicht sauber danach, wie neu oder leistungsfähig ein Modell ist, und Gemini 3.1 Pro Preview ist das klarste Beispiel dafür. Es ist das aktuelle Flaggschiff-Reasoning-Modell und hat überhaupt keine Gratis-Stufe, nicht einmal ein kleines, ratenbegrenztes Kontingent. Jedes Modell der Flash-Stufe, von der ältesten Legacy-Preview bis zum neuesten 3.8 Flash, behält irgendeine Form von Gratis-Zugang. Auch Gemini 2.5 Pro, das Pro-Modell der Vorgängergeneration, hat weiterhin eine. Willst du also kostenlos die Reasoning-Qualität eines Pro-Modells testen, bevor du Budget zusagst, ist der praktische Weg heute das ältere 2.5 Pro, nicht das neuere, in Benchmarks besser abschneidende 3.1 Pro Preview, rein wegen der Art, wie Google die Gratis-Stufe gestaffelt hat.
Abrechnung der Gratis-Stufe, und wie sich die Bezahlstufen freischalten
Der Gemini-API-Zugang beginnt auf einer kostenlosen, ratenbegrenzten Stufe, die jedem aktiven Projekt zur Verfügung steht, ohne dass ein Abrechnungskonto nötig ist. Der Wechsel zu einem bezahlten Zugang erfolgt in gestaffelten Stufen, die jeweils eine höhere monatliche Abrechnungsobergrenze freischalten, geprüft anhand von Googles eigener Abrechnungsdokumentation:
Tier Qualification Billing cap
----------------------------------------------------------------
Free Active project or free trial N/A
Tier 1 Link an active billing account $250
Tier 2 Paid $100+, 3 days after first payment $2,000
Tier 3 Paid $1,000+, 30 days after first payment $20,000-100,000+
Innerhalb der Bezahlstufen gibt es zwei Abrechnungspläne: Postpay, das traditionelle Modell mit Bezahlung nach Nutzung, und Prepay, 2026 hinzugefügt, bei dem du im Voraus Guthaben lädst und die Ausgaben auf den geladenen Betrag gedeckelt sind, eine deutlich sicherere Option für alle, die schon einmal von einer Überraschungsrechnung erwischt wurden (siehe unten). Google hat 2026 außerdem projektbezogene harte Ausgabenobergrenzen hinzugefügt, die den API-Zugriff eines Projekts tatsächlich pausieren, sobald ein Budget aufgebraucht ist, im Unterschied zu den älteren Budget-Alarm-Benachrichtigungen, die dich erst im Nachhinein per E-Mail informieren.
Grounding-Tools kosten extra, und das Gratis-Kontingent ist kleiner, als es klingt
Braucht dein Anwendungsfall, dass das Modell Antworten in Echtzeit-Google-Search-Ergebnissen oder Google-Maps-Daten verankert, wird das separat von der Token-Nutzung abgerechnet. Google-Search-Grounding gibt den Gemini-3.x-Modellen ein gemeinsames Kontingent von 5.000 kostenlosen Anfragen pro Monat über alle 3.x-Modelle zusammen, nicht pro Modell, danach 14 $ pro 1.000 Anfragen. Gemini-2.5-Modelle bekommen statt eines monatlichen ein kleineres tägliches Kontingent: 1.500 Anfragen pro Tag, gemeinsam genutzt von 2.5 Flash und Flash-Lite, plus separate 1.500 RPD für 2.5 Pro, danach 35 $ pro 1.000 verankerte Prompts, rund das 2,5-Fache des 3.x-Modell-Satzes. Google-Maps-Grounding ist pro Anfrage günstiger (25 $/1.000), mit einem Gratis-Kontingent von 500 Anfragen/Tag bei Flash-Modellen oder 10.000/Tag bei Pro. Stützt sich deine App bei jeder Antwort auf Grounding, ist das häufig der Posten, der die Rechnung dominiert, nicht der Basis-Token-Preis.
Bildgenerierung und Embeddings
Googles Bild- und Embedding-Modelle werden zum selben Input-Token-Satz abgerechnet wie ihr jeweiliges Text-Pendant, zuzüglich einer separaten Gebühr pro Ausgabebild oder pro Ausgabe-Token:
Model Input Image/embedding output
--------------------------------------------------------------------------
Gemini 3 Pro Image (Nano Banana Same as 3.1 $120/1M tok out =
Pro) Pro Preview $0.134/image (1K-2K),
$0.24/image (4K).
No free tier.
Gemini 3.1 Flash Image (Nano $0.50 (text) $60/1M tok out =
Banana 2) out $3.00 $0.045-$0.151/image
Gemini 2.5 Flash Image (Nano $0.30 $0.039/image (1024x1024)
Banana)
Gemini Embedding 2 (multimodal) text $0.20/1M, image $0.45/1M
($0.00012/img), audio $6.50/1M
($0.00016/sec), video $12.00/1M
($0.00079/frame). Free tier: yes.
Gemini Embedding (text-only) $0.15/1M. Free tier: yes.Was tatsächlich schiefgeht: Alarme sind keine Obergrenzen, und geleakte Keys werden teuer
Das Muster in nahezu jeder echten Horrorgeschichte zur Gemini-API-Abrechnung ist dieselbe Lücke: Ein Budget-Alarm benachrichtigt dich per E-Mail, stoppt aber nicht den Zähler. Googles eigene Community-Foren und Entwickler-Diskussionen dokumentieren das immer wieder. Ein Thread im Google AI Developer Forum beschreibt einen Nutzer, dem rund 780 $ für 1.540 Veo-Videogenerierungen berechnet wurden, obwohl seiner Aussage nach nur rund 20 Clips hätten entstehen sollen; er nannte das Volumen im fraglichen Zeitfenster „physisch unmöglich"; der Google-Support löste den Streitfall im Thread nicht vollständig. Eine GitHub Discussion im gemini-cli-Repository beschreibt einen Entwickler, der einen API-Key zur CLI hinzufügte und Gratis-Stufen-Nutzung erwartete: Über drei Tage lief eine Rechnung von 66 $ auf, bei einem Verbrauch von 97 Millionen Token an einem einzigen Nachmittag, dann, in einer Folge-Sitzung, weitere 72 $ in rund vier Stunden, in beiden Fällen weit mehr Token-Volumen, als der Nutzer seiner tatsächlichen Nutzung nach für gerechtfertigt hielt. Separat berichteten Sicherheitsforscher von Truffle Security, 2.863 aktive Google-API-Keys öffentlich im Web gefunden zu haben, die sich bei der Gemini-API authentifizieren konnten, weil jeder Key, der an ein Projekt mit aktivierter Gemini-API gebunden ist, zu einem gültigen Gemini-Zugangsdatensatz wird, ein Detail aus dem Legacy-Design und kein Gemini-spezifischer Bug, das aber echte, diebstahlbedingte Rechnungen in Höhe von Zehntausenden Dollar verursacht hat, berichtet unter anderem von The Register und Tom's Hardware.
Die Lösung ist in jedem dokumentierten Fall dieselbe: Verlass dich nicht auf Alarm-E-Mails als Sicherheitsnetz. Richte eine echte projektbezogene Ausgabenobergrenze ein (2026 hinzugefügt und die einzige Einstellung, die die Abrechnung tatsächlich stoppt statt dich nur zu benachrichtigen), rotiere jeden API-Key, der jemals in einem öffentlichen Repository oder in clientseitigem Code aufgetaucht ist, und erwäge Prepay-Abrechnung, wenn du eine harte Obergrenze per Design willst statt einer Einstellung, an die du dich erst erinnern musst.
Warum der Preisrechner, den du in der Suche gefunden hast, heute falschliegen könnte
Wir haben mehrere der für dieses Thema gut rankenden Gemini-Preisseiten Dritter gegen Googles eigene Primärquelle geprüft und dabei echte, konkrete Fehler gefunden, die man kennen sollte, falls man andere Leitfäden querverweist: Der „aktuelle" Preis eines Trackers für Gemini 3.6 Flash ist in Wirklichkeit der Satz nach der Erhöhung im Januar 2027, nicht der heutige Einführungspreis. Ein anderer Artikel, preislich korrekt für das beschriebene Modell, nennt es bei einem Namen, „Gemini 3 Pro Preview", den Google inzwischen zugunsten von „Gemini 3.1 Pro Preview" ausrangiert hat, und behauptet zudem, das Modell habe keinen Batch- oder Caching-Rabatt, was nicht mehr stimmt. Zwei weitere von uns geprüfte Leitfäden erwähnen die Flash-Generation 3.6, 3.7 oder 3.8 überhaupt nicht, sodass ein Leser, der sich darauf verlässt, nicht einmal wüsste, dass die aktuelle mittlere Flash-Reihe existiert. Nichts davon ist böswillig, Preisseiten veralten in einem Markt, der alle drei Wochen ein neues Flash-Modell ausliefert, einfach schnell, aber es ist ein guter Grund, vor dem Vertrauen in irgendeinen Preisleitfaden, auch diesen hier, auf den Zeitstempel zu achten; liest du das hier deutlich nach September 2026, prüfe es noch einmal gegen Googles eigene Seite, bevor du Budget zusagst.
Häufige Fragen
Ist die Gemini API kostenlos nutzbar?
Die meisten Gemini-Modelle haben eine kostenlose, ratenbegrenzte Stufe, die jedem aktiven Projekt ohne Abrechnungskonto zur Verfügung steht, einschließlich der aktuellen Flash-Reihe (3.6, 3.7, 3.8 Flash) und Gemini 2.5 Pro. Die eine nennenswerte Ausnahme ist Gemini 3.1 Pro Preview, das aktuelle Flaggschiff-Reasoning-Modell, das überhaupt keine Gratis-Stufe hat.
Wie viel kostet Gemini 3.8 Flash?
0,75 $ pro Million Input-Token und 3,75 $ pro Million Output-Token, ein Einführungspreis, der dem von 3.6 und 3.7 Flash entspricht, gültig bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 verdoppelt sich der Preis auf 1,50 $/7,50 $.
Warum fiel meine Gemini-API-Rechnung viel höher aus als erwartet?
Die am häufigsten gemeldete Ursache ist die Verwechslung eines Budget-Alarms mit einer Ausgabenobergrenze: Alarme benachrichtigen dich erst, nachdem die Nutzung stattgefunden hat, sie stoppen die Abrechnung nicht. Richte eine ausdrückliche projektbezogene Ausgabenobergrenze ein oder wechsle zu Prepay-Abrechnung (beides 2026 von Google hinzugefügt), wenn du eine harte Obergrenze willst. Geleakte oder öffentliche API-Keys sind die andere große Ursache für hohe Überraschungsrechnungen.
Sind Google-Search-Grounding-Kosten in den Gemini-API-Preisen enthalten?
Nein, Grounding wird separat von der Token-Nutzung abgerechnet. Gemini-3.x-Modelle bekommen 5.000 kostenlose Search-Grounding-Anfragen pro Monat, gemeinsam über alle 3.x-Modelle genutzt, danach 14 $ pro 1.000 Anfragen. Ältere 2.5-Modelle bekommen ein kleineres tägliches Gratis-Kontingent und zahlen 35 $ pro 1.000 verankerte Anfragen.
Ist die Gemini-API günstiger als GPT oder Claude?
Das hängt stark davon ab, welches konkrete Modell und welche Stufe du vergleichst, und die Preise aller drei Anbieter ändern sich alle paar Wochen, sodass jede einzelne Vergleichstabelle schnell veraltet. Vergleiche die genauen Modell-IDs und Stufen, die du nutzen willst, direkt auf der aktuellen Preisseite jedes Anbieters, statt einem statischen Vergleich zu vertrauen.
Exportiere dein NotebookLM mit einem Klick
Kostenlose Chrome-Erweiterung. PDF, Word und Markdown. Auf deinem Gerät gerendert — nichts wird hochgeladen.