Guia

Preços da API do Gemini, explicados (setembro de 2026): todo modelo de texto e imagem, e o aumento de preço escondido à vista de todos

Procure por preços da API do Gemini e você vai cair em sites de calculadora e guias de custo, vários datados de meados de 2026, citando um preço do Flash que ou tem duas gerações de atraso ou é, sem querer, o preço que o Google começa a cobrar em janeiro de 2027. Aqui está a tabela real e atual, retirada diretamente das próprias páginas de preços e cobrança do Google e conferida linha por linha, além da única data que todo desenvolvedor construindo sobre o Gemini agora deveria ter marcada no calendário.

Atualizado 7 set 202611 min de leitura
Resposta rápida

O Gemini 3.6, 3.7 e 3.8 Flash custam atualmente US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída. Essa é uma taxa introdutória válida até 31 de dezembro de 2026. Em 1º de janeiro de 2027, os três dobram para US$ 1,50/US$ 7,50. Se você está planejando o orçamento de um projeto que vai passar do ano novo, use o número mais alto.

O Gemini 3.1 Pro Preview, o atual modelo de raciocínio principal, não tem nenhum plano gratuito, um fato genuinamente contraintuitivo, já que o Gemini 2.5 Pro, mais antigo, ainda tem. Se você quer prototipar de graça contra um modelo de nível Pro, precisa do modelo legado, não do mais novo.

A maioria dos rastreadores de preços de terceiros que verificamos está errada ou desatualizada agora mesmo, de formas que importam: um lista o preço pós-2027 do 3.6 Flash como o preço de hoje, outro cita um nome de modelo ("Gemini 3 Pro Preview") que o Google já renomeou, e outros dois nem mencionam a geração 3.6/3.7/3.8 Flash.

Um "alerta de orçamento" não é a mesma coisa que um teto de gastos. Vários desenvolvedores relataram contas surpresa de quatro e cinco dígitos porque os alertas do Google apenas notificam, eles não interrompem a cobrança, a menos que você configure separadamente um teto rígido de gastos do projeto, uma opção que o Google adicionou em 2026 depois de uma onda desses incidentes.

A tabela de preços atual, verificada na própria página do Google

Todo número abaixo vem de ai.google.dev/gemini-api/docs/pricing, com data marcada pelo próprio Google como última atualização em 4 de setembro de 2026, conferido cruzadamente com a página de preços empresariais do Google Cloud para os mesmos modelos. Os preços são do plano Standard, por 1 milhão de tokens, em dólares americanos. Dois multiplicadores se aplicam a quase todos os modelos desta lista: o processamento Batch ou Flex roda a 50% da taxa Standard, e o processamento Priority custa 1,8x o Standard.

Model                        Input $/1M      Output $/1M     Free tier
------------------------------------------------------------------------
Gemini 3.1 Pro Preview       $2.00 (<=200K)  $12.00 (<=200K)  None
                              $4.00 (>200K)   $18.00 (>200K)
Gemini 3.8 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.7 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.6 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.5 Flash             $1.50           $9.00            Yes (limited)
Gemini 3.5 Flash-Lite        $0.30           $2.50            Yes (limited)
Gemini 3.1 Flash-Lite        $0.25 / $0.50a  $1.50            Yes (limited)
Gemini 3 Flash Preview       $0.50 / $1.00a  $3.00            Yes (limited)
Gemini 2.5 Pro               $1.25 (<=200K)  $10.00 (<=200K)  Yes (limited)
                              $2.50 (>200K)   $15.00 (>200K)
Gemini 2.5 Flash             $0.30 / $1.00a  $2.50            Yes (limited)
Gemini 2.5 Flash-Lite        $0.10 / $0.30a  $0.40            Yes (limited)

* Introductory price through 31 Dec 2026. Rises to $1.50 in / $7.50 out
  on 1 Jan 2027 for all three Flash 3.6/3.7/3.8 models.
a Audio input is priced separately/higher than text, image, and video
  input on these models - the second figure is the audio rate.

Esta tabela cobre a linha de modelos de texto e raciocínio; as variantes Live, Omni, Transcribe e TTS-preview em tempo real do Gemini têm preços separados e estão fora do escopo aqui. O cache de contexto está disponível em todos os modelos acima com um desconto de aproximadamente 90% sobre a taxa de entrada, mais uma taxa de armazenamento por hora (tipicamente de US$ 0,50 a US$ 4,50 por milhão de tokens por hora, mais alta para os modelos de nível Pro). Nenhuma das páginas de preços ou cobrança que o Google publica para desenvolvedores informa números explícitos de requisições por minuto ou tokens por minuto; esses números ficam numa página separada de limites de taxa e mudam com frequência suficiente para que não repitamos um valor específico aqui, apenas sinalizando que os tetos de RPM/TPM dos planos gratuito e pago são reais e vale a pena checar diretamente antes de construir algo em cima de uma vazão presumida.

A página oficial de preços da Gemini Developer API do Google, mostrando a lista de benefícios do plano gratuito e um banner anunciando que o Gemini 3.8 Flash já está disponível.
ai.google.dev/gemini-api/docs/pricing, setembro de 2026.

O precipício de preços de janeiro de 2027 que quase ninguém está sinalizando

Esse é o fato mais útil para quem está orçando um projeto movido a Gemini que vai passar do ano novo, e é o que todo rastreador de terceiros que verificamos errou ou deixou de fora completamente. O Gemini 3.6, 3.7 e 3.8 Flash, os três modelos em que a maioria dos desenvolvedores está realmente construindo agora, têm todos um preço introdutório de US$ 0,75 de entrada / US$ 3,75 de saída por milhão de tokens até 31 de dezembro de 2026. Em 1º de janeiro de 2027, essa taxa dobra para US$ 1,50/US$ 7,50 nos três. Não é um aumento de preço que o Google esteja planejando em silêncio; já está publicado na página de preços atual, bem ao lado da taxa atual, e é fácil passar batido porque a página apresenta isso como uma nota de rodapé, não como uma manchete. Se o modelo de custo do seu projeto presume que o preço atual do Flash vai se manter indefinidamente, não vai, e a duplicação não é pequena: uma carga de trabalho que custa US$ 750 por mês em tokens de saída do Flash hoje passa a custar US$ 1.500 por mês a partir de janeiro.

A lacuna do plano gratuito: o Pro mais novo não tem nenhum

A disponibilidade do plano gratuito não acompanha de forma clara o quão novo ou capaz um modelo é, e o Gemini 3.1 Pro Preview é o exemplo mais claro disso. É o atual modelo de raciocínio principal, e ele não tem nenhum plano gratuito, nem mesmo uma pequena cota com limite de taxa. Todo modelo de nível Flash, do preview legado mais antigo ao mais novo 3.8 Flash, mantém alguma forma de acesso gratuito. O Gemini 2.5 Pro, o modelo Pro da geração anterior, também mantém. Então, se você quer prototipar de graça contra a qualidade de raciocínio de um modelo de classe Pro antes de comprometer orçamento, o caminho prático hoje é o 2.5 Pro mais antigo, não o 3.1 Pro Preview mais novo e com benchmarks melhores, puramente por causa de como o Google restringiu o plano gratuito.

Cobrança do plano gratuito e como os planos pagos se desbloqueiam

O acesso à API do Gemini começa num plano gratuito, com limite de taxa, disponível para qualquer projeto ativo, sem exigir conta de cobrança. A migração para acesso pago acontece em níveis graduais, cada um desbloqueando um teto de cobrança mensal mais alto, verificado na própria documentação de cobrança do Google:

Tier    Qualification                              Billing cap
----------------------------------------------------------------
Free    Active project or free trial                  N/A
Tier 1  Link an active billing account                 $250
Tier 2  Paid $100+, 3 days after first payment          $2,000
Tier 3  Paid $1,000+, 30 days after first payment       $20,000-100,000+
A página oficial de documentação de cobrança da API do Gemini do Google, mostrando a tabela de níveis de uso (Free, Tier 1 em US$ 250, Tier 2 em US$ 2.000) e um sumário listando tetos de gastos e planos de cobrança Prepay/Postpay.
ai.google.dev/gemini-api/docs/billing, setembro de 2026.

Existem dois planos de cobrança dentro dos níveis pagos: o Postpay, o modelo tradicional de pagar depois de usar, e o Prepay, adicionado em 2026, que permite carregar fundos com antecedência e limita os gastos ao que você carregou, uma opção materialmente mais segura para quem já levou um susto com uma conta inesperada (veja abaixo). O Google também adicionou tetos rígidos de gastos em nível de projeto em 2026, que realmente pausam o acesso à API de um projeto quando um orçamento se esgota, diferente das notificações mais antigas de alerta de orçamento, que só enviam um e-mail depois do fato.

As ferramentas de grounding custam a mais, e a cota gratuita é menor do que parece

Se o seu caso de uso precisa que o modelo embase respostas em resultados ao vivo do Google Search ou dados do Google Maps, isso é cobrado separadamente do uso de tokens. O grounding do Google Search dá aos modelos Gemini 3.x uma cota compartilhada de 5.000 requisições gratuitas por mês entre todos os modelos 3.x combinados, não por modelo, e depois US$ 14 a cada 1.000 requisições. Os modelos Gemini 2.5 recebem uma cota diária menor em vez de mensal: 1.500 requisições por dia compartilhadas entre o 2.5 Flash e o Flash-Lite, mais 1.500 RPD separados para o 2.5 Pro, e depois US$ 35 a cada 1.000 prompts embasados, cerca de 2,5x a taxa dos modelos 3.x. O grounding do Google Maps é mais barato por requisição (US$ 25/1.000), com uma cota gratuita de 500 requisições/dia nos modelos de nível Flash ou 10.000/dia no Pro. Se o seu app depende de grounding para toda resposta, esse costuma ser o item de linha que domina a conta, não o preço base dos tokens.

Geração de imagens e embeddings

Os modelos de imagem e embeddings do Google têm preços com a mesma taxa de tokens de entrada que seus equivalentes de geração de texto, mais uma cobrança separada por imagem de saída ou por token de saída:

Model                              Input        Image/embedding output
--------------------------------------------------------------------------
Gemini 3 Pro Image (Nano Banana    Same as 3.1  $120/1M tok out =
  Pro)                              Pro Preview   $0.134/image (1K-2K),
                                                   $0.24/image (4K).
                                                   No free tier.
Gemini 3.1 Flash Image (Nano       $0.50 (text) $60/1M tok out =
  Banana 2)                        out $3.00     $0.045-$0.151/image
Gemini 2.5 Flash Image (Nano       $0.30        $0.039/image (1024x1024)
  Banana)
Gemini Embedding 2 (multimodal)    text $0.20/1M, image $0.45/1M
                                    ($0.00012/img), audio $6.50/1M
                                    ($0.00016/sec), video $12.00/1M
                                    ($0.00079/frame). Free tier: yes.
Gemini Embedding (text-only)       $0.15/1M. Free tier: yes.

O que realmente quebra: alertas não são tetos, e chaves vazadas saem caro

O padrão em praticamente toda história real de terror de cobrança da API do Gemini é a mesma lacuna: um alerta de orçamento notifica por e-mail, mas não interrompe a contagem. Os próprios fóruns da comunidade e discussões de desenvolvedores do Google documentam isso repetidamente. Um tópico do Google AI Developer Forum descreve um usuário cobrado em cerca de US$ 780 por 1.540 gerações de vídeo do Veo que, segundo ele, deveriam ter produzido cerca de 20 clipes, chamando o volume de "fisicamente impossível" na janela de tempo; o suporte do Google não resolveu totalmente a disputa no tópico. Uma discussão no GitHub no repositório gemini-cli descreve um desenvolvedor que adicionou uma chave de API à CLI esperando um uso dentro do plano gratuito: uma conta de US$ 66 acumulada em três dias, consumindo 97 milhões de tokens numa única tarde, e depois, numa sessão seguinte, mais US$ 72 em cerca de quatro horas, um volume de tokens muito maior nos dois casos do que o usuário acreditava que seu uso real justificaria. Separadamente, pesquisadores de segurança da Truffle Security relataram ter encontrado 2.863 chaves de API do Google ativas expostas publicamente na web que podiam se autenticar na API do Gemini, porque qualquer chave vinculada a um projeto com a API do Gemini habilitada se torna uma credencial válida do Gemini, um detalhe de design legado, não um bug específico do Gemini, mas que já gerou contas reais de dezenas de milhares de dólares por roubo, relatadas por veículos como o The Register e o Tom's Hardware.

A solução em todo caso documentado é a mesma: não conte com e-mails de alerta como sua rede de segurança. Configure um teto de gastos real em nível de projeto (adicionado em 2026, e a única configuração que realmente interrompe a cobrança em vez de apenas notificar você sobre ela), gire qualquer chave de API que já tenha passado por um repositório público ou código do lado do cliente, e considere a cobrança Prepay se você quiser um teto rígido por design, em vez de uma configuração que você precisa lembrar de ativar.

Por que a calculadora de preços que você achou na busca pode estar errada hoje

Verificamos várias páginas de preços de terceiros sobre o Gemini que rankeiam bem para esse tema, comparando com a própria fonte primária do Google, e encontramos erros reais e específicos que vale a pena conhecer se você for cruzar com outros guias: o preço "atual" de um rastreador para o Gemini 3.6 Flash na verdade é a taxa pós-aumento de janeiro de 2027, não a taxa introdutória de hoje. Outro artigo, correto em termos de preço para o modelo que descreve, se refere a ele por um nome, "Gemini 3 Pro Preview", que o Google já aposentou em favor de "Gemini 3.1 Pro Preview", e afirma separadamente que esse modelo não tem desconto de batch ou cache, o que não é mais verdade. Outros dois guias que verificamos simplesmente não mencionam de forma alguma a geração 3.6, 3.7 ou 3.8 Flash, o que significa que um leitor que confiasse neles nem saberia que a atual linha de Flash de nível intermediário existe. Nada disso é malicioso, páginas de preços só ficam desatualizadas rápido demais num mercado que lança um novo modelo Flash a cada três semanas, mas é um bom motivo para checar a data antes de confiar em qualquer guia de preços, incluindo este; se você está lendo isso bem depois de setembro de 2026, reverifique na própria página do Google antes de comprometer orçamento.

Perguntas frequentes

A API do Gemini é gratuita?

A maioria dos modelos do Gemini tem um plano gratuito, com limite de taxa, disponível para qualquer projeto ativo sem exigir conta de cobrança, incluindo a atual linha Flash (3.6, 3.7, 3.8 Flash) e o Gemini 2.5 Pro. A exceção notável é o Gemini 3.1 Pro Preview, o atual modelo de raciocínio principal, que não tem nenhum plano gratuito.

Quanto custa o Gemini 3.8 Flash?

US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, uma taxa introdutória igual à do 3.6 e do 3.7 Flash, em vigor até 31 de dezembro de 2026. A partir de 1º de janeiro de 2027, o preço dobra para US$ 1,50/US$ 7,50.

Por que minha conta da API do Gemini veio muito mais alta do que eu esperava?

A causa mais comumente relatada é confundir um alerta de orçamento com um teto de gastos: os alertas só notificam depois que o uso acontece, eles não interrompem a cobrança. Configure um teto de gastos explícito em nível de projeto ou mude para a cobrança Prepay (ambos adicionados pelo Google em 2026) se você quiser um teto rígido. Chaves de API vazadas ou públicas são a outra grande causa de contas surpresa altas.

O preço da API do Gemini inclui o grounding do Google Search?

Não, o grounding é cobrado separadamente do uso de tokens. Os modelos Gemini 3.x recebem 5.000 requisições gratuitas de grounding do Search por mês, compartilhadas entre todos os modelos 3.x, e depois US$ 14 a cada 1.000 requisições. Os modelos 2.5 mais antigos recebem uma cota diária gratuita menor e pagam US$ 35 a cada 1.000 requisições embasadas.

O preço da API do Gemini é mais barato que o do GPT ou da Claude?

Depende muito de qual modelo e nível específicos você compara, e os preços dos três provedores mudam a cada poucas semanas, então qualquer tabela comparativa única fica desatualizada rápido. Compare os IDs de modelo e níveis exatos que você pretende usar diretamente na página de preços atual de cada provedor, em vez de confiar numa comparação estática.

notebooklm-to-pdf.comTodos os guias

Exporte seu NotebookLM em um clique

Extensão gratuita do Chrome. PDF, Word e Markdown. Renderizado na sua máquina — nada é enviado para a nuvem.

Continue lendo