O DeepSeek V4 Pro foi lançado, depois os preços da sua API subiram até 1.100%, e esse número não é sobre os tokens que você imaginaria
A DeepSeek lançou um modelo genuinamente mais forte em 13 de agosto de 2026, e três dias depois destruiu sua própria reputação de IA barata. A manchete de "aumento de preço de 1.100%" que todo mundo está repetindo é real, mas não é sobre os tokens de saída que a maioria das pessoas presume. Eis o que realmente mudou, quanto custa agora, e se o DeepSeek ainda vale a pena usar.
O DeepSeek-V4-Pro-0813 saiu da prévia e atingiu disponibilidade geral em 13 de agosto de 2026, sob licença MIT, com uma pontuação de 53 no Artificial Analysis Intelligence Index, aproximadamente no mesmo nível do GLM-5.2 da Zhipu e alguns pontos atrás do GPT-5.6 Terra e do Kimi K3.
A partir de 16 de agosto de 2026, às 16h00 UTC, a DeepSeek substituiu o preço fixo da API por tarifas de pico e fora de pico. Os tokens de saída subiram 355-371%. O número muito mais assustador de "até 1.100%" que todo mundo está citando se refere especificamente a tokens de entrada em cache, que passaram de um custo incomumente baixo de $0,0036/milhão para até $0,044/milhão no horário de pico.
O aplicativo de chat gratuito da DeepSeek na web e no celular não é afetado. Essa mudança de preço é exclusiva da API, direcionada a desenvolvedores e a quem constrói produtos em cima do modelo.
Mesmo depois do aumento, o DeepSeek ainda é mais barato que os principais modelos ocidentais, só que não mais pela margem de 10 a 30 vezes que costumava ter. O preço de saída em horário de pico do V4-Pro ($3,96/milhão) é cerca de um quarto do preço do Claude Opus 5 ($25/milhão) e aproximadamente um oitavo do preço do GPT-5.6 Sol ($30/milhão).
O que realmente foi lançado em 13 de agosto
O DeepSeek-V4-Pro-0813 saiu de uma prévia de abril de 2026 para atingir disponibilidade geral em 13 de agosto, disponível pelo site da DeepSeek, pelo aplicativo móvel e pela API, com os pesos publicados sob a licença MIT no Hugging Face. A própria tabela de benchmarks da DeepSeek mostra saltos grandes em relação à versão de prévia: o Terminal-Bench subindo de 72,1 para um valor alegado de 87,9, e o SWE-bench Verified alcançando um valor alegado de 96,40%. Esses são números da própria DeepSeek, não reproduzidos de forma independente, e essa distinção importa mais que o normal aqui.
Avaliadores independentes não têm sido gentis com os números autorreportados. O Artificial Analysis coloca o Intelligence Index do V4-Pro em 53, no mesmo nível do GLM-5.2 da Zhipu, quatro pontos atrás do GPT-5.6 Terra e sete atrás do Kimi K3, uma pontuação que não lidera a fronteira. O South China Morning Post relatou uma nova execução independente do Terminal-Bench chegando a cerca de 54,68%, bem abaixo dos 87,9% alegados pela DeepSeek, e citou o Vals AI classificando o modelo em 12º lugar em seu próprio ranking, atrás do GPT-5.5 da geração anterior. Nada disso faz do V4-Pro um modelo ruim. Isso torna a tabela de marketing da DeepSeek tão pouco confiável quanto costuma ser a tabela de benchmark autorreportada de qualquer fornecedor, e vale tratá-la com o mesmo ceticismo que você aplicaria a qualquer empresa corrigindo sua própria prova.
A mudança de preços, em detalhe
Três dias depois do lançamento do V4-Pro, às 16h00 UTC de 16 de agosto de 2026, o próprio changelog da DeepSeek confirmou a mudança de um preço fixo por token para uma estrutura de pico e fora de pico. O horário de pico é das 01h00 às 04h00 e das 06h00 às 10h00 UTC, o que corresponde das 9h ao meio-dia e das 14h às 18h no horário de Pequim, sete horas por dia; as outras 17 horas são fora de pico, com preço exatamente na metade da tarifa de pico. O motivo declarado pela DeepSeek, em suas próprias palavras, é "alocar recursos de forma mais racional" e incentivar desenvolvedores a deslocar o trabalho para os horários mais tranquilos. A empresa já havia sinalizado um "aumento significativo" vindouro em sua página de preços por volta de 6 de agosto, então isso não foi uma surpresa total para quem estava acompanhando de perto.
Model / token type Old (flat) New off-peak New peak Peak increase
------------------------------------------------------------------------------------
V4-Pro input, cache miss $0.435/M $0.66/M $1.32/M ~203%
V4-Pro input, cache HIT $0.0036/M $0.022/M $0.044/M ~1,114%
V4-Pro output $0.87/M $1.98/M $3.96/M ~355%
V4-Flash input, cache miss $0.14/M $0.22/M $0.44/M ~214%
V4-Flash output $0.28/M $0.66/M $1.32/M ~371%Essa tabela conta a história inteira, e é por isso que manchetes dizendo "preços quadruplicaram" e manchetes dizendo "preços subiram 1.100%" são ambas tecnicamente corretas sobre números diferentes. O aumento nos tokens de saída, aquele que determina a fatura mensal da maioria das pessoas, é um salto de 355-371%, um multiplicador de aproximadamente 4x a 4,7x. O número chamativo de mais de 1.100% pertence especificamente aos tokens de entrada em cache, um custo mais estreito e especializado: é o que você paga quando uma solicitação reaproveita um contexto que os servidores da DeepSeek já processaram, algo comum em sessões longas de agentes com muita troca de mensagens e em fluxos de trabalho de contexto repetido. Esse tipo de token costumava ter um preço incomumente baixo de $0,0036 por milhão, então até um salto grande em dólares produz uma variação percentual enorme. Se o seu fluxo de trabalho não depende muito de cache de prompt, você vai sentir algo mais perto do número de 4x, não do de 12x.

Quem realmente sentiu isso, e o que disseram
A explicação mais clara da mudança circulando entre desenvolvedores veio de uma thread no Hacker News discutindo o próprio anúncio da DeepSeek. Um comentário muito votado colocou isso de forma direta: "o aumento percentual de quatro dígitos vem da entrada em cache, que tinha um preço incomumente baixo de $0,003625 por milhão de tokens... Mesmo depois do aumento, a DeepSeek continua barata em relação aos principais modelos de fronteira... em tarifas de pico, o DeepSeek V4-Pro ainda custa cerca de dois terços do Sonnet na entrada e aproximadamente 40% na saída." Outro desenvolvedor admitiu que, mesmo antes do aumento, o atrito de manter uma configuração baseada em DeepSeek não valia claramente a pena quando uma assinatura do Claude já estava paga: "Eu tenho tentado manter uma configuração DeepSeek + OpenCode a semana inteira, mas parece que meu Claude Max subsidiado ainda é bastante relevante."
Um terceiro ponto dessa thread é fácil de passar despercebido e genuinamente útil se você está decidindo se troca de provedor por causa disso: o preço bruto por token diz menos do que parece, porque ignora o quão agressivamente o cache de um provedor realmente funciona e quantos tokens um determinado modelo consome para terminar a mesma tarefa. Um preço de etiqueta mais barato num modelo que precisa do dobro de tokens para resolver um problema não é, de fato, mais barato. Alguns desenvolvedores na mesma thread relataram faturas mensais subindo de cerca de $5 para $15 sob a nova estrutura, e observaram que os horários de pico da DeepSeek coincidem com o horário comercial central da China, o que prejudica estruturalmente desenvolvedores dos EUA e da UE, que não conseguem facilmente deslocar cargas de trabalho pesadas para a janela fora de pico da DeepSeek sem eles próprios trabalharem em horários incomuns.
Como o DeepSeek se compara agora
O enquadramento honesto: a DeepSeek não deixou de ser barata, deixou de ser absurdamente barata. Em preço de pico, a tarifa de saída do V4-Pro de $3,96 por milhão de tokens ainda é uma fração do que os principais modelos ocidentais cobram.
Model Input $/M Output $/M
--------------------------------------------------------------
DeepSeek V4-Pro (off-peak) $0.66 $1.98
DeepSeek V4-Pro (peak) $1.32 $3.96
DeepSeek V4-Flash (peak) $0.44 $1.32
Claude Sonnet 5 $2.00 $10.00
Claude Opus 5 $5.00 $25.00
Claude Fable 5 $10.00 $50.00
GPT-5.6 Luna ~$0.20 ~$1.20
GPT-5.6 Terra $2.00 $12.00
GPT-5.6 Sol $5.00 $30.00
Gemini 3.7 Flash (intro, through 2026) $0.75 $3.75O V4-Pro em horário de pico ainda fica abaixo do Claude Sonnet 5 no preço de saída, e chega a cerca de um quarto da tarifa do Opus 5 e um oitavo da do GPT-5.6 Sol. A diferença que importava para desenvolvedores sensíveis a preço há um mês, a DeepSeek sendo de 10 a 30 vezes mais barata que um modelo ocidental de ponta, encolheu para algo mais próximo de 4 a 8 vezes. Isso ainda é uma vantagem real. Só que não é mais o tipo de vantagem que torna o preço, por si só, o argumento inteiro, especialmente contra o GPT-5.6 Luna, que a OpenAI cortou em 80% no preço em 30 de julho e que agora fica abaixo até do DeepSeek V4-Flash fora de pico na saída.
O que isso significa se você está de fato construindo algo
- Usuários do chat gratuito na web/app: nada muda. Essa mudança de preço é exclusiva da API. Se você só usa o deepseek.com ou o aplicativo móvel para conversar, seu acesso não é afetado.
- Cargas de trabalho em lote ou não interativas: desloque o que puder para as 17 horas fora de pico (01h00-04h00 e 06h00-10h00 UTC) para manter aproximadamente o antigo multiplicador de 2x em vez das novas tarifas de pico.
- Fluxos de trabalho de agentes com uso intenso de cache (sessões longas que reaproveitam o contexto repetidamente) são os mais atingidos em termos relativos, porque é exatamente esse tipo de token que saltou cerca de 12x no pico. Planeje o orçamento de acordo, ou reconsidere se a carga de trabalho realmente precisa rodar em horário de pico.
- Antes de trocar de provedor só por causa disso, calcule o custo de uma carga de trabalho real de ponta a ponta, não apenas a tarifa por token. Um modelo que precisa de mais tokens ou mais tentativas para terminar o mesmo trabalho pode anular rapidamente um preço de etiqueta mais barato, um ponto que a thread do Hacker News citada acima deixa bem direto.
Para os leitores deste site cujo trabalho real é ler e resumir documentos em vez de construir pipelines de agentes, essa notícia é mais interessante do que diretamente relevante. O Gemini Notebook não tem preço por token de API; é uma assinatura fixa (gratuita, ou de $4,99 a $199,99/mês dependendo do plano) com limites de fontes e consultas em vez de uma fatura medida, o que é um modelo de custo genuinamente diferente de tudo na tabela acima. Se você está avaliando ferramentas de IA de forma geral, em vez de procurar especificamente pela API mais barata, nossa comparação de alternativas ao Gemini Notebook mostra onde a DeepSeek e as demais realmente se encaixam.
O DeepSeek ainda é mais barato que o ChatGPT, o Claude e o Gemini?
Sim, mas por uma margem menor que antes. Nas tarifas de pico da API, o preço de saída do DeepSeek V4-Pro ($3,96/milhão de tokens) ainda é cerca de um quarto do preço do Claude Opus 5 e um oitavo do GPT-5.6 Sol, abaixo da diferença de 10 a 30 vezes que a DeepSeek costumava ter. Fora de pico, a diferença volta a se aproximar das antigas margens.
O aumento de preço afeta o aplicativo de chat gratuito da DeepSeek?
Não. A mudança de preços de 16 de agosto de 2026 se aplica apenas à API, a interface que os desenvolvedores usam para construir produtos em cima do modelo. O site gratuito e o aplicativo móvel de chat da DeepSeek não são afetados.
Por que o preço subiu 1.100% em alguns números, mas não em outros?
O número de mais de 1.100% se aplica especificamente aos tokens de entrada em cache, que tinham um preço incomumente baixo antes da mudança ($0,0036/milhão) e subiram para até $0,044/milhão no pico, um aumento de aproximadamente 12 vezes em termos de dólares, mesmo que o custo absoluto ainda seja pequeno. Os tokens de saída, que determinam a fatura real da maioria das pessoas, subiram um percentual separado e menor, de 355-371%.
O DeepSeek V4 Pro é de fato um modelo melhor que a versão anterior?
Os próprios benchmarks publicados pela DeepSeek mostram ganhos grandes, mas testes independentes não os confirmaram. O South China Morning Post relatou uma nova execução independente do Terminal-Bench com pontuação de cerca de 54,68% contra os 87,9% alegados pela DeepSeek, e o ranking do Vals AI supostamente coloca o modelo em 12º lugar, atrás do GPT-5.5 da geração anterior. Trate os próprios números da DeepSeek como um ponto de partida, não como um fato definitivo.
Exporte seu NotebookLM em um clique
Extensão gratuita do Chrome. PDF, Word e Markdown. Renderizado na sua máquina — nada é enviado para a nuvem.