A DeepSeek tem sido o piso de preços da indústria de IA desde que seu modelo R1 chegou em janeiro de 2025. Suas tarifas são baixas o suficiente para que desenvolvedores direcionem, por padrão, trabalhos de alto volume para ela, e os modelos chineses agora respondem por a maioria do tráfego no OpenRouter, o marketplace onde desenvolvedores buscam modelos entre diferentes fornecedores. Na quarta-feira, a empresa de Hangzhou mudou esse panorama. Anunciou o lançamento geral do DeepSeek-V4-Pro, seu carro-chefe, e na mesma publicação divulgou uma nova tabela de preços da API.
As novas tarifas entram em vigor às 16:00 UTC em 16 de agosto. Os aumentos variam de 50% a 1.100% acima dos preços atuais, dependendo do modelo, do tipo de token e da hora do dia, uma faixa que a Reuters calculou a partir do comunicado da empresa. A saída no V4-Pro, ou seja, o texto que o modelo escreve, passa de US$0,87 por milhão de tokens para US$1,98 na maior parte do dia e US$3,96 durante uma janela de pico de sete horas.
Nada disso era segredo em linhas gerais. A DeepSeek disse aos desenvolvedores em 6 de agosto que um aumento amplo estava a caminho e que se planejassem adequadamente, sem dizer quanto nem quando. A resposta chegou uma semana depois, atrelada a um lançamento de produto.
A empresa apresenta a mudança como um desconto. "As tarifas fora de pico são 50% menores do que as de pico", a DeepSeek escreveu em seu anúncio de lançamento, chamando isso de uma forma de agendar cargas de trabalho com mais flexibilidade. O ponto de referência aí é a nova tarifa de pico, não a antiga tarifa fixa. Até agora, um milhão de tokens de saída no V4-Pro custava o mesmo em qualquer hora de qualquer dia. A partir de domingo, eles custarão cerca de 2,3 a 4,6 vezes mais do que custam hoje, e quanto você pagará dependerá de quando sua tarefa for executada.
Preços de pico e fora de pico chegam em 16 de agosto
Os horários de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC, segundo a página de preços da API da DeepSeek. Todo o restante é fora de pico. O modelo mais barato V4-Flash também muda: entrada de US$0,14 para US$0,22 fora de pico e US$0,44 no pico, saída de US$0,28 para US$0,66 e US$1,32.
O aumento mais acentuado recai sobre a entrada em cache, a tarifa com desconto cobrada quando uma solicitação repete texto que o sistema já processou. No V4-Pro, isso passa de US$0,003625 por milhão de tokens para US$0,022 fora de pico e US$0,044 no pico, um salto de mais de 1.100% no limite superior. Softwares de agente, que reenviam as mesmas instruções em cada ciclo, são precisamente o tipo de carga de trabalho que mais depende de cache.
Como o V4-Pro-0813 pontua nos próprios testes da DeepSeek
O modelo por trás do endpoint é o DeepSeek-V4-Pro-0813, encerrando uma prévia que começou em 24 de abril. Ele usa uma arquitetura de mistura de especialistas, com 1,6 trilhão de parâmetros no total e 49 bilhões ativos para cada token, lê até 1 milhão de tokens de contexto e escreve até 384.000. Ele está disponível no aplicativo em "Modo Expert", oferece suporte à API Responses da OpenAI com configuração do Codex em um clique e traz ajustes de esforço de raciocínio de baixo a máximo. Seu irmão mais barato já havia superado a prévia do carro-chefe em testes de agente em julho.
A tabela publicada pela DeepSeek coloca o V4-Pro-0813 em 87,9 no Terminal Bench 2.1, que mede o quão bem um modelo opera uma linha de comando, atrás do Kimi-K3, com 88,3, e do Claude Fable 5, com 88,0. Ele lidera duas das dez linhas: 83,3 no Cybergym, um benchmark de segurança, e 31,8 no AutomationBench público. No Humanity's Last Exam, marca 42,7 sem ferramentas contra 53,3 do Fable 5. Uma nota de rodapé diz que os números do agente de programação vieram de uma bateria interna de testes ainda não lançada e podem variar em outras estruturas. Nenhum laboratório externo verificou qualquer um desses resultados.
A diferença de custo diminui, mas não desaparece
Mesmo depois de domingo, a DeepSeek continua muito abaixo daquilo com que se compara nos benchmarks. O Claude Fable 5 tem preços listados de US$10 e US$50 por milhão de tokens de entrada e saída. A xAI lançou o Grok 4.6 no mesmo dia que o V4-Pro a US$2 e US$6, entre as opções ocidentais de fronteira mais baratas. O V4-Pro, nas tarifas cheias de pico, fica em US$1,32 e US$3,96.
O que a DeepSeek está testando é se os desenvolvedores que a transformaram na família de modelos mais usada no mercado aberto estavam comprando capacidade ou comprando baixo custo. Se eles ficarem, todos os outros laboratórios ganham espaço para parar de dar descontos. O piso acabou de subir, e todos acima dele vão perceber.
