DeepSeek est le plancher tarifaire de l’industrie de l’IA depuis l’arrivée de son modèle R1 en janvier 2025. Ses tarifs sont suffisamment bas pour que les développeurs lui confient par défaut les charges de travail à fort volume, et les modèles chinois représentent désormais la majorité du trafic sur OpenRouter, la place de marché où les développeurs choisissent des modèles auprès de plusieurs fournisseurs. Mercredi, l’entreprise de Hangzhou a changé cette donne. Elle a annoncé la disponibilité générale de DeepSeek-V4-Pro, son modèle phare, et a publié dans le même billet une nouvelle grille tarifaire pour l’API.

Les nouveaux tarifs entrent en vigueur à 16:00 UTC le 16 août. Les hausses vont de 50 % à 1 100 % par rapport aux prix actuels selon le modèle, le type de token et l’heure de la journée, une fourchette calculée par Reuters à partir du communiqué de l’entreprise. La sortie sur V4-Pro, c’est-à-dire le texte que le modèle rédige, passe de 0,87 $ par million de tokens à 1,98 $ pendant la majeure partie de la journée et à 3,96 $ durant une fenêtre de pointe de sept heures.

Rien de tout cela n’était secret dans ses grandes lignes. DeepSeek avait informé les développeurs le 6 août qu’une hausse généralisée arrivait et qu’ils devaient s’y préparer, sans préciser ni l’ampleur ni la date. La réponse est arrivée une semaine plus tard, jointe à un lancement de produit.

L’entreprise présente ce changement comme une remise. « Les tarifs hors pointe sont 50 % inférieurs aux tarifs de pointe », DeepSeek a écrit dans son annonce de lancement, en le présentant comme un moyen de planifier les charges de travail avec plus de flexibilité. Le point de référence ici est le nouveau tarif de pointe, et non l’ancien tarif fixe. Jusqu’à présent, un million de tokens de sortie sur V4-Pro coûtait le même prix à n’importe quelle heure et n’importe quel jour. À partir de dimanche, ils coûteront environ 2,3 à 4,6 fois plus qu’aujourd’hui, et le montant payé dépendra du moment où votre tâche s’exécute.

La tarification en heures de pointe et hors pointe arrive le 16 août

Les heures de pointe vont de 01:00 à 04:00 et de 06:00 à 10:00 UTC, selon la page de tarification API de DeepSeek. Tout le reste est hors pointe. Le modèle moins cher V4-Flash évolue aussi : l’entrée passe de 0,14 $ à 0,22 $ en heures creuses et 0,44 $ en pointe, la sortie de 0,28 $ à 0,66 $ et 1,32 $.

La hausse la plus forte touche l’entrée en cache, le tarif réduit appliqué lorsqu’une requête répète un texte que le système a déjà traité. Sur V4-Pro, elle passe de 0,003625 $ par million de tokens à 0,022 $ hors pointe et 0,044 $ en pointe, soit une hausse de plus de 1 100 % au maximum. Les logiciels agents, qui renvoient les mêmes instructions à chaque boucle, sont précisément le type de charge de travail qui s’appuie le plus sur la mise en cache.

Les scores de V4-Pro-0813 dans les propres tests de DeepSeek

Le modèle derrière l’endpoint est DeepSeek-V4-Pro-0813, mettant fin à une phase de préversion commencée le 24 avril. Il utilise une architecture à mélange d’experts avec 1,6 trillion de paramètres au total et 49 milliards actifs pour chaque token donné, lit jusqu’à 1 million de tokens de contexte et écrit jusqu’à 384 000. Il est disponible dans l’application sous « mode Expert », prend en charge l’API Responses d’OpenAI avec configuration de Codex en un clic, et propose des réglages d’effort de raisonnement allant de faible à maximal. Son équivalent moins cher avait déjà surpassé le modèle phare en préversion dans des tests d’agents en juillet.

Le tableau publié par DeepSeek place V4-Pro-0813 à 87,9 sur Terminal Bench 2.1, qui mesure la capacité d’un modèle à piloter une ligne de commande, derrière Kimi-K3 à 88,3 et Claude Fable 5 à 88,0. Il arrive en tête sur deux des dix lignes : 83,3 sur Cybergym, un benchmark de sécurité, et 31,8 sur l’AutomationBench public. Sur Humanity's Last Exam, il obtient 42,7 sans outils contre 53,3 pour Fable 5. Une note de bas de page indique que les chiffres des agents de codage proviennent d’un banc d’essai interne non publié et peuvent varier avec d’autres frameworks. Aucun laboratoire externe n’a vérifié tout cela.

L’écart de coût se resserre mais ne disparaît pas

Même après dimanche, DeepSeek reste très en dessous de ce à quoi il se compare. Claude Fable 5 est affiché à 10 $ et 50 $ par million de tokens d’entrée et de sortie. xAI a lancé Grok 4.6 le même jour que V4-Pro à 2 $ et 6 $, parmi les options occidentales de pointe les moins chères. V4-Pro, à ses tarifs de pointe complets, est à 1,32 $ et 3,96 $.

Ce que DeepSeek teste, c’est de savoir si les développeurs qui en ont fait la famille de modèles la plus utilisée sur le marché ouvert achetaient des capacités ou achetaient des bas prix. S’ils restent, tous les autres laboratoires auront plus de marge pour arrêter les remises. Le plancher vient de bouger, et tous ceux qui sont au-dessus le remarqueront.