DeepSeek ha sido el suelo de precios de la industria de la IA desde que su modelo R1 llegó en enero de 2025. Sus tarifas son lo bastante bajas como para que los desarrolladores le envíen por defecto trabajos de gran volumen, y los modelos chinos ahora concentran la mayoría del tráfico en OpenRouter, el mercado donde los desarrolladores comparan modelos entre distintos proveedores. El miércoles, la empresa de Hangzhou cambió esa ganga. Anunció el lanzamiento general de DeepSeek-V4-Pro, su buque insignia, y en la misma publicación presentó una nueva lista de precios de la API.
Las nuevas tarifas entran en vigor a las 16:00 UTC del 16 de agosto. Los aumentos van del 50% al 1,100% sobre los precios actuales según el modelo, el tipo de token y la hora del día, un rango que Reuters calculó a partir del comunicado de la empresa. La salida en V4-Pro, es decir, el texto que escribe el modelo, pasa de $0.87 por millón de tokens a $1.98 durante la mayor parte del día y $3.96 durante una ventana pico de siete horas.
Nada de esto era un secreto en términos generales. DeepSeek dijo a los desarrolladores el 6 de agosto que se avecinaba un aumento amplio y que planificaran en consecuencia, sin decir cuánto ni cuándo. La respuesta llegó una semana después, adjunta al lanzamiento de un producto.
La empresa presenta el cambio como un descuento. "Las tarifas fuera de horas pico son 50% más bajas que las de horas pico", DeepSeek escribió en su anuncio de lanzamiento, calificándolo como una forma de programar cargas de trabajo con más flexibilidad. El punto de referencia ahí es la nueva tarifa pico, no la anterior tarifa plana. Hasta ahora, un millón de tokens de salida en V4-Pro costaba lo mismo a cualquier hora de cualquier día. A partir del domingo costarán aproximadamente entre 2.3 y 4.6 veces más que hoy, y cuál de esos extremos pagues dependerá de cuándo se ejecute tu trabajo.
Los precios en horas pico y fuera de horas pico llegan el 16 de agosto
Las horas pico son de 01:00 a 04:00 y de 06:00 a 10:00 UTC, según la página de precios de la API de DeepSeek. Todo lo demás queda fuera de horas pico. El modelo más barato V4-Flash también cambia: la entrada pasa de $0.14 a $0.22 fuera de horas pico y $0.44 en horas pico; la salida, de $0.28 a $0.66 y $1.32.
La subida más pronunciada recae sobre la entrada en caché, la tarifa con descuento que se cobra cuando una solicitud repite texto que el sistema ya ha procesado. En V4-Pro eso pasa de $0.003625 por millón de tokens a $0.022 fuera de horas pico y $0.044 en horas pico, un salto de más del 1,100% en el extremo superior. El software de agentes, que reenvía las mismas instrucciones en cada ciclo, es precisamente la carga de trabajo que más depende del caché.
Qué puntúa V4-Pro-0813 en las propias pruebas de DeepSeek
El modelo detrás del endpoint es DeepSeek-V4-Pro-0813, poniendo fin a una vista previa que comenzó el 24 de abril. Utiliza un diseño de mezcla de expertos con 1.6 billones de parámetros totales y 49 mil millones activos para cualquier token dado, lee hasta 1 millón de tokens de contexto y escribe hasta 384,000. Está disponible en la app bajo "Modo Experto", es compatible con la Responses API de OpenAI con configuración de Codex en un clic, y ofrece ajustes de esfuerzo de razonamiento de bajo a máximo. Su versión más barata ya había superado en puntuación a la vista previa del buque insignia en pruebas de agentes en julio.
La tabla publicada por DeepSeek sitúa a V4-Pro-0813 en 87.9 en Terminal Bench 2.1, que mide qué tan bien un modelo maneja una línea de comandos, por detrás de Kimi-K3 con 88.3 y Claude Fable 5 con 88.0. Lidera dos de las diez filas: 83.3 en Cybergym, un benchmark de seguridad, y 31.8 en el AutomationBench público. En Humanity's Last Exam obtiene 42.7 sin herramientas frente a los 53.3 de Fable 5. Una nota al pie dice que las cifras de agentes de programación proceden de un arnés de pruebas interno aún no publicado y que pueden variar con otros marcos de trabajo. Ningún laboratorio externo ha verificado nada de esto.
La brecha de costos se estrecha, pero no se cierra
Incluso después del domingo, DeepSeek sigue muy por debajo de aquello con lo que se compara. Claude Fable 5 cotiza a $10 y $50 por millón de tokens de entrada y salida. xAI lanzó Grok 4.6 el mismo día que V4-Pro a $2 y $6, entre las opciones frontier occidentales más baratas. V4-Pro, a tarifas pico completas, cuesta $1.32 y $3.96.
Lo que DeepSeek está poniendo a prueba es si los desarrolladores que la convirtieron en la familia de modelos más usada del mercado abierto estaban comprando capacidad o comprando precios bajos. Si se quedan, todos los demás laboratorios tendrán margen para dejar de hacer descuentos. El suelo de precios acaba de moverse, y todos los que están por encima lo notarán.
