La inferencia rápida podría convertirse en un mercado de $550 mil millones para 2030, según Mizuho Securities, lo que daría al fabricante de chips especializados Cerebras (CBRS) la oportunidad de hacerse con uno de los mayores segmentos de la computación de IA. El banco mantuvo su recomendación de desempeño superior y su precio objetivo de $300 en una nota del 4 de octubre revisada por The Latent.
Vijay Rakesh, director gerente de Mizuho, sitúa el mercado de la inferencia rápida en alrededor de $1 mil millones en 2025. Para 2030, espera que represente cerca del 20% de todas las cargas de trabajo de IA. Los chips de Cerebras permiten un procesamiento más rápido.
Sus estimaciones de ingresos para Cerebras son de unos $885 millones este año, $3 mil millones en 2027 y $13.5 mil millones en 2029. La mayor parte provendría de la "creciente cartera de acuerdos con clientes de la compañía, respaldada por alianzas clave con OpenAI y AWS, con posibles clientes adicionales que impulsarían el potencial alcista futuro hasta 2027/28E", señala la nota.
A $300, Cerebras cotizaría a unas 12 veces la estimación de Mizuho para las ventas de 2028. El objetivo está aproximadamente un 80% por encima del cierre del viernes, de $166.43. Rakesh también planteó un escenario alcista de $465 y uno bajista de $165, y escribió que Cerebras "debe ejecutar continuamente su hoja de ruta para mantener y ampliar su ventaja tecnológica [en chips especializados]."
Los compradores pagan más por la velocidad
Los tokens de IA entregados a alta velocidad alcanzan precios entre seis y 10 veces superiores a los tokens estándar, escribió Rakesh, "lo que lo convierte en un segmento de mayores ingresos y márgenes."
Tomemos el modo rápido de Anthropic para Claude: funciona aproximadamente 2.5 veces más rápido y cuesta seis veces más. Rakesh también citó el plan Pro de OpenAI de $500 al mes, que incluye acceso al nivel Ultrafast presentado en el evento DevDay de la compañía la semana pasada.
Cerebras dijo en agosto que impulsa Ultrafast para el GPT-5.6 Sol de OpenAI. La compañía afirma que el modo rápido puede generar hasta 750 tokens por segundo, o hasta 14 veces la velocidad del modo estándar de OpenAI. El modelo más reciente ofrecido en ese nivel es GPT-6.1 Sol, actualmente el segundo mejor modelo de OpenAI en la prueba de referencia de The Latent.
Demanda inicial de firmas de trading y el Pentágono
Jane Street, Citadel, Jump y Hudson River Trading se encuentran entre los creadores de mercado y las firmas de trading de alta frecuencia que Mizuho espera que impulsen la demanda inicial. El banco también ve una mayor adopción de la inferencia rápida en la monitorización de ciberseguridad y en sistemas de defensa que requieren inferencia en tiempo real, y señala a las empresas de tecnología de defensa Anduril y Shield AI.
Ya hay un contrato asegurado: Cerebras y Ranovus obtuvieron $45 millones de DARPA para construir un banco de pruebas de IA para simulaciones de campos de batalla, con el objetivo de lograr una inferencia de menos de un segundo, según la nota.
Rakesh considera a Meta (META) un posible próximo cliente de inferencia. También afirma que Amazon Web Services, o AWS, planea ofrecer sus modelos Nova en Bedrock durante el primer trimestre de 2027 utilizando sus chips Trainium junto con sistemas CS-3 de Cerebras.
Más ingresos dependen de OpenAI
Se espera que OpenAI por sí sola represente más del 80% de los ingresos de Cerebras, según la estimación de Mizuho. Esto ocurre después de un año en el que G42 y la Mohamed bin Zayed University of Artificial Intelligence, con sede en Abu Dabi, aportaron aproximadamente el 86% de los ingresos. El banco espera que la participación de esos dos clientes caiga por debajo del 40% este año, frente al nivel de 2025.
Cerebras salió a bolsa en mayo a $185 por acción. La semana pasada, la acción cayó por debajo de su precio de oferta pública inicial después de que SemiAnalysis informara que el nuevo nivel GPT-6.1 Sol Ultrafast de OpenAI funciona con GPU de Nvidia. También hubo más acciones disponibles para la venta al expirar las restricciones de bloqueo posteriores a la oferta pública inicial.
El CEO de OpenAI, Sam Altman, escribió en X que "Cerebras es un socio cercano y tenemos una colaboración profunda para ampliar las fronteras de la velocidad."
Según Mizuho, Cerebras planea enviar CS-4 en el cuarto trimestre, duplicando la velocidad de tokens de la generación actual, y CS-5 en 2027. OpenAI también está desarrollando su propio hardware de inferencia. En agosto dijo que su primer chip de inferencia superó al GB300 de Nvidia en pruebas de laboratorio.
