L’inférence rapide pourrait représenter un marché de 550 milliards de dollars d’ici 2030, selon Mizuho Securities, offrant au fabricant de puces spécialisées Cerebras (CBRS) une chance de s’imposer sur l’un des plus grands segments de l’informatique dédiée à l’IA. La banque a maintenu sa recommandation de surperformance et son objectif de cours de 300 dollars dans une note datée du 4 octobre et consultée par The Latent.

Vijay Rakesh, directeur général chez Mizuho, évalue le marché de l’inférence rapide à environ 1 milliard de dollars en 2025. D’ici 2030, il s’attend à ce qu’elle représente environ 20 % de l’ensemble des charges de travail liées à l’IA. Les puces de Cerebras permettent d’accélérer le traitement.

Ses estimations de revenus pour Cerebras s’élèvent à environ 885 millions de dollars cette année, 3 milliards de dollars en 2027 et 13,5 milliards de dollars en 2029. La majeure partie de ces revenus proviendrait du « pipeline croissant de contrats avec des clients, soutenu par des partenariats clés avec OpenAI et AWS, de nouveaux clients potentiels pouvant encore stimuler la croissance à l’horizon 2027-2028 », indique la note.

À 300 dollars, Cerebras se négocierait environ 12 fois l’estimation de Mizuho pour son chiffre d’affaires de 2028. Cet objectif est supérieur d’environ 80 % au cours de clôture de vendredi, à 166,43 dollars. Rakesh a également présenté un scénario haussier à 465 dollars et un scénario baissier à 165 dollars, écrivant que Cerebras « doit constamment mettre en œuvre sa feuille de route pour préserver et élargir son avantage technologique [dans les puces spécialisées] ».

Les acheteurs paient davantage pour la vitesse

Les tokens d’IA fournis à grande vitesse se vendent environ six à 10 fois plus cher que les tokens standard, a écrit Rakesh, « ce qui en fait un segment générant davantage de revenus et de marges ».

Prenons le mode rapide d’Anthropic pour Claude : il fonctionne environ 2,5 fois plus vite et coûte six fois plus cher. Rakesh a également cité le forfait Pro d’OpenAI à 500 dollars par mois, qui comprend l’accès au niveau Ultrafast déployé lors de l’événement DevDay de l’entreprise la semaine dernière.

Cerebras a déclaré en août qu’elle alimentait Ultrafast pour le GPT-5.6 Sol d’OpenAI. L’entreprise affirme que le mode rapide peut générer jusqu’à 750 tokens par seconde, soit une vitesse jusqu’à 14 fois supérieure à celle du mode standard d’OpenAI. Le dernier modèle proposé à ce niveau est GPT-6.1 Sol, actuellement le deuxième meilleur modèle d’OpenAI dans le benchmark de The Latent.

Une demande précoce portée par les sociétés de trading et le Pentagone

Jane Street, Citadel, Jump et Hudson River Trading figurent parmi les teneurs de marché et sociétés de trading à haute fréquence dont Mizuho prévoit qu’elles stimuleront la demande initiale. La banque estime également que l’inférence rapide gagnera du terrain dans la surveillance de la cybersécurité et les systèmes de défense nécessitant une inférence en temps réel, en citant les entreprises de technologies de défense Anduril et Shield AI.

Un contrat est déjà en poche : Cerebras et Ranovus ont obtenu 45 millions de dollars de la DARPA pour construire un banc d’essai d’IA destiné à la simulation de champs de bataille, avec pour objectif une inférence en moins d’une seconde, selon la note.

Rakesh considère Meta (META) comme un possible prochain client dans le domaine de l’inférence. Il indique également qu’Amazon Web Services, ou AWS, prévoit de proposer ses modèles Nova dans Bedrock au premier trimestre 2027, en utilisant ses puces Trainium aux côtés des systèmes CS-3 de Cerebras.

Une plus grande part des revenus dépend d’OpenAI

Selon les estimations de Mizuho, OpenAI devrait à elle seule représenter plus de 80 % des revenus de Cerebras. Cette prévision intervient après une année durant laquelle G42 et la Mohamed bin Zayed University of Artificial Intelligence, basée à Abou Dhabi, ont généré environ 86 % des revenus. La banque s’attend à ce que la part de ces deux clients passe sous les 40 % cette année, contre ce niveau en 2025.

Cerebras a fait son entrée en Bourse en mai à 185 dollars l’action. La semaine dernière, le titre est passé sous son cours d’introduction après que SemiAnalysis a rapporté que le nouveau niveau GPT-6.1 Sol Ultrafast d’OpenAI fonctionnait sur des GPU Nvidia. Un plus grand nombre d’actions est également devenu disponible à la vente après l’expiration des restrictions de conservation liées à l’introduction en Bourse.

Le PDG d’OpenAI, Sam Altman, a écrit sur X que « Cerebras est un partenaire proche, et nous collaborons étroitement pour repousser les limites de la vitesse ».

Selon Mizuho, Cerebras prévoit de livrer le CS-4 au quatrième trimestre, avec une vitesse de traitement des tokens deux fois supérieure à celle de la génération actuelle, puis le CS-5 en 2027. OpenAI développe également son propre matériel d’inférence. L’entreprise a déclaré en août que sa première puce d’inférence avait surpassé la GB300 de Nvidia lors de tests en laboratoire.