快速推理可能在 2030 年形成规模达 5500 亿美元的市场,瑞穗证券表示,这将让专用芯片制造商 Cerebras(CBRS)有机会切入 AI 计算领域最大的细分市场之一。该行在《The Latent》查阅的一份 10 月 4 日报告中维持其“跑赢大盘”评级和 300 美元目标价。
瑞穗董事总经理 Vijay Rakesh 估计,快速推理市场在 2025 年规模约为 10 亿美元。他预计,到 2030 年,快速推理将占所有 AI 工作负载的约 20%。Cerebras 的芯片支持更快的处理速度。
他预计 Cerebras 的营收今年约为 8.85 亿美元,2027 年为 30 亿美元,2029 年为 135 亿美元。报告称,其中大部分营收将来自公司“不断扩大的客户合作项目储备,其核心是与 OpenAI 和 AWS 的重要合作,潜在新增客户将在 2027/28E 年继续带来上行空间”。
按 300 美元计算,Cerebras 的交易价格相当于瑞穗对其 2028 年销售额预期的约 12 倍。该目标价较周五 166.43 美元的收盘价高出约 80%。Rakesh 还给出了 465 美元的乐观情景和 165 美元的悲观情景,并写道,Cerebras“必须持续执行其路线图,以维持并扩大其[专用芯片]技术护城河”。
买家愿意为速度支付更高价格
Rakesh 写道,高速交付的 AI token 定价约为标准 token 的 6 至 10 倍,“使其成为营收和利润率更高的细分市场”。
以 Anthropic 的 Claude 快速模式为例:其运行速度约快 2.5 倍,但价格是其 6 倍。Rakesh 还提到了 OpenAI 每月500 美元的 Pro 订阅计划,该计划包含使用 Ultrafast 层级的权限,该层级已在公司上周举行的 DevDay 活动上推出。
Cerebras 在 8 月表示,其为 OpenAI 的 Ultrafast 提供算力支持,该服务面向 OpenAI 的GPT-5.6 Sol。该公司称,快速模式每秒最多可生成 750 个输出token,速度最高可达 OpenAI 标准模式的 14 倍。该层级目前提供的最新模型是 GPT-6.1 Sol,也是 OpenAI 目前在The Latent 基准测试中排名第二的模型。
交易公司和五角大楼带来的早期需求
瑞穗预计,Jane Street、Citadel、Jump 和 Hudson River Trading 等做市商及高频交易公司将推动早期需求。该行还认为,快速推理将在网络安全监控和防务系统中逐渐获得应用,这些系统需要实时推理;瑞穗特别提到了防务科技公司 Anduril 和 Shield AI。
报告称,一份合同已经落地:Cerebras 和 Ranovus 从 DARPA 获得了 4500 万美元,用于构建战场模拟 AI 测试平台,目标是实现亚秒级推理。
Rakesh 认为,Meta(META)可能成为下一家推理客户。他还表示,Amazon Web Services(即 AWS)计划在 2027 年第一季度利用 Trainium 芯片,并结合 Cerebras CS-3 系统,在 Bedrock 中提供其 Nova 模型。
更多营收依赖 OpenAI
按瑞穗的估计,OpenAI 一家公司预计将贡献 Cerebras 营收的 80% 以上。这是在阿布扎比的G42和 Mohamed bin Zayed University of Artificial Intelligence 贡献约 86% 营收之后的情况。该行预计,今年这两家客户的营收占比将从 2025 年的水平降至 40% 以下。
Cerebras 于 5 月上市,发行价为每股 185 美元。上周,SemiAnalysis 报道称,OpenAI 较新的 GPT-6.1 Sol Ultrafast 层级运行在 Nvidia GPU 上,随后该股跌破 IPO 发行价。随着 IPO 锁定期限制到期,可供出售的股票也有所增加。
OpenAI CEO Sam Altman 在 X 上写道:“Cerebras 是密切的合作伙伴,我们开展了深入合作,持续探索速度的前沿。”
据瑞穗称,Cerebras 计划在第四季度交付 CS-4,其 token 速度将达到当前一代产品的两倍,并于 2027 年推出 CS-5。OpenAI 也在开发自己的推理硬件。该公司 8 月表示,其首款推理芯片在实验室测试中击败了 Nvidia 的 GB300。
