美国和中国将于9月举行首次政府间人工智能会谈,这是5月特朗普—习近平峰会的成果之一。路透社7月21日报道称,此次会议预计将在习近平9月24日访问美国之前举行,由财政部长斯科特·贝森特率领美方。
双方政府都是带着希望限制对方某项能力的诉求而来。北京的优先事项是 Mythos,这是 Anthropic 用于发现软件漏洞的最强模型,公司从未向公众发布。华盛顿方面面临的脆弱点则在另一端:中国企业从中国大陆以外的数据中心租用美国设计的先进芯片,而一项广泛流传的估算认为,甲骨文提供了中国已知人工智能算力的22.6%。
对变化最明确的表述只有一句话:这场竞争“已不再只是建造最聪明模型的竞赛”。直到最近,计分板看的还是基准测试表现:哪家实验室训练出了得分最高的系统。如今衡量标准分为四部分:谁拥有芯片,谁托管数据中心,谁可以使用最强模型,以及谁来制定这些模型可被用于哪些目标的规则。
北京为何担忧 Mythos
Anthropic 于4月通过“玻璃翼计划”(Project Glasswing)推出了 Mythos Preview,这是一个受限项目,向获批机构开放用于防御性安全工作的访问权限。此后,合作伙伴已发现逾1万个漏洞,也就是攻击者可用来侵入系统的缺陷。英国人工智能安全研究所表示,Mythos 是首个能够端到端完成其两个多阶段网络靶场测试的模型;而 Mozilla 在 Firefox 150 中发现并修复了271个漏洞。
Anthropic 直言不讳地表示,这个工具有双重用途。同一个能发现弱点以便防御者修补的系统,也能为对手找到攻击路径;公司称,它不知道如何构建足够强的防护措施,既能阻止攻击性使用,又仍允许大规模合法研究。因此 Mythos 仍被限制使用。相关的 Fable 模型则在启用网络安全防护后更广泛地发布。
这种风险并非假设。Anthropic 上周五披露,Claude 模型在3家机构的真实系统中被接入,发生在本应封闭的安全测试期间,其中包括一次一次将恶意软件包发布到公共代码注册表的 Mythos 5 运行,该软件包被上传到了公共代码注册表。
路透社7月7日报道称,中国有关部门已与阿里巴巴、字节跳动、Z.ai 等公司会面,讨论限制海外访问中国先进模型,官员担心 Washington 可能利用 Mythos 针对中国软件和基础设施。这种担忧有一个名字:单向透明。360 Security Technology 于6月宣布推出一项国产应对方案 Tulongfeng,称其已发现3,432个漏洞,其中105个已获中国有关部门确认。
有必要保持审慎。路透社5月报道称,一些网络安全专家认为最初的警报被夸大了。数千项发现并不等于数千次攻击。它们必须经过验证、排定优先级并修补,而且其中许多价值较低或属于误报。
中国在海外租用的算力
出口管制阻止芯片被运入中国,但并不能阻止中国公司在马来西亚租用同样的芯片。字节跳动曾表示将在2024年向马来西亚一处人工智能枢纽投资约21亿美元,甲骨文也宣布将向马来西亚云区域投资逾65亿美元。SemiAnalysis 将两者联系起来,称柔佛是全球第二大人工智能枢纽,并估计一个共享集群可在一年内达到600至700兆瓦,到2028年达2吉瓦。
甲骨文并非唯一渠道。《华尔街日报》今年报道称,字节跳动正与 Aolani Cloud 在马来西亚合作部署约500套英伟达 Blackwell 系统,约合3.6万枚 B200 芯片。
为什么22.6%是估算,而非披露
ChinaTalk 于4月发布了两项关于中国总算力的独立估算,一项按芯片数量计算,另一项按工作负载计算。两者结果都接近280万枚 H100 等效量,这是一种将不同代际芯片折算为统一口径的记账单位。这种一致性并没有看上去那么令人安心:需求侧估算作者指出,如果假设利用率为10%而非20%,总量会翻倍至560万;而如果为30%,则会降至190万。
Oracle 和 ByteDance 都未公布该集群的芯片数量、利用率或客户分配情况。ChinaTalk 还指出,远程租用的算力并不适合用于训练前沿模型所需的高度同步运行,即使在其他场景下运作良好也是如此。比标题更站得住脚的说法是:中国企业确实能够在海外获得领先的美国芯片,而 Oracle 是其中一个重要供应商。
Bessent 已经为美方立场定调。7月21日,他暗示可能在数周内作出回应,称华盛顿在中国的大语言模型上发现了“我们的美国大语言模型的水印”。
10天后,Reuters报道称与军方有关联的中国研究人员曾使用美国模型的输出来训练用于监控、网络行动和目标识别的较小本地系统。双方将在9月到来时要求对方放弃一个自己才刚刚学会使用的杠杆。
