今年,AI“蒸馏”一直是华盛顿政策制定者争论的核心问题。这一过程涉及利用更强大模型的输出训练较弱的模型,使后者能够以一小部分成本模仿前者的结果。
4月,白宫科学办公室指责外国公司,尤其是中国开发商,利用这一技术开展大规模行动,以提取美国模型的能力。在美国政府看来,这类似于工业窃取。财政部长 Scott Bessent 提议,作为应对措施,甚至可以对中国企业实施制裁。
然而,本周 Meta 的 Mark Zuckerberg 提出了另一种做法。他在 Meta 新闻编辑室发布的一封公开信中表示,跨模型训练是“开源生态系统运作方式的重要原则”,美国政策制定者最好接受这一点,而不是加以抵制。
扎克伯格的文章伴随着 Meta 发布一款新的开放权重模型,推动其股价当天收盘上涨2.4%。
扎克伯格的论点关乎竞争力
与这封公开信同日发布的 Meta 新开放权重模型 Muse Glimmer,本身就是利用 Muse Spark 的蒸馏输出开发的。这款拥有300亿参数的模型权重容量低于20GB,据报道可以在配置适当的 Mac 或配备单块消费级 GPU 的 PC 上本地运行。
扎克伯格这封题为《未来属于每个人》的14页公开信承认,AI 行业正在进行蒸馏,但同时指出,这是生态系统运作方式中的正常环节。
信中称,在技术和数据的国际流动中引入更多阻碍,将损害美国竞争力。出于同样的原因,Meta CEO 反对阻止美国人访问外国开放模型。Nvidia、Microsoft 及其他公司也持类似立场,与 Meta 共同签署了另一封7月24日发布的公开信,反对此类限制。
然而,批评者认为,扎克伯格的论点没有回应一个核心问题:据报道,中国开发商通过付费 API 访问提取美国模型的输出,这构成了违反服务条款的行为。
2月,OpenAI 告诉众议院中国问题特别委员会,中国领先的 AI 实验室 DeepSeek 正是通过使用第三方路由器隐藏踪迹来完成这一行为。同月,Anthropic 指责 MiniMax、Moonshot 和 DeepSeek 从其旗舰 Claude 模型中提取能力。
华盛顿的方向仍未确定
这使政策制定者陷入两项相互竞争的优先事项之间:既要防止美国开发的能力被海外低成本复制,又要避免实施可能削弱美国企业日益依赖的开放生态系统的限制。通过 API 进行未经授权的提取,仍可被视为合同或安全问题,而不必将蒸馏本身变成被禁止的行为。
美国立法者是否会推动对外国开放权重模型实施广泛限制,目前仍悬而未决。Axios 上月报道称,一项原计划发布的行政命令已被取消,该命令原本会让美国公司为其服务器上托管的任何中国模型承担责任。
国会和美国 AI 行业都在是否采取此类保护主义措施上存在分歧,不确定这将有助于还是损害国内市场。有关蒸馏和制裁威胁的担忧,很可能会在9月提出;届时,美国和中国代表预计将举行特朗普政府任内首次双边 AI 会谈。
预计美国代表将提出对中国获取美国芯片和模型的担忧,而北京关注的重点包括美国领先 AI 模型可能带来的国家安全威胁。
