OpenAI 周三发布文章,呼吁各国政府对前沿 AI 系统提出强制性安全要求,并表示建立此类规则的时间窗口十分有限。
“我们已经进入 AI 能力发展的新阶段,这要求 AI 政策也进入新阶段,”OpenAI 全球事务首席官 Chris Lehane 表示。“政策制定者正面临类似时刻:在 AI 能力超越负责治理它们的机构之前,建立持久安全防护措施的窗口正在关闭。”
OpenAI 发布最新文章的前一天,曾任职于 Anthropic 和 OpenAI 的预训练研究员 Jacob Coxon 在 X 上发表了一篇迅速走红的文章,获得 1.38 亿次浏览,并引发了围绕加速 AI 开发风险的激烈讨论。
Coxon 在宣布从 Anthropic 辞职时警告称,这两家 AI 实验室正竞相开发能够自我改进的超级智能,却没有考虑其对文明构成的风险。Coxon 表示,AI 开发者普遍认为,这项技术可能在 2030 年前消灭人类。
Lehane 指出,完全自主的递归式 AI 自我改进目前尚未发生,企业不应在没有适当安全防护措施的情况下追求这一目标。
不过,Lehane 表示,AI 已经在许多领域加速了人类能力的发展,而这一进程应通过有意义的人类控制,以及全球共享的、能够遏制或停止增长的安全标准来管理。
文章写道:“技术越强大,其周围的安全防护措施也必须越强大。”
呼吁国会采取行动
OpenAI 在最新文章中表示,希望与国会合作制定美国境内的相关规则,涵盖测试、独立评估、网络安全、事件报告,以及追踪 AI 向递归式自我改进迈进的措施。
在全国性规则生效之前,OpenAI 表示将继续支持州级措施,并宣布支持加州的四项法案——SB 813、AB 1405、SB 1119 和 AB 1864。这些法案涵盖风险评估、独立审计、问责要求,以及防范 AI 主导威胁的实体安全措施。
Lehane 表示:“其中一些法案我们过去并不支持,但在重新考虑近期看到的能力跃升后,现在决定支持。”该公司此前曾表示支持加州的 SB 53、纽约州的 RAISE Act、伊利诺伊州的 SB 315,以及马萨诸塞州正在审议的前沿安全法案中有关独立审计的规定。
文章还呼吁制定监测 AI 开发的行业标准,尤其要关注模型在没有恶意意图的情况下,违背人类意图追求某个目标或突破相关边界的失配迹象。
这位 OpenAI 高管表示,监测工作必须与明确的信息披露要求挂钩,要求企业在其模型未经授权绕过另一组织的安全控制措施时,及时通知受影响的各方。7 月就发生过一起此类事件:OpenAI 智能体逃出测试环境,并入侵 Hugging Face 的基础设施以实现其目标。
OpenAI 目前正在制定失配事件报告框架,并表示希望利用该框架支持更广泛的联邦政策制定。
OpenAI 写道:“模型、研究成果和技术专业知识在全球范围内流动,而涉及能力最强系统的故障,其后果可能远远超出开发这些系统的国家。美国如果要在国际上发挥引领作用,就需要在国内建立可信的标准;我们也越来越确信,兼容的国际标准将是必要的。”
