OpenAI 于周四深夜发布了 GPT-6 Astra,最初仅限少数获选组织使用。
不过,此次发布并不顺利,CEO Sam Altman 表示,OpenAI 在将公告上线时遇到了一点“小插曲”;与此同时,有报道称符合条件的用户难以访问这一新前沿模型。“首先,很抱歉这次上线过程一团糟,”Altman 后来写道,并补充说,更广泛的访问权限应在“不久的将来”开放,Pro 订阅用户将率先获得。
在发布公告中,OpenAI 确认,未来几天内,ChatGPT Plus、Pro、Business 和 Enterprise 订阅用户将陆续获得 Astra 的访问权限。
OpenAI 工程负责人 Tibo Sottiaux 表示,付费 ChatGPT 用户每被延迟一天使用 Astra,就会获得一次“累积重置”额度。“团队正在竭尽全力,尽可能快地开放访问权限,”他写道。
Astra 的性能
在上线过程多次延迟之际,Altman 表示,OpenAI 在发布 Astra 前投入了额外时间进行安全测试。“我们花了额外的时间,以确保能够满足这一能力级别所要求的安全和对齐标准,”他写道。
本周早些时候,OpenAI 表示准备很快发布 Astra,但其先进的网络安全能力将受到限制,因为 Astra 成为首个达到“Critical”网络安全能力阈值的 OpenAI 模型。该公司解释说,这意味着只要配备适当的工具并获得访问权限,它就能发现此前未知的安全漏洞,并在许多系统中制定利用这些漏洞的方法,而无需人员逐步指导。
在周三接受 Sources Podcast 采访时,Altman 表示,Astra 在使用计算机方面已经达到让人感觉“与人类水平相当”的程度,而此前的模型在这一领域往往表现不可靠。他说,在考虑模型朝 AGI 发展的进展时,计算机使用能力是让他产生“哇,它真的做到了”这种感受的能力之一。
OpenAI 在发布公告中表示,Astra 在编程和计算机任务方面取得了进步。据该公司称,Astra 在 Terminal-Bench 4.0 上的得分为 57.9%,GPT-5.6 Sol 为 37.3%,Claude Fable 5.1 为 55.8%。ARC Prize Foundation 补充说,Astra 在 ARC-AGI-3 的 96% 关卡中达到了人类行动效率基线。
由 The Latent 汇总的独立基准测试结果则没有那么明确:Astra 在部分测试中优于竞争模型,但在其他测试中落后于它们。
OpenAI 确实指出了 Astra 表现不如 GPT-5.6 Sol 的一个领域。在旨在测试模型能否隐藏自身行为的对抗性测试中,Astra 在执行某些破坏任务时,有时会在被明确要求这样做的情况下避开 OpenAI 的内部监控。在OpenAI 的安全概览报告中,该公司表示,其更广泛的测试仍发现,与 GPT-5.6 Sol 相比,Astra 总体上不太可能违反安全和安保限制。
此外,OpenAI 周四宣布,将提供 10 亿美元的补贴访问权限给 Daybreak,这是其面向网络防御人员的项目。这项承诺涵盖访问权限、培训和技术支持,初期对象包括供水和电力运营商、州及地方政府、社区银行、非营利组织以及开源维护者等群体。
