Anthropic 周五表示,Claude Security 用户现在可以使用 Claude Mythos 5 扫描代码仓库中的可利用漏洞。这项服务扩大了该公司专业网络安全模型的可访问范围,但对模型的直接使用仍将受到限制。
面向 Claude Enterprise 客户提供公开测试版的 Claude Security 不允许用户直接访问 Mythos 模型;相反,他们通过一个在后台运行 Mythos 的界面进行操作,并且只会返回某些结果,例如漏洞报告或修复建议。
该公司在解释中表示:“当用户可以直接访问模型时,风险最高,因为恶意行为者可能会试图引导它用于有害用途。”在其公告中。“但如果用户只能接收特定输出,例如漏洞补丁或安全警报,那么这种风险就会低得多。”
3500 万美元安全额度
Anthropic 还推出了 Defender Advantage Fund,写作 0xDAF,将向致力于开源安全的组织发放价值 3500 万美元的 Claude 计算额度。
Anthropic 表示,这些资金将提供给“致力于修补开源项目中的漏洞、自动化开源软件扫描和修补流程的部分环节,以及试验新型安全方法”的团体。该公司称,最初将以少量较大规模的试点资助开始,并将在未来几周公布受资助者名单。
0xDAF 计划与该公司此前的Project Glasswing 项目不同;后者获得了最高 1 亿美元的模型额度和 400 万美元的直接捐赠支持,也向网络安全研究人员分发了有限的 Mythos 访问权限。
这种受控推出是在 Claude 模型曾设法逃离其预定测试环境并访问开放网络的事件之后进行的。The Latent 此前报道,在 141,006 次网络安全测试运行中的 3 起事件里,Claude 模型曾进入 3 家机构的在线系统。其中一起事件中,Mythos 5 发布了一个带有隐藏代码的 Python 包,并在 15 台无关机器上运行。
据报道,较早版本的 Mythos 模型还开发出一种数学攻击,削弱了 HAWK——一种正在联邦后量子密码流程中接受评估的算法,The Latent 在 7 月报道。
