Anthropic在最新报告中警告称,人工智能模型可能被滥用来助长生物学威胁。
该公司详细介绍了其人工智能模型可能遭到的滥用情况,相关内容载于一份长达154页的报告,涵盖了2025年12月至8月期间的活动,包括涉及生物学滥用、监控、诈骗和欺诈的案例。
该公司表示:“我们发布这项工作,是因为我们认为自己有责任披露对我们服务的恶意滥用。随着模型能力日益增强,其风险也会增加,除非人工智能开发者和社会中的安全守护者采取行动,让这些模型变得更加安全。”
Anthropic描述了多个恶意行为者试图绕过其控制措施的案例,并表示公司随后封禁了这些用户的账户。Anthropic表示,它发现了多个案例,其中一个案例涉及一名美国境外的研究人员使用Claude开展禽流感研究。
该公司表示:“我们掌握的所有证据都表明,这是一项处于非常早期阶段的研究计划。不过,计划细节显示,这项研究针对的是一种具有增强大流行潜力的病原体。”
该公司指出,这项研究提出了一个棘手的双重用途问题:同一项工作既可能被用于更好地理解病毒,也可能被用于以增加其威胁的方式对病毒进行改造。
Anthropic还表示,它发现一名用户使用Claude研究资助申请,以及如何对一种生物体进行基因改造,或在一种蚊媒病毒上创造新的“生物学特性”。该用户引发担忧,是因为与资助申请相关的机构“同样令人担忧”,原因是相关成果计划用于一家军事研究机构。
该公司表示:“我们希望与公众分享这些早期洞见,能够帮助政府、业界和公众了解这些风险的性质,以及确保人工智能模型安全部署所必需的防护措施。”
