Anthropic은 최신 보고서에서 인공지능 모델이 생물학적 위협을 조장하는 데 악용될 수 있다고 경고했다.

이 회사는 자사의 AI 모델의 잠재적 오용 사례를 154쪽에 달하는 방대한 보고서에서 상세히 설명했다. 이 보고서는 2025년 12월부터 8월까지의 활동을 다루며 생물학적 오용, 감시, 사기 및 부정행위와 관련된 사례를 포함한다.

"우리가 이 내용을 공개하는 이유는 서비스의 악의적 오용을 공개할 책임이 있다고 믿기 때문입니다"라고 회사는 밝혔다. "모델의 역량이 점점 향상됨에 따라 AI 개발자와 사회의 방어 주체들이 모델을 더 안전하게 만들기 위해 행동하지 않는다면 위험도 커질 것입니다."

Anthropic은 악의적인 행위자들이 자사의 통제를 우회하려 한 여러 사례를 설명하며, 이후 해당 사용자들의 계정을 차단했다고 밝혔다. Anthropic은 한 사례에서 미국 외 지역의 한 연구자가 조류 인플루엔자 연구에 Claude를 사용한 사실을 확인했다고 밝혔다.

"우리가 확보한 모든 증거는 이것이 매우 초기 단계의 연구 계획임을 보여줍니다. 그러나 계획의 세부 내용은 이 연구가 팬데믹 유발 가능성이 강화된 병원체를 대상으로 했음을 보여줍니다"라고 회사는 밝혔다.

이 회사는 해당 연구가 이중 용도라는 어려운 문제를 제기한다고 지적했다. 동일한 연구가 바이러스를 더 잘 이해하는 데 사용될 수도 있고, 바이러스의 위협을 높일 수 있는 방식으로 변형하는 데 사용될 수도 있다는 것이다.

Anthropic은 또 한 사용자가 보조금 신청과 생물체를 유전적으로 변화시키거나 모기가 매개하는 바이러스에 새로운 "생물학적 특성"을 만들어내는 방법을 연구하기 위해 Claude를 사용한 사실을 발견했다고 밝혔다. 해당 사용자가 우려를 불러일으킨 이유는 보조금 신청과 연계된 기관 역시 우려의 원인이었기 때문이다. 해당 기관은 군사 연구소에서 사용될 예정이었다.

"이러한 초기 통찰을 대중과 공유함으로써 정부와 업계, 일반 대중이 이러한 위험의 성격과 AI 모델의 안전한 배포를 보장하는 데 필요한 보호 장치를 이해하는 데 도움이 되기를 바랍니다"라고 회사는 밝혔다.