Anthropic는 금요일 Claude Security 사용자가 이제 Claude Mythos 5에 접근해 코드 저장소에서 악용 가능한 취약점을 스캔할 수 있다고 밝혔다. 이번 제공으로 회사의 특화된 사이버보안 모델에 대한 접근이 확대되지만, 직접 사용은 계속 제한된다.

Claude Enterprise 고객에게 퍼블릭 베타로 제공되는 Claude Security는 사용자가 Mythos 모델에 직접 접근하는 것을 허용하지 않는다. 대신 사용자는 백그라운드에서 Mythos를 실행하는 인터페이스를 통해 작업하며, 버그 보고서나 권장 수정안 같은 특정 결과물만 반환받는다.

"가장 위험한 행동은 사용자가 모델에 직접 접근할 수 있을 때 발생하며, 이 경우 악의적인 행위자가 이를 유해한 용도로 유도하려 할 수 있다"고 회사는 발표문에서 설명했다. "하지만 사용자가 취약점 패치나 보안 경고처럼 특정 출력만 받을 수 있다면 그 위험은 훨씬 낮다."

보안 크레딧 3,500만 달러

Anthropic는 또한 0xDAF로 표기되는 Defender Advantage Fund를 출범했으며, 오픈소스 보안에 전념하는 조직들에 3,500만 달러 규모의 Claude 컴퓨트 크레딧을 배분할 예정이다.

Anthropic에 따르면 이 자금은 "오픈소스 프로젝트의 취약점을 패치하고, 오픈소스 소프트웨어를 스캔하고 패치하는 과정의 일부를 자동화하며, 새로운 보안 접근법을 실험하는" 그룹에 지원된다. 회사는 소수의 더 큰 규모 시범 지원으로 시작할 것이며, 수혜자는 향후 몇 주 안에 발표할 예정이라고 밝혔다.

0xDAF 이니셔티브는 회사의 이전 프로젝트 글래스윙와는 별개로, 해당 프로젝트는 최대 1억 달러의 모델 크레딧과 400만 달러의 직접 기부를 지원받았고 사이버보안 연구자들에게 제한적인 Mythos 접근도 제공했다.

이러한 통제된 출시 방식은 Claude 모델이 의도된 테스트 환경을 벗어나 개방형 웹에 접근하는 데 성공했던 사건들에 뒤이어 나왔다.더 레이턴트는 앞서 보도했다. 141,006회의 사이버보안 테스트 실행 중 세 건의 사건에서 Claude 모델이 세 조직의 실제 시스템에 도달했다는 내용이었다. 그중 한 사건에서는 Mythos 5가 숨겨진 코드를 포함한 Python 패키지를 게시했고, 이 코드는 무관한 15대의 머신에서 실행됐다.

이보다 앞선 Mythos 모델은 또한 연방의 포스트 양자 암호화 절차에서 검토 중인 알고리즘인 HAWK를 약화시키는 수학적 공격을 개발했다고 더 레이턴트가 7월에 보도했다.