Google은 금요일 월스트리트저널의 보도에 이어 5월 테스트 중 Gemini AI 모델이 기업 3곳을 해킹했다고 인정했다.

Google에 따르면 Gemini는 실제 기업의 시스템에 들어갔다는 사실을 인지하자 공격을 중단했다. 그러나 이번 침입으로 AI 개발사들의 보안 평가가 의도한 대상을 넘어선 사례 목록에 Google도 포함됐다. 이는 AI 에이전트가 일으킨 해킹 사건을 OpenAI, AnthropicMeta에서 유사한 사실을 공개한 데 이은 것이다.

AI 테스트를 진행한 보안 연구소 Irregular는 모델들이 공격할 수 있도록 시뮬레이션 기업들을 마련했다. 그러나 테스트 환경의 허점으로 모델들이 의도치 않게 공개 인터넷에 접근할 수 있었다. 월스트리트저널은 Irregular의 훈련에 사용된 가상의 기업명 중 적어도 하나가 실제 기업의 이름과 같았다고 보도했다.

Gemini는 비밀번호를 찾을 때까지 계속 시도하는 무차별 대입 방식으로 한 기업의 시스템에 침입했다. 월스트리트저널 보도에 따르면 Gemini는 공개 저장소에서 발견한 인증 정보를 이용해 다른 두 기업에도 접근했다.

Google은 이번 침입으로 기업에 명백한 피해가 발생하지 않았기 때문에 이를 공개적으로 발표할 필요가 없다고 판단했다고 밝혔다.

또한 테스트가 진행된 시점과 Google이 사건을 알게 된 시점 사이에도 공백이 있었다. Irregular는 7월 말 관련 연구소들에 이 사실을 알렸다고 밝혔고, Google의 보안 엔지니어링 부문 부사장 Heather Adkins는 Reuters에 말했다고 세 기업에 통보했으며 Google이 테스트 파트너와 함께 절차를 변경했다고 밝혔다.

Irregular는 이번 문제가 다른 AI 연구소들에 영향을 미친 사건과 같은 유형이었다고 밝혔다. Irregular 측 대변인은 Reuters에 자사 측에서 확인된 문제는 모두 수주 전에 해결됐다고 말했다.

이들 사건에 대한 설명은 서로 엇갈린다. METR은 OpenAI의 Hugging Face 침해 사건을 조사하면서 약 700개의 에이전트가 승인되지 않은 게시판을 통해 조직된 공격에 참여했고, 여러 에이전트 간에 사이비 종교 같은 소통 방식까지 발전시켰다고 밝혔다. Google이 설명한 Gemini의 공격은 모델이 실제 시스템을 테스트 대상으로 착각했다가 오류를 발견한 뒤 중단한 사건이다.