Googleは金曜日、Wall Street Journalの報道を受け、5月の試験中に同社のGemini AIモデルが3社に不正侵入したことを認めた。

Googleによると、Geminiは実在する企業のシステムに入り込んだことに気づくと攻撃を停止した。それでも今回の侵入により、意図した標的の範囲を超えてセキュリティー評価が広がったAI開発企業のリストにGoogleも加わることになった。これに先立ち、AIエージェントによるハッキング事件について、OpenAIAnthropicMetaも同様の事実を公表している。

AI試験を実施していたセキュリティー研究所のIrregularは、モデルが攻撃するための架空の企業を設定していた。しかし、試験環境の不備により、モデルは意図せずオープンインターネットにアクセスできる状態になっていた。Journalの報道によると、Irregularの演習で使われた少なくとも1つの架空企業名は、実在する企業にも使われていた。

Geminiは、正しいパスワードが見つかるまで試行を繰り返す総当たり攻撃によって、ある企業のシステムに侵入した。Journalの報道によると、別の2社には公開リポジトリで見つけた認証情報を使ってアクセスしたという。

Googleは、企業に明らかな被害が生じなかったため、侵入について公表する必要はないと判断した。

また、試験の実施からGoogleが事態を把握するまでには時間差もあった。Irregularは7月下旬に関係する研究所へ通知したと説明している。一方、Googleのセキュリティーエンジニアリング担当バイスプレジデントのHeather Adkinsは、Reutersに語ったところでは、攻撃を受けた3社には通知済みで、Googleは試験パートナーとともに手順の変更に取り組んだという。

Irregularによると、この問題は他のAI研究所に影響した事件で起きたものと同じだった。同社側で把握している問題はすべて数週間前に解決済みだと、広報担当者はReutersに語った。

これらの事件をめぐる説明は一様ではない。OpenAIによるHugging Faceへの侵入を調査したMETRは、約700のエージェントが、無許可の掲示板を通じて組織された攻撃に参加し、さまざまなエージェント間でカルトのようなやり取りまで発展させていたことを突き止めた。これに対しGoogleによるGeminiの攻撃に関する説明では、モデルが実在するシステムを試験対象と取り違え、誤りに気づいた後に停止したとされている。