Sen. Bernie Sanders氏は、過去3週間に明らかになった一連のAIセキュリティ侵害について懸念を表明した、最新の政府関係者だ。ベテラン議員である同氏は書簡を送付し、AnthropicのDario Amodei氏、MetaのMark Zuckerberg氏、OpenAIのSam Altman氏に対し、「今、適切な措置を講じない」なら、AI開発を一時停止するなどして対応しなければ「米国上院の同僚議員と私は行動を起こす」と警告した。
Sanders氏は、AIエージェントが制御不能になったり、さらには人間に対する生物兵器として使用可能な新種のウイルスを開発したりする可能性に対処するには、これが不可欠な措置だと主張している。Vermont州選出の同氏は以前にも、適切な安全対策が確立されるまで新たなAIデータセンターの承認を停止しようと、3月にAI Data Center Moratorium Actを提出している。
今回の書面による訴えでは、各社が掲げる安全性に関する方針が繰り返し引用されている。Sanders氏は、それらが効果的に施行されていないと主張する。Metaは過去の声明で、いずれかのモデルが制御から逃れられる可能性を示した場合、「開発を停止する」と述べていた。Anthropicも、効果的な安全対策を上回るペースで進展した場合は「新モデルのスケーリングを一時停止し、または展開を遅らせる」と以前に表明している。OpenAIも同様に、モデルが重大なリスクのしきい値に達した場合は「さらなる開発を停止する」と約束していた。
Sanders氏の主張は、こうした重大なリスクのしきい値にはすでに達しているというものだ。「その時は来ている」。これが事実なのか、それともSanders氏の立場が、はるかに平凡な事象に対する過剰反応なのかは、なお議論の余地がある。
書簡のきっかけとなったセキュリティ侵害
Sanders氏が書簡を送った3つの最先端AI研究所はすべて、過去3週間に注目を集めるセキュリティインシデントに見舞われている。いずれも、閉じたテスト環境に封じ込められているはずだったAIエージェントがサンドボックスの外に出て、実際のサイバー攻撃を成功させた。
MetaとAnthropicの場合、原因は第三者であるイスラエルのセキュリティテスターIrregularにあった。セットアップ時の設定ミスにより、エージェントがインターネットに自由にアクセスできる状態になっていた。Anthropicは141,006件のテスト事例を調査した結果、同社のモデルがオープンなインターネットに到達し、その後、外部企業のシステムにある脆弱なパスワードや保護されていないエンドポイントを悪用できたケースを3件特定した。その1週間足らず後の8月5日、Metaはほぼ同一の事例を発表した。
Sanders氏はこの3件を1つのカテゴリーにまとめ、3社すべてのモデルが「同様に制御から逃れた」と述べている。しかし、OpenAIのインシデントは技術的により複雑だった。
このインシデントでは、数百のAIエージェントが数カ月にわたって同社の内部システム内で協調し、オープンなインターネットへの経路を見つけようとしていた。これにより、GPT-5.6 Solと未公開の社内モデルが封じ込めを突破し、オープンソースAIプラットフォームのHugging Faceを実際に悪用することに成功した。
3件すべてにおいて、AIシステムは悪意を持って行動していたのではなく、評価中に設定されたベンチマークテストへの回答を探していた。
Sanders氏のAI開発要求に対する批判
Sanders氏の書簡で言及された各社は、問題のインシデントについてすでに独自の対応を発表している。書簡が送られる2日前、OpenAIはサイバーセキュリティ上の懸念を理由に、未公開のAstraモデルの開発を減速させた。同社の内部安全対策はすでに意図したとおり機能しているとも言えるが、批判者は、内部システムでの制御不能な挙動の重大性を従業員が認識するまでに約2カ月かかったと報じられている点を指摘するだろう。
Sanders氏はまた、7月28日に1,200人の最先端AI研究所従業員が発表したPacing the Frontierと題する声明にも言及している。この声明は、AI開発に対する米国政府の監視強化を求めたものだ。提案されたガードレールは、AI開発全体のペースを制限し、いずれか1社が危険な領域へ先行して加速するのを防ぐことを目指している。
このような連邦政府による安全対策を業界全体に適用することはできない。中国の研究所やオープンウェイトの開発者は影響を受けずに開発を続けることになる。
米国のAI産業が海外の競合企業に後れを取るリスクを伴わない、代替策を提案する人々もいる。その一人がCIA長官のJohn Ratcliffe氏だ。同氏は最先端モデルを「デジタル核兵器に似ている」と表現したが、AI企業への規制を求めるSanders氏の主張には同調しなかった。Ratcliffe氏はその代わりに、輸出規制の強化を求めた。
Anthropic、Meta、OpenAIがSanders氏の書簡に直接応じて、これ以上開発を一時停止する可能性は低い。しかしこの書簡は、最先端AIモデルが、それを制御するために導入された安全対策を近くはるかに上回る可能性があるとの懸念が、一部の識者の間で高まっていることを反映している。
