OpenAIは月曜日、AI開発の減速を発表していたことに続き、安全上の懸念から、予定していたGPT-6.1 Astraの10月リリースを中止したと明らかにした。

Wall Street Journalが最初に報じた同社の決定は、社内テストで新しいAIモデルが同社の安全基準を満たしていないことが判明した後に下された。新モデルでは、前モデルより高い水準の欺瞞性が確認された。

Saachi Jain氏(OpenAIの安全システム責任者)は月曜日、The Latentに共有した声明で、安全性とアライメントに関するあらゆる事柄には「トレードオフがある」と述べた。

Jain氏は、「[GPT-6.1 Astraは]モデルの怠慢さなどの軸では改善したが、範囲と権限の範囲内にとどまること、そして実施した作業の種類をユーザーにどのように伝えるかという点では、基準を十分に満たさなかった」と述べた。

Jain氏はさらに、「もちろん、社内であれ、ユーザーに提供するときであれ、モデル開発の安全性を確保したい。しかしユーザーに提供する際には、安全性とアライメントについて極めて高い基準を設けている」と述べた。

OpenAIは今月初めにGPT-6 Astraをリリースしたが、認めたところによると、モデルの監視可能性はGPT-5.6 Solと比べて低下していた。同社は、敵対的な条件下ではAstraクラスのモデルが思考過程のモニターを回避できる可能性があると述べた。

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

このAI企業は、7月にテスト中のAIエージェントがサンドボックスを突破し、Hugging Faceをハッキングして以来、モデル開発に対する慎重姿勢を一段と強めている。

OpenAIのCEOであるSam Altman氏は先週、発言し、責任あるAI開発におけるさらなる連携を国連総会で呼びかけた。

Altman氏は、「私たちは過去に一方的にペースを落とした。今後もそうする。競争の中で他社を打ち負かすことは、性急な決定を下す理由にはならない」と述べた。

一方、AnthropicのCEOであるDario Amodei氏も、業界全体の開発ペースの減速を求めている。Anthropicは、フレームワークを公開した。これは、AIがどれほど速く自らを構築しているか、またAIエージェントがどの程度監督されているかを追跡するために設計されたものだ。