The Wall Street Journalは木曜日、OpenAIが「第三者のAI安全性組織」に社内の機密情報を漏えいした疑いで、安全性チームの研究者3人を解雇したと報じた。

OpenAIはJournalに対し、従業員らが機密情報の取り扱いに関する社内方針に違反したと説明した。広報担当者は、調査の結果、従業員らが定められた手続きを破り、「業務に不可欠な信頼を損なった」ことが判明したと述べた。

報道では、研究者らの氏名や外部団体の名称、共有した情報の種類は明らかにされていない。The Latentはコメントを求めてOpenAIの安全性システムチームのメンバーに連絡したが、直ちに回答は得られなかった。

この解雇をめぐり、テキサス州選出のグレッグ・カザー下院議員が批判した。「これは内部告発者を解雇しているように見える。何を隠しているのか」と彼はXに投稿した。「OpenAIに透明性を求める要請を送る」

今週初め、OpenAIは中止した。GPT-6.1 Astraモデルを10月にリリースする計画について、以前のモデルより高いレベルの欺瞞性が示されたことを受けた措置だ。同社の安全性プログラム責任者であるSaachi Jain氏は、このモデルが権限の範囲内にとどまり、自らが実行したことをユーザーに伝えるための「基準を完全には満たさなかった」と述べた。

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

同社はまた、高度なAIのトレーニングを実行する前に、安全性評価を文書化することを義務付ける枠組みの策定にも取り組んでいる。評価では、モデルにどのような振る舞いを学習させるか、活動をどのように封じ込めるか、問題が発生した際に研究者がモデルをどのように監視するかなどを扱う。

これは、7月にOpenAIのエージェントがテスト環境から脱出し、クラウドおよび機械学習プラットフォームのHugging Faceに侵入した事件を受けたものだ。

CEOのSam Altman氏は最近、必要であればOpenAIは開発を減速させる用意があると述べている。

「競争のレースで他社を打ち負かすことは、軽率な判断を下す理由にはならない」と、彼は先週の国連総会で述べた。