OpenAIは今後数週間のうちに、欧州連合に所在するユーザー向けに、ChatGPTおよびCodexから生成される特定のモデルテキスト出力への見えない透かしの付与を開始すると、同社は月曜日に発表した。

OpenAIの透かしシステムは、世界中のAPI顧客がオプトインで利用できる。このシステムは10月5日から、選択されたAIモデルが生成したテキストをAI生成として見えない形で示すが、この機能は初期設定では無効のままとなる。OpenAIは、この機能の導入について、同機関によるディープフェイクや、「公共の利益に関する事柄について国民に情報を提供する目的で公開された」改変テキストの削減を目指す取り組みであるEU AI Actの透明性要件に対応するためだと説明した。

同社がtextGrainと呼ぶこの透かしシステムは、モデルが言語を選択する際の特定の選択に統計的パターンを埋め込む。ただし、OpenAIのベンチマークでは透かしの付与による意味のある性能差は確認されなかったため、モデルの出力全般の信頼性を変えることはないはずだと同社は述べた。OpenAIはこの技術をオープンソース化する計画だが、検出ツールは当初、承認済みの研究者と専門機関のみが利用できる。

ただし、同社の内部テストでは、編集によって透かしの検出が容易に妨げられることも示されている。400トークンの短い文章を使ったあるテストでは、10語に1語だけを同義語に置き換えると、検出成功率はおよそ92%から66%に低下した。同社の別のテストでは、語の4分の1を同義語に置き換えると、検出率はわずか17%まで低下した。

Anthropicはすでに同様の透かし付与に踏み切っている。The LatentがClaude Fable 5.1の公開時に報じたように、同社の同じく見えない透かしシステムには、わずかなAI支援でさえ自分の作品にフラグが付く可能性や、透かしによってモデルの出力が劣化する可能性を懸念するユーザーから異論が出た。Fable 5.1は現在、The Latentのベンチマークで3番目に高い順位のモデルで、OpenAIのGPT-6 AstraとAnthropicのOpus 5.5に次ぐ。

OpenAIのテストによると、短い文章や、数学のように言葉の選択の自由度が限られる分野も検出が難しかった。これは「語の選択における自由度が低い」ためだという。

OpenAIは、同社の透かしによって「そのテキストの所有者、利用が合法だったか、開示が必要だったか、または誰に責任があるか」を特定することはできないと述べた。同システムは、他のモデルや、以前のOpenAIモデルが生成したテキストを認識できない場合もある。そのため、同社によれば、透かしがないことは人間がその文章を書いたことの証明にはならない。