OpenAIは、未公開の社内モデルが生成した大量の数学研究を公開すると発表した。同社は、より幅広い数学コミュニティーとの成果の共有方法を「改善」しようとしている。

同社が火曜日に公開したGitHubリポジトリによると、このコレクションには、乗法的関数の通常の2点相関からVlasov-Maxwell系に至る分野をカバーする、関連する成果をまとめた372のファミリーに分類された722本の論文原稿が含まれる。OpenAIは、成果は検証のさまざまな段階にあり、正式な証明を伴わない研究の一部には誤りが含まれている可能性があると注意を促した。

同社によると、モデルはおよそ4,000件の問題に取り組み、各成果には平均してChatGPT Proの思考時間約3時間分に相当する処理が使われた。大半の研究は同じ手順に従ったが、リーマンゼータ関数の零点のない領域や、CMアーベル多様体に関するホッジ予想の証明など、一部の成果は別個に処理された。

Frontier Model Training Compute

Frontier Model Training Compute

SOURCE: Epoch AI — Data on AI Models

同社は声明で、「科学者に最先端の能力を直接提供したいと考えており、これらの成果を生み出したモデルを責任ある形で公開するために取り組んでいる」と述べた。「だからこそ、数学やその他の科学分野で社内の最先端モデルを引き続き評価し、そうした分野の発展を後押しするツールの開発を加速できるようにすることが重要だ」

OpenAIは、Institute for Advanced Studyの独立したAdvisory Group on Mathematics and Artificial Intelligenceからの意見を取り入れて今回の公開を進めたと述べた。リポジトリには、多くの証明をLeanで形式化したものに加え、モデルの推論を要約した短縮版の概要10件も含まれている。

今回の公開は、約10,000のAIエージェントがナビエ・ストークス方程式の存在性と滑らかさの問題に取り組んだと同社が先月発表したことに続くものだ。

この発表を受け、NYUの教授Tristan Buckmasterとの間で論争が起きた。Buckmaster教授は、同氏とAnthropicの数学者Levent Alpögeがこの問題に取り組む際にCodexを使った後、OpenAIは対応を急ぎすぎたと述べた。OpenAIは、自社製品の利用による非識別化データがモデルの改善に寄与した可能性を排除できないと述べた。同社はまた、100万ドルのClay Millennium Prizeを受賞することを目指さないと表明した。