AIToday
大規模言語モデルAI安全性・アラインメントZenn AI/ML掲載日時: 2026年10月10日 10:00

OpenAI、モデル生成の数学成果を公開

LINEで送る
OpenAI、モデル生成の数学成果を公開

2026年10月6日、OpenAIはモデル生成の数学成果とLean証明をopenai/mathで公開。10月7日までに原稿3本が撤回され、訂正14件と参照更新13件が記録された。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

2026年10月6日のOpenAIの公開は、モデル生成の成果とLean形式証明を一つのGitHubリポジトリにまとめたものだったが、その包み方の限界は1日で明らかになった。10月7日の履歴ファイルは、撤回、証明の修正、引用更新、追加の形式化を別々のカテゴリーに分けている。各項目が異なる種類の事後確認を意味するからだ。撤回は引用した主張とその根拠の証明が今も有効かを問う。修正は命題、仮定、論証のどこが変わったかを問う。参照更新はどの版を引用しているか、論理的依存が変わったかを問う。

参考文献リスト上で似て見える二つの関係は同じものではない。論理的依存とはある定理の証明が別の定理を仮定することであり、書誌的参照は別の文書や版を指すだけだ。前者を後者から推測したり、引用が更新されたことを依存関係の再検証の証拠と見なしたりするのは不適切とされる。ここで引用されるAGMAIの提言——永続識別子、改訂履歴、自然言語の主張と形式証明を結ぶ機械可読リンク、形式化状況の明示——は出版者向けだが、検証をやり直さずに引き継ぐために下流の研究者が何を必要とするかも示している。

提案された管理スキーマは既存のopenai/mathの構造ではなく、原稿の状態と版を、主張レベルの検証範囲、論理的依存、書誌的参照から分離する概念例だ。単純なverified: trueというフラグでは、形式化がどの版のどの定理を対象とするか、依存関係がその後改訂されたかが失われる。例えば現在のREADMEの719という数字は722の訂正ではなく、3本撤回後の数であり、ここで数字を読むには何をいつ数えたかを知る必要がある。

よくある質問
OpenAIは何本の原稿を公開し、何本が撤回されたのか。
公開時は372結果系列と722原稿が掲載されていた。10月7日に原稿3本が撤回され、10月9日のREADMEでは372結果系列と719原稿になっていた。
ここでLean検証は実際に何をカバーしているのか。
READMEは検証レベルが一律ではなく、すべての原稿にLean形式化があるわけではないと明記しており、形式化された成果でも対象の主張の確認は別途必要だ。
LINEで送る

ITmedia AI+、SiliconANGLE AIも報道

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へUkraine