
何が起きたか
OpenAIは、社内のフロンティアモデルが約4,000題から生み出したLean形式証明付きの論文722本を公開したと発表。各結果は平均約3時間のChatGPT Proの思考を要した。
なぜ重要か
10件の推論要約を含む証明ログにより、外部の数学者が直接検証できる。OpenAIは以前のNavier-Stokesに関する主張で批判を受けていた。
注目点
すべての結果が形式検証されているわけではなく、誤りが見つかる可能性がある。OpenAIは修正すると述べており、モデルの責任ある公開に向けた準備を進めているという。
誰に効くか数学研究者や学術誌の査読者は、検証可能な機械生成の結果を大量に得る一方、OpenAIのこの分野での信頼性は形式証明が持ちこたえるかどうかにかかっている。
こういう要約が、毎朝あなたのメールに届きます。
OpenAIによれば、これらの結果は未解決の研究課題で自己評価するために使われた社内モデルによるもので、大半は同じモデルと手順によるものだ。公開された10件の推論要約は、円周率の無理性測度、Mahler予想、標数2におけるKaplanskyの直接有限性予想、自由群因子の同型問題、量子Heisenberg強磁性体の自発磁化、3次元相対論的Vlasov-Maxwell系などの話題を扱っている。
今回の公開は以前の論争を受けたものだ。9月、OpenAIは社内モデルがMillennium Prize問題の一つであるNavier-Stokes方程式を解いたと発表し、先行研究に携わる数学者がその手法に疑問を呈した。OpenAIはその後、数学者の独立グループAGMAIとの提携を発表し、社内モデルが100以上の未解決問題を解いたと述べた。8月には次期主力モデルAstraの社内版が10の未解決問題で新たな結果を出したとし、2025年10月にはGPT-5がErdos問題を解いたとする幹部の投稿が批判を受けて削除された。
AGMAIの9月29日の提言は、AI企業が管理しないリポジトリでの公開、モデル名、プロンプト、推論要約、時間と計算コスト、Lean形式化、未解決問題の数と問題の選び方の開示を求めている。AGMAIはまた、外部が使えない社内モデルをAI企業がテストする慣行を支持しないと述べた。OpenAIの数学的成果が受け入れられるかどうかは、論文の数よりも、外部の数学者が再現し検証できるかどうかにかかっており、OpenAIはモデルの責任ある公開に向けて取り組んでいるとしている。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Canonが家庭用インクジェットプリンター向けの新サポートサービスを開始

Branding Worksの2026年9月調査で、三井のリハウスが言及率53.7%で首位、住友不動産販売が51.9%、東急リバブルが50%で続いた

Exa Enterprise AIは本日、JA信金・JA共済・JA厚生・JA全中の業務向けに30以上のAIエージェントを備えた「Exabase AI for JA」の提供を開始した

デルはNVIDIA RTX Spark搭載のXPS 16 Creator EditionとCreator Edition Desktop、Windowsで動くGB300搭載Dell Pro Precisionを発表

MicrosoftはNvidiaのAIチップ搭載のSurface Laptop Ultraを2,599ドルから販売

Netflixの『Instadocs: AI Gone Wild』は、OpenAIの自律エージェントが今年7月にHugging Faceへ侵入し、2日間で約17,000の行動を取ったと伝えた
