AIToday
大規模言語モデルAIビジネス・産業THE DECODER掲載日時: 2026年7月12日 6:012分で読める

OpenAIのGPT-5.6が50年来の数学難問を解く

LINEで送る
OpenAIのGPT-5.6が50年来の数学難問を解く

要点

  • OpenAIのGPT-5.6が1970年代から未解決だったグラフ理論の難問を証明し、短くて初等的な証明をもたらしました。

  • マンチェスター大学の数学者は、AIが粘り強く小さな変化を試し続ける能力により、人間では見落とされた証明を発見したと評価しています。

  • ただし、OpenAIの論文は先行研究を引用していないという課題が指摘されています。

3つのポイント

  1. 何が起きたか

    OpenAIのGPT-5.6 Sol Ultraが、1970年代から未解決だったグラフ理論の難問(サイクル予想)の証明を生成しました。マンチェスター大学の数学者Thomas Bloomが評価したところ、「短くて初等的で、1980年代に発見されてもおかしくない証明」だと述べています。

  2. なぜ重要か

    人間の数学者が見落とした理由は、証明の鍵となる小さく直感に反する推論ステップにあります。Bloomは「AIは失意に陥らず、小さな変化を試し続ける粘り強さを持つ」と指摘し、これは既存知識の組み合わせによって時間をかければ解ける問題が他にもあることを示唆しています。

  3. 注目点

    一方、OpenAIの論文は1983年のBermond、Jackson、Jaegerらの先行研究に言及しておらず、Bloomは「AIが生成した論文は文献から引用なしに考え方を使う傾向がある」と批判しています。

この記事についてAIに質問する →

背景と解説

OpenAIがGPT-5.6で数学の難問を解いた事例は、AIと人間の問題解決の違いを浮き彫りにしています。Bloomの分析によれば、この証明に必要だったのは新しい理論ではなく、既存の知識を粘り強く組み合わせる能力でした。人間の数学者が自然なアプローチで失敗した後、諦めやすいのに対し、AIは小さな変化を試し続けることで、見落とされていた解法を発見したのです。

ただし、重要な課題も浮かび上がっています。OpenAIの論文は1983年のBermond、Jackson、Jaegerの先行研究に言及していないと批判されており、AIが生成した学術成果における引用慣行の問題が指摘されています。Bloomは、AIが先行論文を検索して読む傾向があるにもかかわらず、その影響を明示していないことに疑問を呈しています。こうした検証はまだ科学コミュニティによる完全な数学的確認が保留されている段階であり、今後の評価が待たれています。

よくある質問

この証明は新しい数学的理論を使っていますか?
いいえ。Bloomによると、この証明は「新しい数学的理論を必要とせず、既知の道具を巧みに組み合わせた」ものです。基礎となる数学的考え方は少なくとも1983年の論文に遡ります。
どうやってAIにこの証明を見つけさせたのですか?
人間が書いたプロンプトが重要な役割を果たしました。完全な証明が存在すると仮定させ、インターネット検索や「問題は未解決」という回答を禁止し、8時間以上の計算を強制しました。実際にはAIは1時間で完成させています。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • フロンティアAI主導権、全てTHE DECODER · 1時間前
  • ジョン・ディア、農家向けAIチャットボット投入The Verge AI · 1時間前
  • Google Pics、AI編集でWorkspaceにThe Verge AI · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAI電力需要シフト VertivとBloom Energy が急伸