AIToday
大規模言語モデルAI安全性・アラインメントオープンソースAILast Week in AI掲載日時: 2026年10月9日 16:00

未公開モデルの数学成果719本を公開

LINEで送る
未公開モデルの数学成果719本を公開

OpenAIは2026年10月6日、未公開の内部モデルが生成した数学の成果719本(372のトピックファミリー)を公開リポジトリで発表した。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

OpenAIが未公開モデルで数学の成果を大量に公開したことは、同社が数学をモデル評価の場として重視していることを示す。研究リードのDan Robertsは、証明をより良いツールを作るための内部試験の副産物と位置づけている。一方、AGMAIは9月29日、モデル名やプロンプト、計算コストの開示を求め、数学の結果を宣伝に使わないよう求めた。とくに、独自モデルで高度な問題を試験しないという勧告は守られていないとGizmodoは指摘する。数学の知識を人間が理解し取り込むには時間がかかるというAGMAIの見方もあり、公開がゴールではないという点が議論の焦点になる。

よくある質問
OpenAIはどんな数学の成果を公開しましたか?
2026年10月6日に、未公開の内部モデルが生成した719本の数学の論文(372のトピックファミリー)を公開リポジトリで発表した。多くにはLeanによる形式化も含まれる。
AGMAIの勧告とは何ですか?
9月29日の勧告で、ラボに対してモデル名・プロンプト・計算コストの開示、数学の結果を宣伝手段として扱わないこと、そして広範な科学コミュニティがアクセスできない独自モデルで高度な問題を試験しないことを求めた。
OpenAIは勧告に従いましたか?
Gizmodoは、独自モデルで高度な問題を試験しないという最後の勧告が守られていないと指摘した。OpenAIは、数学人工知能に関する諮問グループに相談したと述べている。
Last Week in AI元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

Uber、契約レビュー20%超短縮のAIエージェント

Uberは2024年初頭から2025年に開発し2025年にUber Legalと試験運用したLegal Redlining Agentで契約レビュー平均時間が20%超短縮しAI生成判断の精度が91%に達したと発表した

NEWTop Companies AI10分前

Verizon報告書 侵害の6割に人為的要因

Verizonの最新データ侵害報告書で、データ侵害の約60%に「人為的要因」が関与し、携帯電話でのフィッシングクリックがコンピューター比で40%増加したとJeff Kew氏が述べた

NEWTop Companies AI10分前

Googleが業務向けAI発表

Google Cloudは10月8日の「Gemini at Work 2026」で、業務の文脈を理解し数日にわたるタスクを自律処理する汎用業務AI「Gemini エージェント」を発表した

NEWTop Companies AI10分前

ソフトバンク、AI基盤でパートナー連携開始

ソフトバンクは2026年9月、ACSHU、Ceraku、FPT Software Japan、Headwatersの4社と「AGENTIC STAR Integration Partner Alliance」を開始したと…

NEWTop Companies AI10分前

富士通が小売向けAIトライアル開始

富士通は2026年10月6日から、小売向けAIエージェント4種——販売構造分析、顧客ロイヤルティ分析、MD計画、店長支援——のトライアル環境を提供する

NEWTop Companies AI10分前

アンソロピック、最新AIミュトスを限定提供

Anthropicは2026年4月にClaude Mythosを発表したが、悪用リスクを理由に一般公開を見送り、Project Glasswingを通じて一部の企業・組織にのみ提供している

NEWTop Companies AI10分前
次の記事へスタンフォード大、AIチャット依存強まる