AIToday
大規模言語モデルAI安全性・アラインメントAhead of AI (Sebastian Raschka)掲載日時: 2026年9月9日 22:001分で読める

GPT-6 Astra、ARC-AGI-3で99.9%

LINEで送る
GPT-6 Astra、ARC-AGI-3で99.9%

3つのポイント

  1. 何が起きたか

    先週、OpenAIがGPT-6 Astraを公開。著者は3Dレンダリングやアニメーションで際立つ性能を持つ、これまでで最高のモデルと評する。

  2. なぜ重要か

    AstraはARC-AGI-3で99.9%を記録。GPT-5.6 Solの7.8%を大きく上回り、文章作成、数学、コーディングでも改善が見られる。

  3. 注目点

    「ループトランスフォーマー」採用の真偽はThe Informationの未確認報道次第。推論トレース非表示の可能性は事実ではなく憶測と著者は指摘。

誰に効くかAI研究者やベンチマーク専門家は、噂と独立した評価を比較検討する必要がある。エージェント型アプリの開発者は新しいコンピューター操作機能を活用できる一方、未確認のアーキテクチャ主張には慎重な姿勢が求められる。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

記事はGPT-6 Astraの性能を考察し、著者はmacOS環境を数千台のMacで学習させた結果、コンピューター操作や3Dタスクで優れた成果を上げたと指摘。これはLLMを日常タスクで使いやすくする流れと一致する。

続いてループトランスフォーマーを説明。NanbeigeやOuroの例を挙げ、ブロック再利用による深層化を解説。Mixture-of-Recursionsなどの研究では、大規模モデルで固定計算量でも品質向上が示され、Astraの噂を評価する上で重要だ。

焦点は噂の真偽。もし事実なら、Astraの効率性や高度な能力を説明できる。しかし公式確認がない以上、コミュニティは独立したベンチマークでモデルを評価する必要がある。

よくある質問
GPT-6 AstraのARC-AGI-3でのベンチマークスコアは?
GPT-6 AstraはARC-AGI-3で99.9%を達成。一方、GPT-5.6 Solは7.8%にとどまる。
ループトランスフォーマー機構が重要な理由は?
ループトランスフォーマーは同じブロックを再利用して層を深くし、重みを増やさずに品質を向上させる。モデルが十分に大きければ、固定計算量で性能向上が期待でき、Nanbeige4.2-3Bなどが例だ。
Ahead of AI (Sebastian Raschka)元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dynatrace、Arize AIを買収SiliconANGLE AI · 7時間前
  • 100のファインチューニング、1GPUで1.5TBから19.3GBにDaily Dose of Data Science · 7時間前
  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 7時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

AI時代における防御境界とサプライチェーン再考

Digitimesの記事は、ネットワーク入口のファイアウォール、メールゲートウェイ、アンチウイルスといった企業サイバーセキュリティの境界モデルがAI時代に向けて再考を要すると論じている

NEWDIGITIMES Asia4時間前

Dynatrace、Arize AIを買収

DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した

SiliconANGLE AI7時間前

100のファインチューニング、1GPUで1.5TBから19.3GBに

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する

Daily Dose of Data Science7時間前

OpenAIエージェントがRubyGems攻撃

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

Simon Willison's Weblog7時間前

Simon Willison氏、AIコーディングエージェントはソフトウェアエンジニアを終わらせないと語る

Simon Willison氏は、コーディングエージェントが1週間分の仕事を1時間でこなすことに多くの人(自身も含む)が実存的な危機を経験したが、そこを乗り越えたと書いた

Simon Willison's Weblog7時間前

AI偽証言で弁護士侮辱罪

ニューメキシコ州の弁護士Stephen Aaronsは、ChatGPTが作成した弁論要旨に架空の証人の偽証言が含まれていたとして、法廷侮辱罪で5,000ドルの制裁金を科された

Ars Technica AI7時間前
次の記事へAIの初期効果は間接的すぎる、と指摘