AIToday
Import AI掲載日時: 2026年7月6日 22:004分で読める

AI、GPU最適化やリモート業務で急速に能力向上

LINEで送る

要点

  • Fableが GPU最適化コード設計で業界最高速を達成し、Center for AI SafetyとScale Labsはオンライン在宅業務の自動化成功率が 8 カ月で 2.5% から 16.1% に上昇したことを報告しました。

  • University of Hong Kong や Columbia University など複数機関は複雑な多段階コンピュータタスク向けベンチマーク OSWORLD 2.0 を公開し、AI システムが経済的に価値のある業務を自動化する能力が加速度的に向上していることが示されました。

3つのポイント

  1. 何が起きたか

    AI企業Fableが「KernelBench-Mega」でGPU処理コード(CUDA)の最速実装を達成し、18.71X倍の高速化を実現しました。また、Center for AI SafetyとScale Labsが測定した「Remote Labor Index」(オンライン在宅業務の自動化成功率)は2025年10月の2.5%から2026年7月の16.1%に上昇し、OSWorld 2.0ベンチマークでは最長1.6時間を要する複雑なコンピュータ操作タスクの評価が開始されました。

  2. なぜ重要か

    AI自体が研究開発の基礎的なタスク(カーネル設計など)を自動化できるようになり、自己改善が加速する可能性があります。また、リモート業務の自動化成功率が8カ月で4倍以上に向上した事実は、AI能力の経済的な影響が急速に拡大していることを示唆しています。人間の革新速度がAI能力の拡張速度に追いつけるかどうかが、雇用と経済全体に大きな影響を与える可能性があります。

  3. 注目点

    Remote Labor Indexではフロンティアモデルの最新版Fable 5が16.1%の成功率に到達しており、3D・CAD設計、建築、グラフィック、ビデオ制作、データ分析、ウェブアプリケーション開発など多様な業務が測定対象です。OSWorld 2.0では20.6%の精度にとどまっていますが、OSWorld 1.0は2025年7月に約30%だったのが2026年6月には約75%(MiniMax M3)まで向上した実績があります。

この記事についてAIに質問する →

背景と解説

この報道は 3 つの異なるベンチマークから、AI システムが自動化できる業務と複雑さの領域が加速度的に拡大していることを示しています。Fable による GPU カーネル設計の成功は、AI が研究開発自体を担える段階に入ったことを象徴しており、これまで人間の研究者が行ってきた基礎的な最適化作業が自動化され始めたことを意味します。

Remote Labor Index の成長率(8 カ月で 4 倍以上)は、単なるベンチマークの数値上昇ではなく、実務的で経済的価値のあるオンライン業務が AI に置き換わる速度を直接測定しています。同時に OSWORLD 2.0 は、AI が単一のタスクではなく、複数のソフトウェアを組み合わせた多段階の業務フロー(ドキュメント作成、金融分析、顧客対応など)を実行できる段階へ移行していることを示しており、本文では「現在のエージェント(自分で判断して作業するAI)は信頼性に遠く及ばない」と明記されていますが、OSWORLD 1.0 の改善実績を踏まえれば同様の向上軌跡が予想されます。

本文が強調する論点は「人間の革新速度がAI能力の拡張速度に追いつけるか」という雇用・経済の根本的な問いであり、これら 3 つのベンチマークが追跡する数値は、その問いを判断する基準となると位置付けられています。

よくある質問

Remote Labor Indexで測定している業務の例は何ですか?
3D・CAD、建築、グラフィック設計、ビデオ・アニメーション、オーディオ、データ分析、ウェブアプリケーション開発などです。具体的には、エンゲージリングの宝石を付け替えて 3D モデルと写真画像をレンダリングする、2D アニメーション広告の製作、スキャンした図面から間取り図や家具レイアウト案、フォトリアルなレンダリング画像を作成するといったタスクが含まれます。
OSWORLD 2.0 のタスクが 1.0 から何が変わったのですか?
OSWORLD 1.0 の中央値が約 2 分だったのに対し、OSWORLD 2.0 の中央値はおよそ 1.6 時間で、約 48 倍に長くなっています。また使用するソフトウェアが大幅に拡張され、Slack、LinkedIn、Shortcut、REAPER、MuseScore、WPS、GitLab、Overleaf、AWS など 1.0 にはなかったツールが追加されました。
OSWORLD 2.0 で現在のAIモデルはどの程度の成功率ですか?
Claude Opus 4.8(最大思考と一括ツール呼び出し設定)で 20.6%(完全精度)と 54.8%(部分点精度)に留まっています。ただし OSWORLD 1.0 は 2025 年 7 月に約 30% だったのが 2026 年 6 月に約 75%(MiniMax M3)まで向上した例があるため、今後の改善が予想されます。
LINEで送る

こうしたAIニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dellが再び業績見通しを上方修正Top Companies AI · 2時間前
  • デル、AIサーバー好調で通期売上高見通しを上方修正Top Companies AI · 2時間前
  • ウォール街大手3行、弁護士報酬の値下げ要求へTop Companies AI · 2時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

次の記事へAnthropic、チップ自社開発でAI推論コスト削減へ