AIToday
大規模言語モデルAIビジネス・産業GIGAZINE AI掲載日時: 2026年10月6日 13:00

安いAI、32%で高くつく スタンフォード大などが8モデル検証

LINEで送る
安いAI、32%で高くつく スタンフォード大などが8モデル検証

3つのポイント

  1. 何が起きたか

    スタンフォード大学やMicrosoft Researchなどの研究チームが最先端AIモデル8種類に6800以上のタスクを実行させた結果、32%のケースで低価格モデルの総コストが高くなった。

  2. なぜ重要か

    複雑なタスクでは高性能モデルのほうが速く安く完了できる場合があり、価格だけでは安さを判断できないとみられる。

  3. 注目点

    同一モデルでも試行ごとにコストが変動し、最も高い試行が最も安い試行の9.7倍になった例もある。判断の誤りがコスト増につながる点が焦点だ。

誰に効くかAIの導入や調達を担当する情報システム部門は、安価なモデルを選ぶ際に総コストを試算する必要がある。モデル選定の担当者にとっては、単価だけでなくタスク完了までの手数を見極めることが重要になる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

研究チームは、同じタスクを低価格モデルと高価格モデルがどのように実行するのかを調べるため、最先端のAIモデル8種類に数学、プログラミング、科学など6800以上のタスクを実行させた。その結果、32%のケースで低価格モデルのほうが最終的な総コストが高くなる現象が確認された。原因として研究チームが挙げたのは、AIの「考えすぎ」と「行動しすぎ」である。複雑なタスクだと推論回数や行動回数が増え、性能が高いモデルのほうが速く安く実行できる場合があるという。

具体的な例も示されている。Gemini 3 Flashが6万トークンを超える思考トークンを消費したのに対し、より高性能なGPT-5.4は25トークンで解決したケースがあった。また、同一の指示を同じモデルで繰り返し実行すると、最も高い試行が最も安い試行の9.7倍になった例もあった。モデルの性能とコストは単純な比例関係になく、タスクの性質や実行のばらつきが総コストを左右するとみられる。

筆頭著者のリンジャオ・チェン氏は「価格だけを見て、どのモデルが安いのかを判断すべきではありません」と述べている。安価なモデルを選ぶ判断が、結果的にコスト増につながる可能性がある点が、導入を検討する担当者にとっての論点となる。

よくある質問
どんなタスクで安いモデルのほうが高くつきましたか?
YouTube動画を毎フレーム分析するタスクでは、Gemini 3.1 Proが85ステップで完了したのに対し、Gemini 3 Flashは1000ステップ以上かかっても完了できなかった。費用は前者が1ドル、後者が14ドルだった。
同じモデルでもコストは変わりますか?
変わる。研究チームが同一の指示を同じモデルで繰り返し実行したところ、最も高い試行が最も安い試行の9.7倍になった例があった。
なぜ安いモデルのほうが高くつくのですか?
研究チームはAIの「考えすぎ」と「行動しすぎ」が原因だと指摘している。複雑なタスクでは推論回数や行動回数が増え、高性能モデルのほうが速く安く実行できる場合がある。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へNetAppのNovus、100TB/s突破