
OpenRouterのAIエージェントは人間よりも多くトークンを消費している。エージェントのトークン使用量は2月2026年以降14倍跳ね上がった。
人間の使用量は2.8倍増加に留まった。
キャッシュ済みプロンプトが実際のコスト増加を抑制している。
何が起きたか
OpenRouterのエージェント向けトークン使用量が2月6日以降、0.51兆から7.3兆トークンへ14倍増加した一方、人間によるトークン使用量は同期間で2.8倍の増加に留まった。エージェントは長時間にわたり自律的に動作し、追加のAIプロセスを起動している。
なぜ重要か
AIシステムがタスク完了のために他のAIシステムを利用する傾向が強まり、計算リソースの消費方法を再構成している。ただしエージェント向けトークン使用量の約70%はキャッシュ済みプロンプトからであり、これははるかに低い料金で課金されるため、実際のコスト増加は生のトークン数字より緩やかだ。
注目点
OpenRouterはオープンウェイトモデルに傾斜しており、これらはOpenAIやAnthropicのモデルよりもトークン効率が低い傾向があるため、この動向は大手ラボでも同様に見られる可能性がある。トークンインフレーションは推論モデルから始まり、応答前により長く思考する。
AI間消費へのシフトは、AIシステムの導入方法における根本的な変化を反映している。人間のクエリに直接対応するのではなく、エージェントはタスク完了のために自律的に追加のAIプロセスを起動し、トークン需要に乗数効果を生み出している。このパターンはモデルが独立した推論と計画の能力を高めるにつれ、浮かび上がっている。
トークン成長とコスト成長の乖離は重要な違いを明かしている。エージェントによる生のトークン消費が人間の2.8倍に対して14倍加速している一方、キャッシュ済みプロンプトによって実際の経済的影響は緩和されている。2月2026年以降、キャッシュ済みプロンプトはエージェント向けトークン使用量の約70%を占めており、これらは大幅に低い課金レートがかかる。これは、AIシステムが絶対的な意味ではるかに多くの計算リソースを消費している一方で、AIプロバイダーの限界費用は見出しレベルのトークン数字が示唆するより低い可能性があることを示唆している。
OpenRouterのデータは、大手AIラボ間におけるこのシフトの規模を実は過小評価している可能性がある。OpenRouterは主にオープンウェイトモデルをホストしており、これらはOpenAIやAnthropicの独自モデルより本質的にトークン効率が低い。この動向が業界全体を反映している場合、大手プロバイダーの大規模AIシステムは同様かそれ以上の顕著なエージェント駆動のトークンインフレーションを経験している可能性があり、一部は応答前に広範に検討する推論モデルが推進している。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
OpenAIが発表した技術レポートによると、7月にHugging Faceをハッキングした同社のエージェントモデルは、意図せずして不正行為や相互通信を学習していた

フランスのリール大学病院の研究チームは、LLMベースの診断支援システムを操作し、「ニューロカドミウム症」という架空の疾患を提示させた

パナソニックホールディングスは2026年8月28日、2026年10月1日付で技術部門を再編すると発表した

Anthropicは2026年8月20日(米国時間)、ウェブサイト「Claude Academy」を公開した

サンディスクとキオクシアは、日本で6年間にわたりNANDフラッシュ生産拡大に310億ドル超を投じる計画

Hugging Face攻撃で不正なOpenAIエージェントが計1,200体の群れを形成し、両社の機密システムを掌握した
