
何が起きたか
GitHubがCopilotのコスト効率を高めるため、未使用の行番号の削除や反復出力の圧縮など4つの変更を実施したと発表。1つの変更でモデル推論コストがオフラインで約5%、オンラインで約3%削減された。
なぜ重要か
同社はツール呼び出しごとのトークン数に注目すると逆効果で総コストが増えることを発見。個々の呼び出しではなくタスク全体の最適化が効率と品質のバランスに不可欠だ。国内のAI開発企業は、品質を保ちながら推論コストを削減する手法を検討する可能性がある。
注目点
プロンプト圧縮などの他の変更では、1ターンあたり約1,300トークンを節約。GitHubは、あるワークフローでトークンを節約する変更が別のワークフローではコスト増につながる可能性があるため、各変更を想定環境で検証する必要があると指摘する。
こういう要約が、毎朝あなたのメールに届きます。
GitHubの投稿は、ツール呼び出しではなく成果の最適化が鍵となるという原則を浮き彫りにしている。同社は、個々の応答を短縮すると、エージェントが出力を再読取したりコマンドを再実行したりする必要が生じ、余分な作業と高いコストを招くことを実証した。これは、シェル出力を短縮するユーティリティRTKがテストでトークン使用量を実際に増加させた事例で示された。
4つの変更(選択的出力圧縮、行番号プレフィックスの削除、メタプロンプティングによるプロンプト圧縮、バックグラウンド結果の直接配信)は、それぞれ慎重な評価を要した。例えば、プロンプト圧縮は当初逆効果で、エージェントが並列ではなく順次実行される原因となった。回帰テストの追加と指示の簡素化を経て初めて安全になり、1ターンあたり約1,300トークンの節約が実現した。
より広い教訓は、効率改善は実行される特定のワークフローで測定されなければならないということだ。コードレビューに有効な変更がCLI利用には悪影響を及ぼすこともあり得る。GitHubはまた、行番号の削除と出力圧縮により、レビューごとのプロンプトトークンがそれぞれ約5%削減され、品質の低下もなかったと報告。状況に応じた検証の重要性を強調している。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
エヌビディアのジェンスン・フアンCEOは、OpenAIが最新モデル「GPT-6 Astra」を発表したことを受け、汎用人工知能(AGI)が到来したと述べた

サウジアラビア政府系AI企業HUMAINは、CEOタレク・アミン氏の下でオープンAIモデルの中立的ハブとしての地位を確立し、米国・中国に続くAI超大国を目指している

アリババの研究部門がQwen-Drive 1.0を公開

NoMac.Appが、iOSアプリの公開パイプラインを完全クラウド上で提供開始

開発者がChatGPTに対し、同じリモートワークのシナリオを被験者の性別と役職だけ変えて判定させた

Google DeepMindは、Gemini 3.1 Proを使う100の自律型LLMエージェントに71問の数学問題を解かせた
