
GitHub は Copilot コードレビューで、共通の CLI ツールを使い始めた際に効率が低下した問題を、ツール自体ではなく指示の見直しで解決しました。
査読の実践に合わせた指示に書き換えることで、約20%のコスト削減と品質維持を同時に達成しています。
何が起きたか
GitHub は Copilot コードレビューの指示を見直し、より詳細で査読作業に特化した内容に書き換えました。その結果、平均的なレビューコストが約20%低下しながら、レビュー品質は維持されるようになりました。
なぜ重要か
当初、より保守性の高い共通ツール(grep、glob、view)に置き換えたところ、コストが上昇し、検出される問題数が減少していました。しかし実は「ツール自体の問題ではなく、指示が汎用的なコーディングアシスタント向けに設計されており、査読という狭い目的には不適切だった」という点が明らかになり、指示を調整することで改善が可能だったことを示しています。
注目点
レビューの指示を「diff から始まる具体的な質問を立てる」「grep と glob で候補を絞り込んでから view で正確な証拠を読む」という査読特有のワークフローに変更することで、効率性と効果性の両立が実現しました。
GitHub Copilot コードレビューは、複数製品で使える共通ツールセット(grep、glob、view)を採用することでインフラを統一しようとしていました。ただし、これらのツールは元々 Copilot CLI のために設計されており、汎用的なコーディングアシスタント用の指示で動いていました。査読と汎用アシスタントは似た作業に見えますが、目的が大きく異なります。コーディングアシスタントは変更全体の影響を理解するため広く探索する傾向があり、査読者は diff から出発して問題の存在を判断するのに必要な最小限の証拠を求めます。
ベンチマークで問題が可視化されたのは、エージェントの探索経路を追跡できたからです。指示を査読特有のワークフロー(差分から始まり、検索で絞り込み、確認時だけ詳細を読む)に合わせることで、ツール自体の改善なしにコストと品質の双方の改善が実現しました。このことは、エージェントの性能が単に「より良いツール」を与えるだけでは向上せず、用途に適した指示が不可欠であることを示しています。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
OpenClawの生みの親であるPeter Steinberger氏と共同開発者らが週末、OpenClaw 2.0を発表

AIコーディングは、プロンプトエンジニアリング、コンテキストエンジニアリング、そして現在はハーネスエンジニアリングという3つの段階を経てきた

WorkdayはAIエージェントをGoogle CloudのGemini Enterpriseと統合し、従業員がGmailから直接、四半期業績レビューなどのタスクを開始できるようにする
ここ2年で、CursorやClaude Code、エージェント型ワークフローがDockerコンテナやIDE内で使われるようになり、コード構文の記述が大幅に容易になった

Metaが8月21日に米国でPocketを公開した

北京拠点のAI新興企業Z.aiは金曜日、最新モデルの詳細を公開した
