AIToday
大規模言語モデルAIコーディングZenn AI/ML掲載日時: 2026年10月10日 10:00

人とAIの役割を分ける開発手法

LINEで送る
人とAIの役割を分ける開発手法

著者の「契約ループ開発」は作業を意図・契約・ループの3層に分ける。人が決めるのは何のために作るかと何をもって完成とするかだけで、実装・検証・合流はAIが担う。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

この手法は特定のギャップへの応答として示されている。AIはコードを速く書くが、そのコードが正しいかの確認はほとんど速くならない。検証が今も人かテストに委ねられているからだ。著者は3つの外部シグナルを挙げる。ただし監督と精査は減らず増える。2025年のDORA調査は約5,000人の技術者を対象に、AIを主に増幅器と位置づける。組織の強みも弱みも拡大するという意味だ。そして「ループエンジニアリング」は、著者が査読中とされるarXivプレプリントに由来するとする用語で、毎回エージェントに指示するのではなく、指示を出すシステムを設計する。

著者のこれら3つについての読みは個人的解釈だと明示されている。AIがより多く書くほど、作業を検証し止める仕組みの設計が結果を決める。具体的な答えは固定された役割の組だ。verifyが合否を持ち、stop-gateがループを止めるかを持ち、merge-gateがコードをマージするかを持つ。stop-gateはAIが終わろうとしたときにフックとして走る。著者はClaude CodeのStopフックを使う。検証が失敗すれば終了をブロックし、失敗をAIに返す。詰まったループが永遠に回らないよう、stop-gateは失敗を指紋化し、同じ失敗が繰り返されたとき人に引き継ぐ。ここでは3回だ。

自律度は変更が触れるファイルパスで機械的に設定する。認証やデータベース移行に関わる箇所は高リスクと設定し常に人の承認を要する。何にも一致しない変更は低リスクだ。昇格の基準は直近マージの手戻り率とマージ後不具合で、コミットトレーラーから概算で数える。著者は撤去も第一級の実践として描く。すべての構成要素はどのモデルの限界を前提しているかを記録し、暫定的な要素は四半期ごと、または新モデル到来時に1つずつ撤去し、評価ケースを再実行する。Anthropicのエンジニアリングブログも同様の見方をしていると引用される。構成要素はモデルが単独でできないことへの前提を埋め込み、その前提は古くなる。

よくある質問
契約ループ開発で人が決めることは何か。
意図(何のために作るか)と契約(何が起きれば完成とするか)の2つだけ。どう作るかは人もルールも指定しないと著者は書く。
AIの作業の合否やマージを決めるのは何か。
3つの固定スクリプト。verifyが合否、stop-gateがループを止めるか、merge-gateがマージ可否を決める。書かれたルールやAIの自己判断は結果を決めない。
自律度はどう上がるのか。
A1(全変更に人の承認)からA2(低リスクは自動マージ可)、A3(低・中)へ進む。基準は直近マージの手戻り率とマージ後不具合で、当初は20。高リスクは常に人の承認が要る。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

IBM、AIエージェント管理基盤の必要性を強調

IBMのBruno Aziza氏は、従業員のAIエージェント数が企業の管理能力を上回るため調整基盤が必要だと述べた

NEWSiliconANGLE AI1時間前

AI進歩はエンジニアリングとインフラで加速

Nathan Lambert氏がエッセイを公開し、AIの進歩はエンジニアリングとインフラの向上で加速すると主張

NEWInterconnects (Nathan Lambert)1時間前

Google DeepMind、タンパク質解明は未完了と

Google DeepMindのPushmeet Kohli氏は、AlphaFoldはタンパク質フォールディングを解いていないと述べた

NEWLatent Space1時間前

台帳を汚さぬ試し打ち機能を新設、大型株は38%で却下

9月22日、チャート画面から任意の銘柄を試せる「試し打ち(sandbox)」機能を新設し、大型株を実機検証したところ確度38%で却下、予測台帳は76件のまま維持された

NEWQiita 機械学習1時間前

漏洩対応はまず範囲の特定から

臨床工学技士でAIエンジニアの遠藤太一氏がZennで、漏洩対応の第一歩は範囲の定義だと述べ、AnthropicのClaude Codeソース漏洩に関する公式声明を引用した

NEWZenn AI/ML1時間前

Claudeに3問2度反論、6回とも正解を訂正せず

AIレシピニュースレターの編集チームがClaudeに鉄と羽毛の重さ比べ、モンティ・ホール問題、誕生日のパラドックスの3つを出し、それぞれ2度ずつ反論した

NEWZenn AI/ML1時間前
次の記事へUkraine