AIToday
ロボティクスAIコーディング主要企業のAIニュースTop Companies AI掲載日時: 2026年9月20日 6:30

NTTドコモ、AI-DLCでロボットMLを3日構築

LINEで送る
NTTドコモ、AI-DLCでロボットMLを3日構築

3つのポイント

  1. 何が起きたか

    NTTドコモのMIT部がAWSのAI-DLC Train The Trainerに参加し、模倣学習(IL)を強化学習(RL)で洗練させるロボットアームのパイプラインをRPD手法で3日で構築した。

  2. なぜ重要か

    Inceptionフェーズだけで11件の不整合を洗い出し、30件以上の構造化文書を生成した。設計が不確実で知識が散在するMLプロジェクトの手戻りをAI-DLCが削減できる可能性を示す。

  3. 注目点

    並行チーム開発でこの枠組みが機能するかは未検証——記事の後半ではTeam PinkとTeam Blueがパイプラインを並走させた模様を報告する。

誰に効くかこれは論文を動くパイプラインに変える必要があるML・ロボティクス研究チーム、特に強化学習とシミュレータ作業に不慣れなチームに響く。また、場当たり的なコーディングと構造化されたAI支援ワークフローを天秤にかけるエンジニアリングリーダーにも関係する。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

背景にあるのは応用機械学習でよくある悩みだ。研究論文がそのまま動くパイプラインになることはほとんどない。前提や暗黙の条件のわずかな違いは実装後に初めて表面化し、失敗した実験は高くつく。実世界で動作するAI(フィジカルAI)に取り組むNTTドコモのチームはまさにこれに直面していた——模倣学習モデルは10デモで成功率10%、データ増幅で45%まで上がったが、その後頭打ちになった。

チームはパイプラインをコーディング作業ではなく、AWSのAI-DLC枠組みで構造化すべき製品として扱うことを選んだ。これは計画の中心にAIを置きつつ、意思決定は人間が担う。Inceptionフェーズでは論文やドメイン資料をKiroツールに投入し、その周りでモブ形式で作業した。AIレビューはコードを書く前に、checkpoint形式の不一致、12次元対28次元の入力次元の衝突、アクションスケーリングの不整合といった問題を指摘した——まさにML作業で「コードは動くが出力が間違っている」として後から現れがちな類のエラーだ。

ここまでで示されたのは第1回、つまりInceptionフェーズであり、最終的な学習結果ではない。本当の試練はConstructionフェーズだ。そこでは2チームが並行して走り、一方は当初のスコープを放棄してAI-DLCの枠内で方向転換したと報じられている。構造化文書のアプローチが、調整の改善だけでなくMLの成果そのものを実際に高めるのか——第2回が答える構えのようだ。

よくある質問
NTTドコモが実際に構築したものは?
SO-101ロボットアーム向けのパイプラインで、模倣学習の知識を強化学習で改善する。全体を一つの製品として扱い、AI-DLCプロセスに従った。
ロボットアームに必要なデモデータ量は?
模倣学習で通常推奨される約50エピソードではなく10エピソードで開始。データ増幅により成功率を10%から45%へ引き上げた。
この文脈でのAI-DLCとは?
AIを開発プロセス全体に組み込む枠組みで、Inception、Construction、Operationの各フェーズがある。個人のVibe Codingと違い、チーム全体で共有できる構造化文書を生成する。
Top Companies AI元記事を読む
LINEで送る

「ロボティクス」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • GPT-6 Astra、危険任務100件中2件拒否THE DECODER · 9時間前
  • IFAトップ、中国勢5割に パナソニック・サムスン撤退ITmedia AI+ · 1日前
  • Vantora、フィジカルAIに1億ドル調達TechCrunch AI · 1日前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAI広告に批判殺到のバースデイ