AIToday
大規模言語モデルAI安全性・アラインメントTHE DECODER掲載日時: 2026年8月29日 22:033分で読める

Google WikiSkill、AIが失敗記憶

LINEで送る
Google WikiSkill、AIが失敗記憶

要点

  • GoogleのWikiSkillはAIエージェントに失敗の永続記憶を与える。

  • 5つのベンチマークで他手法を上回り、平均精度を最大18.6ポイント向上。

  • 継続再学習なしで学ぶ回避策だ。

3つのポイント

  1. 何が起きたか

    Googleの研究者が、AIエージェントに過去の失敗や成功した戦略を永続的に記憶させるフレームワーク「WikiSkill」を発表した。エージェントの作業領域を3層に整理する。実行トレースを保存する「Raw Layer」、リセットされない蒸留知識を保持する「Wiki Layer」、パフォーマンスを損ねた場合にロールバック可能な手順命令を格納する「Skill Layer」で構成される。

  2. なぜ重要か

    研究ではWikiSkillが他のスキル進化手法を一貫して上回った。5つのベンチマークで平均して、Gemini-3.5-Flashは49.5%から68.1%、Qwen-3.6-27Bは39.4%から63.3%に向上した。大規模モデルほど恩恵が大きかったが、WikiSkillを使う小規模モデルは、使わない大規模モデルの性能に匹敵できた。日本国内のAI開発企業は、過去の失敗を記憶する手法で小規模モデルの性能向上を実現できる可能性がある。

  3. 注目点

    フレームワークの効果はタスクの種類によって異なり、数学や表計算タスクで最も大きな改善が見られた。あるモデルが開発したスキルは別のモデルにも転用でき、受け取る側のモデル自身のスキルより優れる場合もあったが、転用の可否はケースバイケースで確認すべきだ。

この記事についてAIに質問する →

背景と解説

WikiSkillはAIエージェントの中核的な制約——各実行から真に継続的に学習しない——に取り組む。このフレームワークでは、エージェントがタスクごとに自分自身へのより良い指示を書き出し、永続的なWikiに保存することで、知識を蓄積していく。洗練された方法ではないが、研究のテストでは効果が実証された。

アーキテクチャは経験(生のトレース)、知識(Wiki)、行動(スキル)を分離する。Wiki Maintainerが実行トレースからパターンを蒸留し、Skill Proposerが変更を提案し、ゲーティング機構が別のセットで検証してから展開する。変更が失敗すればロールバックされるが、Wikiには失敗した試みも将来の参照用に残る。

特筆すべきは、スキルがモデル間で転用でき、受け取る側のモデル自身のスキルを上回る場合もあったことだ。ただし研究者らは、常に有益とは限らないため、転用の可否はケースバイケースで確認するよう助言している。このアプローチはAndrej Karpathyの「LLM Wiki」概念に着想を得て、自動スキル開発に応用したものだ。

よくある質問

WikiSkillの3つの層とは?
Raw Layerは実行トレース全体を、Wiki Layerはリセットされない蒸留された洞察を、Skill Layerはパフォーマンスを損ねた場合にロールバック可能な実行中命令を保持する。
WikiSkillは小規模モデルでも機能するか?
Qwen-3.5-4Bのような小規模モデルは長い多段階タスクに苦戦したものの、改善は見られた。WikiSkillを使う小規模モデルは、使わない大規模モデルに匹敵できた。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • AIによる失業は米労働者のわずか3%Fortune AI · 1時間前
  • 自宅PCで無料オフラインのチャットボットWIRED AI · 1時間前
  • AIエージェント、Solana版提供へYahoo Finance AI · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAIによる失業は米労働者のわずか3%