AIToday
大規模言語モデルAIコーディングAmazon AI Blog掲載日時: 2026年10月6日 1:00

AgenticRetrieveStream開始 Amazon Bedrock Managed Knowledge Basesで

LINEで送る
AgenticRetrieveStream開始 Amazon Bedrock Managed Knowledge Basesで

3つのポイント

  1. 何が起きたか

    AWSがAmazon Bedrock Managed Knowledge Basesでエージェント検索を提供開始。maxAgentIterationはデフォルト5、2〜3では単発検索相当になる。

  2. なぜ重要か

    単一ベクトルでは複数意図を代表できず、証拠が十分かを問う工程がなかった。分解により難しい質問ほど再現率が向上するため、この仕組みが有効とみられる。

  3. 注目点

    エージェント検索は呼び出しあたりのコストが高く、レイテンシも大きい。用途に応じて標準検索と使い分けることが焦点となる。

誰に効くか大規模なRAGシステムを運用する企業の情報システム部門やAIエンジニアは、複合的な問い合わせに対して検索の再現率を高められる一方、コスト増を踏まえたルーティング設計が必要になる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

従来のRAGは、質問全体を1つのベクトルに埋め込み、類似度検索で上位チャンクを取得する方式が主流だった。しかし「2つのサービスを3つの観点で比較する」ような質問は、実質的に6つの意図を含む。1つのベクトルではその平均を取るしかなく、上位5件では6つの意図のうち2つを取りこぼすことがAWSの検証で示されている。取得件数を10件に増やせば6つすべてをカバーできるが、同じ観点が重複して取得され、無関係なチャンクも混ざるという無駄が生じる。

エージェント検索は、この構造的な限界に対処する。質問をサブクエリに分解し、それぞれを検索し、得られた証拠が十分かを判断し、足りなければ再度検索する。langchain-awsパッケージはこれを関数として公開しており、LangChainのチェーンに組み込むにはRunnableLambdaで包む必要がある。トレースイベントで計画内容を確認するには、boto3で直接APIを呼び出す。

この仕組みは、単発検索より呼び出しあたりのコストが高く、レイテンシも大きい。複数のモデル呼び出しが発生するためだ。したがって、すべてのトラフィックをエージェント検索に流すのではなく、質問の形状に応じて安価な標準検索と使い分けることが現実的とみられる。エージェント検索が真価を発揮するのは、分解すべき要素がある複合的な質問であり、単純な質問ではコスト増に見合わない可能性がある。

よくある質問
標準検索とエージェント検索はどう使い分ける?
短く明確な質問にはRetrieve APIが安価で高速、複合・比較・探索的な質問にはAgenticRetrieveStreamが適する。クエリの形状でルーティングするのが推奨される。
maxAgentIterationはどう設定すべき?
2〜10まで設定でき、デフォルトは5。2〜3では分解が行われず単発検索相当になるため、デフォルトのままがよい。分解は4から始まる。
エージェント検索は複数のナレッジベースを扱える?
1回のリクエストで最大5つのナレッジベースを登録でき、各ナレッジベースに付けた自然言語の説明を使ってサブクエリを振り分ける。Retrieve APIにはこの機能はない。
Amazon AI Blog元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へCohereのNorth 2、基盤刷新