AIToday
大規模言語モデルSiliconANGLE AI掲載日時: 2026年9月10日 1:003分で読める

Databricks新モデル、Claude Sonnet 5の2倍速

LINEで送る
Databricks新モデル、Claude Sonnet 5の2倍速

3つのポイント

  1. 何が起きたか

    Databricksが検索モデルAdaptive Instructed-Retrieverを拡張。

  2. なぜ重要か

    逐次検索ステップ数を動的に決定し、証拠が十分になるまで継続。マルチステップのエージェント要求における応答時間と計算コストを削減する。

  3. 注目点

    ペナルティの重さが性能を左右。顧客はチェックポイントを選べるが、パラメータ数や価格、一般提供時期は非公表。

誰に効くかDatabricksのGenie Code、Genie One、Genie Agents上でデータエージェントを構築するエンタープライズ開発者が影響を受ける。新モデルのチェックポイントを選択することで、特定のワークロードに応じて検索速度と品質のバランスを調整でき、マルチステップ検索のコスト削減につながる可能性がある。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Databricksの今回の発表は、従来の検索拡張生成を改善するためにユーザー指示や例、データソーススキーマを検索および応答生成プロセスに組み込んだInstructed-Retriever-1のリリースに続くもの。そのアーキテクチャは、エンタープライズQ&Aテストで従来のRAGと比較し、性能が70%以上向上したとされる。新モデルはこの一連の作業を拡張し、マルチステップ検索の遅延とコスト問題に取り組む。このタスクでは通常、エージェントが証拠を収集するにつれてクエリを調整する必要があり、各ステップが応答時間と計算コストを増加させる。

Databricksが説明したテストでは、Adaptive Instructed-Retrieverは、企業が2022年度の損益計算書にリストラ費用を明示しなかったことを2つの検索ステップで検証した一方、Claude Sonnet 5は3ステップ、GPT-5.6 Lunaは4ステップを要した。同社は合成のエンタープライズ検索環境を使用してモデルをトレーニングし、正確な検索軌道を優先しつつ品質向上につながらない追加ステップにペナルティを課す報酬システムでオンライン強化学習を適用した。またDatabricksは、顧客がAI Runtimeを使用して自社データ向けに小型モデルを特化できると指摘し、タスク固有モデルが追加検索の価値を学習することで最先端システムと競争できることを示唆している。

Databricksとその顧客にとっての課題は、品質と遅延のトレードオフを中心に展開する。モデルのチェックポイント群はこの曲線上の選択肢を提供するが、同社はパラメータ数、価格、利用可能性を開示していない。主張もDatabricks独自のベンチマークに依存しているため、独立した検証が待たれる。実際のエンタープライズ環境での性能が、データエージェントを構築する開発者の間でこのアプローチが受け入れられるかどうかを左右するだろう。

よくある質問
Adaptive Instructed-Retrieverは検索をいつ停止するかどう決めるのか?
開発者が逐次検索ステップの最大数を設定し、モデルが要求ごとに必要な数を決定する。利用可能な証拠が十分と判断した時点で停止し、追加の検索が回答を改善する可能性がある場合は継続する。
モデルの性能比較に使われたベンチマークは?
結果は、さまざまなドメインと検索難易度を網羅する、内部・外部の7つの未公開ベンチマークを組み合わせたもの。比較はDatabricks独自のテストに基づき、第三者による検証はまだ行われていない。
SiliconANGLE AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dynatrace、Arize AIを買収SiliconANGLE AI · 6時間前
  • 100のファインチューニング、1GPUで1.5TBから19.3GBにDaily Dose of Data Science · 6時間前
  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 6時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

Dynatrace、Arize AIを買収

DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した

SiliconANGLE AI6時間前

100のファインチューニング、1GPUで1.5TBから19.3GBに

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する

Daily Dose of Data Science6時間前

OpenAIエージェントがRubyGems攻撃

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

Simon Willison's Weblog6時間前

Simon Willison氏、AIコーディングエージェントはソフトウェアエンジニアを終わらせないと語る

Simon Willison氏は、コーディングエージェントが1週間分の仕事を1時間でこなすことに多くの人(自身も含む)が実存的な危機を経験したが、そこを乗り越えたと書いた

Simon Willison's Weblog6時間前

AI偽証言で弁護士侮辱罪

ニューメキシコ州の弁護士Stephen Aaronsは、ChatGPTが作成した弁論要旨に架空の証人の偽証言が含まれていたとして、法廷侮辱罪で5,000ドルの制裁金を科された

Ars Technica AI6時間前

Perplexity、GPT‑6 Astraに本番系を一任

PerplexityがGPT‑6 Astraを使い、文書作成やソフトウェア改修、本番システムの監視を任せていると共同創業者のJohnny Ho氏が語った

OpenAI Blog6時間前
次の記事へブロードコムAI収益がカスタムチップで急増