AIToday
大規模言語モデルオープンソースAIAIビジネス・産業Snowflake AI Blog掲載日時: 2026年8月24日 19:00

Snowflake、動的モデルルーティング発表

LINEで送る
Snowflake、動的モデルルーティング発表

3つのポイント

  1. 何が起きたか

    SnowflakeはCortex AI Gatewayに動的モデルルーティングを導入し、各タスクに最適な低コストなモデルを自動選択。オープンモデルポートフォリオも拡充し、DeepSeek-V4-Flash 0731(プライベートプレビュー)とGLM-5.3(近日公開)を追加した。

  2. なぜ重要か

    初期テストでは、dbtパイプラインのワークロードでトークン効率が最大3倍向上し、コーディングワークロードでは約25%のトークン削減を達成しながら品質を維持。AIモデルの実行コスト(推論コスト)を削減しつつ、成果を損なわない効果が期待できる。国内のAI活用企業は、モデル選定の手間を減らしつつ推論コストを抑えられる可能性がある。

  3. 注目点

    DeepSeek-V4-Flash 0731はADE-benchで74.4%を記録し、テスト済みの主要プロプライエタリモデルを上回る。GLM-5.3は近日公開予定で、セルフホストが可能なためデータを環境内に保持できる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Snowflakeの新機能は、タスクに必要な以上のAI性能にコストを払うという一般的な課題に対応する。各リクエストを品質要件を満たす最も安価なモデルにルーティングすることで、動的モデルルーティングは成果を損なわずにコストを削減できる。社内テストではトークン消費が大幅に減り、そのまま推論コストの削減につながる。

DeepSeek-V4-FlashやGLM-5.3などのオープンモデルの拡充により、ルーターはより効率的な選択肢を得る。DeepSeek-V4-FlashのADE-benchでの高スコアは、オープンソースモデルがデータタスクで競争力を持つことを示し、コストパフォーマンスの向上が期待される。Snowflakeはこれらのモデルを自社ホストすることで、データをガバナンス境界内に保ち、転送コストも削減する。

このアプローチは時間とともに効果が蓄積する設計だ。使用量に応じてルーティング精度が上がり、新しいモデルが登場するたびに、ビジネス成果あたりの平均コストが下がる。ユーザーはアプリケーションを再構築したり、ルーティングロジックを手動で管理する必要はなく、Snowflakeがルーティング層を維持し、モデルの変更に自動対応する。

よくある質問
動的モデルルーティングはどのように機能するか?
各タスクを自信を持って完了できる最も低コストなモデルを選択し、単純なタスクは効率的なモデルへ、複雑なタスクは最先端モデルへ振り分ける。管理者承認済みモデルのみを対象とし、各ルーティング決定はログに記録される。
DeepSeek-V4-Flash 0731の性能は?
ADE-benchで74.4%を記録し、テスト済みの主要プロプライエタリモデルを上回る。現在CoCoでプライベートプレビューを提供中。
Snowflake AI Blog元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へ単純な実験でAIの自然特徴を発見