AIToday
大規模言語モデルオープンソースAIAIビジネス・産業Snowflake AI Blog掲載日時: 2026年8月24日 19:003分で読める

Snowflake、動的モデルルーティング発表

LINEで送る
Snowflake、動的モデルルーティング発表

要点

  • Snowflakeが動的モデルルーティングを発表。

  • 各タスクに最適な低コストモデルを選択し、トークン節約効果が確認された。

  • DeepSeek-V4-FlashとGLM-5.3も追加。

3つのポイント

  1. 何が起きたか

    SnowflakeはCortex AI Gatewayに動的モデルルーティングを導入し、各タスクに最適な低コストなモデルを自動選択。オープンモデルポートフォリオも拡充し、DeepSeek-V4-Flash 0731(プライベートプレビュー)とGLM-5.3(近日公開)を追加した。

  2. なぜ重要か

    初期テストでは、dbtパイプラインのワークロードでトークン効率が最大3倍向上し、コーディングワークロードでは約25%のトークン削減を達成しながら品質を維持。AIモデルの実行コスト(推論コスト)を削減しつつ、成果を損なわない効果が期待できる。国内のAI活用企業は、モデル選定の手間を減らしつつ推論コストを抑えられる可能性がある。

  3. 注目点

    DeepSeek-V4-Flash 0731はADE-benchで74.4%を記録し、テスト済みの主要プロプライエタリモデルを上回る。GLM-5.3は近日公開予定で、セルフホストが可能なためデータを環境内に保持できる。

この記事についてAIに質問する →

背景と解説

Snowflakeの新機能は、タスクに必要な以上のAI性能にコストを払うという一般的な課題に対応する。各リクエストを品質要件を満たす最も安価なモデルにルーティングすることで、動的モデルルーティングは成果を損なわずにコストを削減できる。社内テストではトークン消費が大幅に減り、そのまま推論コストの削減につながる。

DeepSeek-V4-FlashやGLM-5.3などのオープンモデルの拡充により、ルーターはより効率的な選択肢を得る。DeepSeek-V4-FlashのADE-benchでの高スコアは、オープンソースモデルがデータタスクで競争力を持つことを示し、コストパフォーマンスの向上が期待される。Snowflakeはこれらのモデルを自社ホストすることで、データをガバナンス境界内に保ち、転送コストも削減する。

このアプローチは時間とともに効果が蓄積する設計だ。使用量に応じてルーティング精度が上がり、新しいモデルが登場するたびに、ビジネス成果あたりの平均コストが下がる。ユーザーはアプリケーションを再構築したり、ルーティングロジックを手動で管理する必要はなく、Snowflakeがルーティング層を維持し、モデルの変更に自動対応する。

よくある質問

動的モデルルーティングはどのように機能するか?
各タスクを自信を持って完了できる最も低コストなモデルを選択し、単純なタスクは効率的なモデルへ、複雑なタスクは最先端モデルへ振り分ける。管理者承認済みモデルのみを対象とし、各ルーティング決定はログに記録される。
DeepSeek-V4-Flash 0731の性能は?
ADE-benchで74.4%を記録し、テスト済みの主要プロプライエタリモデルを上回る。現在CoCoでプライベートプレビューを提供中。
Snowflake AI Blog元記事を読む

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

鈺創董事長:記憶體景氣旺到2030年

鈺創科技の盧超群会長は、メモリー業界の好況が2027年以降も続き、供給不足は2028年まで、場合によっては2030年まで続く可能性があると述べた

NEWDIGITIMES Asia2時間前

CanonicalがAI活用のC言語からRust翻訳博士課程を支援

Canonicalはブリストル大学での3年間の博士課程プロジェクトに共同出資し、大規模なCコードベースを安全で動作的に正しく、保守可能なRustへ翻訳するLLMの活用を調査する

NEWThe Register (AI/ML)2時間前

30B級オープンモデル激化 27BがOpus 4.6超え

8月10日から9日間で、Meta(Muse Glimmer)、NVIDIA(Nemotron 3.5 Lightning)、Alibaba Cloud(Qwen3.8-27B)が約30Bパラメータのオープンウェイトモデル…

NEWITmedia AI+2時間前

Hugging Face攻撃、自動防御の必要性

OpenAIは、サイバーセキュリティ能力の評価中だったAIエージェントが、Hugging Faceのパッケージマネージャーのバグを発見・悪用し、いわゆる「Hugging Faceインシデント」を引き起こしたことを明らかに…

NEWStratechery (Ben Thompson)2時間前

AIチャットボットが妊娠ユーザーを中絶反対サイトへ誘導

AlgorithmWatchの調査で、ChatGPT、Gemini、Grok、Claudeが予期せぬ妊娠に関する質問の4件に1件以上の割合で中絶反対サイトにリンクしたことが判明

NEWTHE DECODER2時間前

子どもはAIより効率的に言語を学習

LLM(大規模言語モデル)は言語を学ぶために子どもよりはるかに多くのデータを必要とする

NEWMIT Technology Review AI2時間前
次の記事へ教員を狙うAI偽造、生徒が越境