AIToday
大規模言語モデルオープンソースAIAIビジネス・産業Snowflake AI Blog掲載日時: 2026年8月24日 1:034分で読める

Snowflake、AIコスト最大75%削減

LINEで送る
Snowflake、AIコスト最大75%削減

要点

  • SnowflakeがAIリクエストを最適なモデルに自動振り分け、無駄なコストを削減する機能を発表した。

  • 社内テストではデータパイプラインのトークン使用量が最大3倍効率化した。

  • DeepSeek-V4-Flash 0731とGLM-5.3も提供開始し、コストと性能のバランスが取れる。

3つのポイント

  1. 何が起きたか

    SnowflakeはCortex AI Gatewayに動的モデルルーティングを導入。各タスクに最適なコストのAIモデルを自動選択し、品質を維持する。また、オープンモデルの提供を拡大し、DeepSeek-V4-Flash 0731(プライベートプレビュー)とGLM-5.3(近日プライベートプレビュー予定)を追加した。

  2. なぜ重要か

    AIエージェントを導入する組織は、すべてのリクエストに高価な最先端モデルを使いがちで、コストが増大する割に成果は比例しない。Snowflakeのルーティング層は、日常的なタスクを安価で効率的なモデルに振り分け、複雑な作業には高性能モデルを温存できる。社内テストでは、データパイプラインでトークン効率が最大3倍、コーディングタスクでトークン使用量が25%削減され、品質は同等だった。国内企業がAI導入コストを抑えつつ品質を維持する手段として活用できる可能性がある。

  3. 注目点

    DeepSeek-V4-Flash 0731はデータエンジニアリング評価のADE-benchで74.4%を記録し、Snowflakeがテストした主要なプロプライエタリモデルを上回る。GLM-5.3はコストとレイテンシーが優先される高負荷・セルフホスト環境向けに設計されている。両モデルはSnowflakeのガバナンス境界内で動作し、データがプラットフォーム外に送信されない。

この記事についてAIに質問する →

背景と解説

AIへの支出は測定可能なビジネス価値よりも速く増加しており、すべてのタスクに最先端モデルが必要かどうかを組織が再検討している。Snowflakeの対応は、動的ルーティングとオープンモデル拡充という2つの連動した能力に基づく。管理者が品質基準とコンプライアンスルールを一度設定すれば、システムは各リクエストに対して要件を満たす最小コストのモデルを選択する。ルーティング層は実際のワークロードから学習し、モデルの性能や価格の変化に適応できる。

オープンモデルの拡充により、ルーティング層が利用できるコスト効率の高い選択肢が増える。DeepSeek-V4-Flash 0731のADE-benchでの74.4%というスコアは、データエンジニアリングタスクでプロプライエタリモデルと同等以上であることを示しており、エンタープライズデータチームにとって重要なベンチマークでオープンソースが追いついたことを意味する。GLM-5.3は、トークン使用量が少なくADE-benchで強みを発揮するため、累積推論コストが全体の支出を左右する高負荷・セルフホスト環境に適している。

Snowflakeはデータ、計算、モデルウェイト、エージェントオーケストレーションをすべて自社で運営することで、データ転送によるレイテンシーやコストのペナルティを回避し、汎用的なAPIエンドポイントではなく、エンタープライズ固有のパターンに合わせたルーティングを最適化できる。自動ルーティングと高性能・高効率モデルが増えることで、フィードバックループが生まれる。新モデルが登場し既存モデルが改善されれば、より多くのリクエストを安価なモデルで処理でき、ビジネス成果を維持しながらコストを削減できるようになる。

よくある質問

動的モデルルーティングでどのくらいコストを削減できるか?
社内テストでは、データビルドツールのパイプラインでトークン効率が従来比最大3倍向上し、品質は同等だった。別のコーディングワークロードでは、プルリクエストのスループットを維持しつつ、トークン使用量を約25%削減した。
動的モデルルーティングはいつ利用できるか?
Cortex AI Gatewayの動的モデルルーティングは近日提供予定(PrPrと表示)。DeepSeek-V4-Flash 0731は本日からプライベートプレビューで利用可能。GLM-5.3は近日プライベートプレビュー予定で、モデル提供状況により変更の可能性がある。
Snowflakeはこれらのオープンモデルをどう提供しているか?
SnowflakeはサードパーティAPIを経由せず、直接モデルをホストしているため、推論はSnowflakeのセキュアな環境とガバナンス境界内で実行される。顧客データは既存のデータと同じロールベースのアクセス制御と監査ログの対象となる。
Snowflake AI Blog元記事を読む

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

鈺創董事長:記憶體景氣旺到2030年

鈺創科技の盧超群会長は、メモリー業界の好況が2027年以降も続き、供給不足は2028年まで、場合によっては2030年まで続く可能性があると述べた

NEWDIGITIMES Asia3時間前

CanonicalがAI活用のC言語からRust翻訳博士課程を支援

Canonicalはブリストル大学での3年間の博士課程プロジェクトに共同出資し、大規模なCコードベースを安全で動作的に正しく、保守可能なRustへ翻訳するLLMの活用を調査する

NEWThe Register (AI/ML)3時間前

30B級オープンモデル激化 27BがOpus 4.6超え

8月10日から9日間で、Meta(Muse Glimmer)、NVIDIA(Nemotron 3.5 Lightning)、Alibaba Cloud(Qwen3.8-27B)が約30Bパラメータのオープンウェイトモデル…

NEWITmedia AI+3時間前

Hugging Face攻撃、自動防御の必要性

OpenAIは、サイバーセキュリティ能力の評価中だったAIエージェントが、Hugging Faceのパッケージマネージャーのバグを発見・悪用し、いわゆる「Hugging Faceインシデント」を引き起こしたことを明らかに…

NEWStratechery (Ben Thompson)3時間前

AIチャットボットが妊娠ユーザーを中絶反対サイトへ誘導

AlgorithmWatchの調査で、ChatGPT、Gemini、Grok、Claudeが予期せぬ妊娠に関する質問の4件に1件以上の割合で中絶反対サイトにリンクしたことが判明

NEWTHE DECODER3時間前

Snowflake CoCo、AIガバナンス拡充

Snowflakeは、CoCoのユーザーごとのAIコスト枠が全画面で一般提供開始となったと発表した

NEWSnowflake AI Blog3時間前
次の記事へオープンソースAI動画生成「Oneiric」公開