
何が起きたか
さくらインターネットが10月8日、「さくらのAI Engine プライベートエディション」を開始。利用者の生成AIモデルを自社GPU基盤でホストし、閉域の専有環境でAPI提供する。
なぜ重要か
専有環境のため他の利用者の影響を受けず、推論基盤の構築から運用・監視まで同社が担い、利用者の運用負荷軽減が見込まれる。
注目点
サービス開始は10月8日で、GPU単位の月額定額課金となる。
誰に効くか主に影響を受けるのは、自社モデルやファインチューニング済みの生成AIモデルを内製運用したい企業、とりわけ機密データを扱う企業だ。入力データや生成結果がAI学習に使われないためである。コストを予測できずトークン課金を避けているチームにも関係しうる。GPU単位の月額定額制だからだ。
こういう要約が、毎朝あなたのメールに届きます。
さくらインターネットはこのサービスを、既存の「さくらのAI Engine」の技術基盤と運用設計の上に築いている。一から作るのではなく、実績ある基盤を広げる動きだ。利用者の生成AIモデルをさくらインターネットのGPU基盤で動かし、APIで提供する。独自開発モデル、ファインチューニングしたモデル、オープンウェイトモデルを、その顧客だけが使う閉じた環境で扱える。
設計上の特徴は二つある。第一に、専有環境のため推論の実行が他の利用者に影響されず、推論基盤の構築から運用・監視までさくらインターネットが担う。利用者の運用負荷を下げる狙いだ。第二に、料金がGPUごとの月額定額制で、トークン使用量によってコストが変動する心配がない。入力データと生成結果はAIの学習に使われず、機密情報を扱う用途にも道が開ける。
自社モデルの運用方法を検討する読者にとっては、トークン量に応じた課金や顧客間で基盤を共有するサービスとの違いが実用的な比較軸になる。専有構成と定額制が自社に合うかどうかは、各社のワークロードで決まるだろう。10月8日からの稼働後、判断材料が増えそうだ。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。