AIToday

Google、Gemini新モデル発表、費用65%削減

VentureBeat AI6時間前
Google、Gemini新モデル発表、費用65%削減

要点

Google DeepMindが3つの新しいAIモデルを発表し、長期タスクにおいてAIエージェントコスト最大65%削減を実現。Gemini 3.5 Flash-Liteは100万入力トークンあたり0.30ドル、100万出力トークンあたり2.50ドルと価格設定され、従来のFlashモデルを下回る価格でありながらGoogle従来の最安モデルより2倍高速。このリリースにより、Googleはエージェント費用の削減と大規模導入時の実用性向上を実現。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    Google DeepMindが3つの新しい独自AI モデル—Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyberを発表。API経由で100万トークンあたり入力/出力1.50ドル/7.50ドル、0.30ドル/2.50ドル、および未発表の料金で提供される。

  • なぜ重要か

    新モデルは長期エンジニアリングタスクにおいて前世代比でトークンコスト最大65%削減し、AIエージェントの大規模運用を大幅に低コスト化。特にGemini 3.5 Flash-Liteは前世代Flashモデル(100万トークンあたり1.50ドル/9.00ドル)を下回る価格設定でありながら、Google従来の最安モデルGemini 3.1 Flash-Lite(同0.25ドル/1.50ドル)より2倍高速。

  • 注目点

    GoogleはGemini 3.5 Proの到来を予告しているが、料金や提供開始日は未発表。参考までにGemini 3.1 Pro Previewは100万トークンあたり2ドル/12ドル。

詳細

Google DeepMindは本日、AIエージェント—AI推論に基づいて行動する自律システム—のコスト削減と大規模での速度・能力向上を目指す3つの新しい独自AIモデルを発表した。発表される3つは、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyberである。

新モデルの料金設定はコスト効率化への積極的な取り組みを反映している。Gemini 3.6 FlashはAPI経由で100万入力トークンあたり1.50ドル、100万出力トークンあたり7.50ドル。Gemini 3.5 Flash-Liteは劇的に安く100万入力トークンあたり0.30ドル、100万出力トークンあたり2.50ドル。Gemini 3.5 Flash Cyberの料金は未公開。これらの料金を文脈化するため、従来のGemini 3.5 Flashモデルは100万トークンあたり1.50ドル/9.00ドル、Gemini 3.1 Pro Previewは同2ドル/12ドル、Googleの従来最安モデルGemini 3.1 Flash-Liteは同0.25ドル/1.50ドルである。

Googleは新モデルが長期エンジニアリングタスク—トークン消費が複合的に増加する複数ステップのAI推論ワークロード—において最大65%のコスト削減を実現すると主張している。既存のGemini 3.1 Flash-Liteとのトレードオフは明確である。なおもトークンあたり最安であるが、Gemini 3.5 Flash-Liteは2倍高速に動作し、速度を優先するエンタープライズにより高い効率性を提供。GoogleはまたGemini 3.5 Proが来たることを示唆しているものの、料金も提供開始日も提供されていない。

背景と解説

Google DeepMindによる3つの新モデル発表は、AIエージェント—AI推論に基づいて自律的に行動するソフトウェア—の実行計算コスト削減を目指す業界全体の動きを反映している。同社はこれらモデルを「最もトークン効率的な製品群の1つ」と位置づけ、推論(AI応答生成)市場でのコスト競争への直接的な対抗姿勢を示した。トークンは大規模言語モデルの基本計算単位であり、消費トークンが少ないほど顧客の運用コストは低下する。

料金体系は戦略的意図を明確に示している。Gemini 3.5 Flash-Liteは従来のFlash世代を大幅に下回る価格(0.30ドル/2.50ドル対1.50ドル/9.00ドル)で提供され、コスト最適化を求めるワークロードにアクセス可能になる一方、Gemini 3.6 Flashはこの中間に位置し、複数ステップ処理においてトークン効率が最も重要となる長期エンジニアリングタスクで65%のコスト削減を実現。特筆すべきは、Googleの従来最安モデルGemini 3.1 Flash-Liteがなお最安のトークンレートを保つ一方で、現在は2倍遅く、この取捨選択によりGoogleは顧客に超低コストと許容可能な速度のいずれかを選択させるのではなく、両者のバランスを提供していることだ。

Gemini 3.5 Proの発表予定だが未公開の料金設定は、Googleがハイエンド層の刷新も進めていることを示唆しているものの、詳細は依然として不透明。

よくある質問

新しいGeminiモデルの料金は?
Gemini 3.6 Flashは100万入力トークンあたり1.50ドル、100万出力トークンあたり7.50ドル。Gemini 3.5 Flash-Liteは100万トークンあたり0.30ドル/2.50ドル。Gemini 3.5 Flash Cyberの料金は未発表。
新モデルは従来版と比べてどのくらい安いのか?
Gemini 3.5 Flash-Liteは長期エンジニアリングタスクにおいて従来世代比で最大65%コスト削減。Gemini 3.5 Flash(100万トークンあたり1.50ドル/9.00ドル)と比較すると相当な削減幅。
Gemini 3.5 Flash-LiteはGoogleの従来の最安モデルとどう比較されるか?
Gemini 3.5 Flash-LiteはGemini 3.1 Flash-Lite(100万トークンあたり0.25ドル/1.50ドル)よりトークンあたりコストは高いが、2倍高速で動作するため、速度を重視するエンタープライズにとってより良い価値を提供。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます

毎朝1分、AIの要点だけ。

200媒体以上・Email/LINE/Slack 対応

無料で受け取る →