
Googleは3つの新しいGeminiモデル—Gemini 3.6 Flash、Flash Lite、Flash Cyber—をリリースしたが、公約されていたGemini 3.5 Proを保留にした。最大の変化はGemini 3.6 Flashが、DeepSWEベンチマークでコーディング性能を37%から49%に向上させ、トークン使用量を約17%削減しつつAPIの価格設定を引き下げ、開発者が大規模でのAI推論実行コストを削減するのに役立つ点である。
こういう要約が、毎朝あなたのメールに届きます。
無料で登録 →何が起きたか
Googleは3.5 Flashに代わるGemini 3.6 Flashのほか、Gemini 3.5 Flash LiteおよびGemini 3.5 Flash Cyberをリリースした。6月に予定されていたGemini 3.5 Proはリリースされていない。
なぜ重要か
3.6 Flashはコーディング性能を向上させ(DeepSWEテストで49%対3.5 Flashの37%)、トークン使用量を約17%削減しつつ、APIコストをそれぞれ3.5 Flashの1.50ドル、9ドルから入力トークン150万個あたり1.50ドル、出力トークン150万個あたり7.50ドルに引き下げた。これらの効率改善は開発者と企業がAIトークンコストを削減するのに役立つ。
注目点
Flash Liteは秒間350トークンで処理でき、入力トークン150万個あたり0.30ドル、出力トークン150万個あたり2.50ドルの価格設定により、Googleの最も効率的な最新AIとしてのポジションを確立した。Gemini 3.5 Proのリリース日は不明である。
Googleは5月のI/Oイベントの後、3つの新しいGeminiモデルを発表した。そのイベントではGemini 3.5 Flashが目玉だった。しかし3.5 Flashはこれでサポート対象外となり、Gemini 3.6 Flashに置き換わった。3.6 Flashは開発者フィードバックに対応したもので、前回のリリースはコード生成の約束を完全には果たさなかったという指摘があった。コーディングタスク向けのDeepSWEベンチマークで3.6 Flashは49%を獲得し、3.5 Flashの37%から大幅に改善した。このモデルは標準APIフィーチャーとしてコンピュータ利用もサポートし、OSWorldベンチマークでは3.5の78.4%から83%へとスコアが改善した。
Gemini 3.6 Flashはこうした改善を全体でおおよそ17%少ないトークン消費で達成した。コスト意識の高い開発者にとって大きな勝利である。この効率性を反映させるため、GoogleはAPI価格設定を引き下げた。入力トークンは現在150万個あたり1.50ドル(変更なし)、出力トークンは150万個あたり7.50ドルとなり、3.5 Flashの9ドルから引き下げられた。モデルが複数のステップのタスクを自動的に完了するエージェンティック・ワークフローでは、3.6 Flashはより正確な結果をより少ないステップで、より少ないトークンで提供し、開発者とGoogle双方にとって大幅なコスト削減となるはずである。
メインのFlashアップグレードに加えて、Googleはストリップダウン版のGemini 3.5 Flash Liteをリリースした。これは秒間350トークンに達し、Googleの最も効率的な最新AIとなっている。Flash Lite価格設定は入力トークン150万個あたり0.30ドル、出力トークン150万個あたり2.50ドルである。前回の3.1 Flash Lite(それぞれ0.25ドルと1.50ドル)からは若干の値上げだが、Googleはエージェンティック・システムのスケーリングに理想的だと位置付けている。同社はまた、サイバーセキュリティのユースケース向けの専門的な変種であるGemini 3.5 Flash Cyberもリリースした。
本日の発表で顕著に欠けていたのはGemini 3.5 Proで、これは6月にローンチ予定だった。Googleは新しいリリース日を提供していなく、開発者は高層型モデルのいつのリリースについて不確実性を抱えている。この延期はGoogleが新しいプレミアム層を急いで市場投入するのではなく、既に持っているモデル、特に効率性とコストに関するモデルを最適化するというシフトを強調している。
Gemini 3.5 Pro のリリースをスキップするGoogleの決定は、効率性とコスト管理へのシフトを示唆している。同社は3.6 Flashへの変更が特にコード生成性能の面で3.5に対するユーザーフィードバックに応じて行われたことを強調した。トークン効率に対するGoogleのフォーカスは業界全体の圧力を反映している。AIトークンのコストについて事業者が懸念を深めるにつれ、計算要件を削減しながら性能を維持することが競争優位性となった。改善されたコーディング性能(DeepSWEで49%対37%)を17%少ないトークン使用量で達成したことは、Googleが初期の課題を追加コスト負担なく解決したことを実証している。Flash Liteを秒間350トークンで導入することで、Googleはコスト効率性が最優先課題であるエージェンティック・ワークフローで競争力を持つようになる。Pro版の延期は、Googleが高層型リリースを急ぐのではなく、既存の需要により良く対応する最適化されたモデルを優先していることを示唆している。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
まだコメントがありません。最初のコメントを投稿しましょう!
ログインして議論に参加200以上のソースから厳選したAIニュースを毎日無料でお届けします。
無料で始める登録無料・30秒で完了・いつでも解除できます
毎朝1分、AIの要点だけ。
200媒体以上・Email/LINE/Slack 対応