AIToday

Google、Gemini Flash 3種をリリース

THE DECODER3時間前
Google、Gemini Flash 3種をリリース

要点

GoogleはGemini Flash 3機種—3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber—の新リリースを発表したが、フラッグシップのGemini 3.5 Proは非公開テスト中で公開リリース日は未定。3.6 Flashは大幅なコスト削減(入力トークン当たり150万あたり1.50ドル、出力トークン当たり150万あたり7.50ドル)とDeepSWE(37%から49%への向上)などのベンチマークでの改善を提供する一方、フロンティア層の公開モデルリリースの遅延により、OpenAI、Anthropic、トップ層の代替案を提供する中国系ラボなどの競合に後れを取っている。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    GoogleはGemini Flash ファミリーの新モデル3機種、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberをリリースした。同社はGemini 4の事前学習も開始したと発表したが、期待されていたフラッグシップモデルGemini 3.5 Proは限定的なパートナーテスト中で、公開リリース日は未定である。

  • なぜ重要か

    Gemini 3.6 Flashは入力トークン当たり150万あたり1.50ドル、出力トークン当たり150万あたり7.50ドルへコストを削減—従来の3.1 Proより大幅に安い—しながら、DeepSWE(37%から49%)などのベンチマークでパフォーマンスを向上させた。しかし最先端層の公開モデルがないことで、GoogleはOpenAIのGPT-5.6 Sol、AnthropicのFableとMythos、MoonshotやZhipuなどの中国系ラボが最先端で競争する環境にシェアを譲っている。最近のBloombergレポートでは3.5 Proはコード性能の改善作業のため数ヶ月遅延していることが示されている。

  • 注目点

    サイバーセキュリティ向けに調整されたGemini 3.5 Flash CyberはCyberGymベンチマークで83.2%を達成—OpenAIのGPT-5.5-Cyberの85.6%の2ポイント以内—で、政府と信頼できるパートナー向けにパイロットプログラムで限定されている。標準CodeMenderエージェントはGemini Enterprise Agent Platformでプレビュー利用可能になり、C/C++、Go、Java、Python、Ruby、Rust、TypeScriptをサポートする。

詳細

GoogleはGemini Flashモデルファミリーに3つの新規エントリを発表した:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber。このリリースは何がリリースされるかよりも、何が不在かで注目に値する:同社の期待されていたフラッグシップGemini 3.5 Proはパートナーとの限定的なテスト中で、「準備ができたら」ローンチする—日付の不在を強調する言葉である。

このリリースの中心であるGemini 3.6 Flashは、パフォーマンスを損なわずに効率性を提供するよう設計されている。ベンチマーク集約オービスのArtificial Analysis Indexによると、3.5 Flashよりも出力トークンを約17%削減し、DeepSWEなどの特定ベンチマークでは65%に達する節約がある。コストは入力トークン当たり150万あたり1.50ドル、出力トークン当たり150万あたり7.50ドルに削減され、従来の3.1 Proモデルより大幅に安く、3.6 Flashはベンチマークで一貫して3.1 Proを上回る。複数の主要指標で新モデルは3.5 Flashを大幅に上回る:DeepSWEは37%から49%に改善、MLE Benchは49.7%から63.9%に、OSWorld-Verifiedは78.4%から83%に、GDPval-AA v2は1,349から1,421ポイントに向上した。DeepSWEに限定して、3.6 Flashは3.5 Flashの出力トークンの3分の1強を使用する。GoogleはGemini APIおよびGemini Enterpriseに組み込みクライアント側ツールとしてComputer Useを統合し、CBRN(化学・生物・放射線・核兵器)悪用とサイバー攻撃に対するFrontier Safetyセーフガードを追加した。これらの利得と100万トークンコンテキストウィンドウにもかかわらず、GoogleはUS と中国の競合企業の最高モデルにはまだ劣ることを認めている。技術スタッフメンバーのLogan Kilpatrickはソーシャルメディアでこの設計選択を擁護し、明確な目標は効率性、使いやすさ、低コストであり、その過程でパフォーマンスも改善されたと述べた。

Gemini 3.5 Flash-Liteは高容量・低遅延ワークロードをターゲットとする。秒あたり350出力トークンを生成し、入力トークン当たり150万あたり0.30ドル、出力トークン当たり150万あたり2.50ドルでコストがかかる。小型モデルは前身である3.1 Flash-Liteに対して特にエージェント型コード作業で大幅な改善を示す。Terminal-Bench 2.1スコアは31%から54%に上昇し、SWE-Bench ProやOSWorld-Verifiedを含むエージェント型ソフトウェアエンジニアリングとコンピュータ使用ベンチマークで大型のGemini 3 Flashを上回る。Googleは前回のI/Oカンファレンスで初めてGemini 3.5 Flashをエージェント戦略の中心として導入し、その後モデルが自律的にブラウザ、デスクトップ、モバイルデバイスを操作できるネイティブコンピュータ使用を追加した。

Gemini 3.5 Flash Cyber、3.5 Flashに基づく専用サイバーセキュリティモデルは、Google DeepMindのコードセキュリティエージェントCodeMenderに組み込まれている。複数のFlash Cyberサブエージェントが並列で動作し、その調査結果を単一レポートに統合する。CyberGymベンチマークで83.2%を達成—OpenAIのGPT-5.5-Cyberの85.6%の2ポイント以内—により、ずっと小型なモデルだが、Googleの利点は主にトークンあたりの低コストに由来する。実世界テストで、GoogleのBig Sleepチームはflash Cyberを使用してChromeとSafariの重大な欠陥を探し、標準FlashモデルとAnthropicの Claude Opus 4.6の両方を上回った。V8 JavaScriptエンジンのコミットをスキャンする場合、Flash Cyberは55の確認された一意の調査結果を特定し、3.5 Flashは47、Opus 4.6は36、他のモデルが検出しなかった10の調査結果と比較した。別のテストで、GoogleのCloud Vulnerability Research TeamはFlash Cyberを公開APIをスキャンするように展開し、2時間以内にリモートコード実行の欠陥を発見し、セキュリティ保護をバイパスする実行可能なエクスプロイトを生成した。Googleはモデルが攻撃と防御の両方に等しく有用だと判断するため、アクセスは厳密に制限されている:パイロットプログラムの一部としてCodeMenderを通じて3.5 Flash Cyberを使用できるのは政府と信頼できるパートナーのみ。CodeMenderエージェント自体はGemini Enterprise Agent Platformを通じてプレビューで広く利用可能になるが、そのバージョンは標準Geminiモデルで実行され、C/C++、Go、Java、Python、Ruby、Rust、TypeScriptをサポートする。

Googleに対する本当のプレッシャーはGemini 3.5 Proの継続的な不在から来ている。OpenAIはGPT-5.6 Solでフロンティアティアをすでに提供し、AnthropicはFableとMythosを提供し、Moonshot(Kimi K3)やZhipu(GLM-5.2)などの中国系ラボはパフォーマンスギャップを縮めている。MetaはGoogleの全現在のラインアップをコード作業で上回るモデルもリリースしている。フロンティアで競争するのではなく、Googleは効率性とコストに焦点を当てた別のFlashアップデートをリリースした。最近のBloombergレポートはコード性能の改善に向けて同社が取り組むにあたり、フラッグシップモデルが数ヶ月遅延していることを示唆している。3.5 Proが非公開テストにとどまる限り、Googleは市場の最上位で競争する公開モデルがない。Gemini 4の事前学習がすでに開始中で「最も野心的な学習実行」と呼ぶ同社の発表は損害管理として読める—Googleが市場の期待を理解しているがまだそれを提供できないことを示すシグナルである。

背景と解説

Googleの発表は2つの戦略に挟まれた企業の姿を浮き彫りにする:近期的に効率性とコストの最適化を進める一方で、フラッグシップモデルは拡張学習のままである。3つの新Flash バリエーションはそれぞれ異なるユースケースをターゲットとしている—3.6 Flashは汎用ワークロード向けにパフォーマンスとコストのバランスを取り、3.5 Flash-Liteは超低コスト(入力トークン当たり150万あたり0.30ドルで秒あたり350出力トークン生成)でスループットを優先し、3.5 Flash Cyberはセキュリティスキャンに特化し厳密なアクセス制御を実施している。全体として、ピーク性能よりも価格と効率性が重要な中層とオペレーショナルセグメントで競争力のあるポジションを示している。

しかし本当の話は不在である:Gemini 3.5 Proの継続的な遅延は、Googleが競合企業が現在公開で提供している最先端のパフォーマンスに対抗できないことを示唆している。OpenAIのGPT-5.6 Sol、AnthropicのFableとMythos、Moonshot(Kimi K3)やZhipu(GLM-5.2)などの中国系ラボはすでに最上層を占めており、さらにMetaもGoogleの現在の公開ラインアップをコード作業で上回るモデルをリリースしている。Gemini 4の事前学習を「最も野心的な学習実行」と位置づけることで、Googleは市場の期待を認識しているが3.5 Proではそれに対応できないことを示している。Flash効率とコストに注力する同社の対応は、遅延がさらに拡大すれば、プレミアムセグメントを永続的に譲る危険性がある。

よくある質問

新しいGeminiモデルの価格は?
Gemini 3.6 Flashは入力トークン当たり150万あたり1.50ドル、出力トークン当たり150万あたり7.50ドル。Gemini 3.5 Flash-Liteは入力トークン当たり150万あたり0.30ドル、出力トークン当たり150万あたり2.50ドル。
Gemini 3.5 Flash Cyberにアクセスできるのは誰か?
パイロットプログラムの一部として、政府と信頼できるパートナーのみがCodeMenderを通じて3.5 Flash Cyberを使用できる。標準CodeMenderエージェント自体はGemini Enterprise Agent Platformを通じてプレビューで利用可能になり、標準Geminiモデルで実行される。
Gemini 3.5 Proはいつ利用可能になるか?
Gemini 3.5 Proはパートナーとの限定的なテスト中で、Googleによると「準備ができたら」リリースされる。最近のBloombergレポートはコード性能の改善作業のためフラッグシップモデルが数ヶ月遅延していることを示唆している。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます

毎朝1分、AIの要点だけ。

200媒体以上・Email/LINE/Slack 対応

無料で受け取る →