
何が起きたか
GoogleはGemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteにエージェント型動画分析を追加した。毎秒フレームをサンプリングするのではなく、モデルが関連部分を自律的に選択する。
なぜ重要か
Googleの1H-VideoQAとLVBenchベンチマークで、トークン使用量は88%減り、精度はわずかに向上。開発者のコストが下がり、異常検知や反復動作のカウントなど、長時間映像の分析が容易になる。国内の動画分析サービス開発者は、長時間映像の処理コスト削減が可能になるとみられる。
注目点
この機能はGemini APIで追加料金なしに利用可能。まもなくFlashとFlash Liteの全Geminiアプリ利用者に展開される。その後、再生ページで「Ask YouTube」を強化する予定。
こういう要約が、毎朝あなたのメールに届きます。
今回のアップデートは、1月にGemini 3 Flashへ搭載された「エージェント型視覚」の動画版といえる。先の機能はモデルがPythonを書いて実行し、画像編集をループで検証するものだった。今回は同じ原理を動画に応用し、フレーム、音声、文字起こしの中から必要な部分をモデルが選び、動画の一部だけを取得。1H-VideoQAやLVBenchなどのベンチマークで最大88%のトークン削減を実現している。
実際の利点は、1秒未満のカットや状態変化など、毎秒固定サンプリングでは見逃しがちな細部で精度が出ることだ。Googleによれば、LongVideoBenchでGemini 3.7 Flashは品質とコスト効率の両方で首位。エージェント型の手法は単に安価なだけでなく、しばしば高精度でもある。
Googleは今後数ヶ月でFlashとFlash Liteの全Geminiアプリ利用者にこの機能を展開し、その後「Ask YouTube」連携を進める。APIは通常のトークン料金で追加料金もかからないため、コスト削減により高度な動画分析が開発者にとって利用しやすくなる。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
エヌビディアのジェンスン・フアンCEOは、OpenAIが最新モデル「GPT-6 Astra」を発表したことを受け、汎用人工知能(AGI)が到来したと述べた

サウジアラビア政府系AI企業HUMAINは、CEOタレク・アミン氏の下でオープンAIモデルの中立的ハブとしての地位を確立し、米国・中国に続くAI超大国を目指している

アリババの研究部門がQwen-Drive 1.0を公開

開発者がChatGPTに対し、同じリモートワークのシナリオを被験者の性別と役職だけ変えて判定させた

Google DeepMindは、Gemini 3.1 Proを使う100の自律型LLMエージェントに71問の数学問題を解かせた

福島県は2025年度、2つの生成AIサービス(NTT東日本の提供サービスとMicrosoft 365 Copilot)について、有償アカウントを各50ずつ、計100アカウント用意し、約50人の職員を対象に実証実験を行った
