
GoogleがAPI経由で新しい画像生成モデルと動画生成モデルを提供開始しました。
Nano Banana 2 Liteは4秒で1K解像度の画像を$0.034で生成でき、Gemini Omni Flashは自然言語で動画編集ができます。
開発者は両モデルを組み合わせて、画像から動画への変換パイプラインを構築でき、既にGoogle検索などの消費者向けサービスにも展開されています。
何が起きたか
Googleが画像生成モデル「Nano Banana 2 Lite」と動画生成モデル「Gemini Omni Flash」をAPI経由で提供開始しました。Nano Banana 2 Liteは4秒で画像を生成し、1K解像度あたり$0.034の低価格です。Gemini Omni Flashは動画生成・編集をテキストプロンプトで操作でき、1秒あたり$0.10の価格設定です。
なぜ重要か
従来、GoogleはAPIを通じた動画生成を提供していませんでした。今回、開発者が画像と動画を同じAPI環境で組み合わせて使える環境が整い、プロトタイピングから本番運用まで一貫して対応する道が開けた可能性があります。
注目点
Nano Banana 2 Liteは既にGoogle検索のAI Mode、Geminiアプリ、Google Photos、Google Adsなど複数の消費者向けサービスに展開されています。Gemini Omni Flashは現在10秒のクリップ生成に対応し、Google AI Studio、Gemini API、Gemini Enterprise Agent Platformで利用可能です。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
TSMCは次世代COUPEプラットフォーム向けに、帯域幅を拡張する2つの道筋を発表

北京拠点のAI新興企業Z.aiは金曜日、最新モデルの詳細を公開した

OpenAIなどのAI研究所は、自律的に複数ステップのタスクを処理するコンピューター使用エージェントを訓練するため、Mac miniとMac Studioを数万台購入した

NTTデータグループは31日、米セキュリティー大手パロアルトネットワークスと提携すると発表した

OpenAIは推論チップ「Jalapeño」の初期成果を公表し、主要システムと比べてワット当たりの性能が向上し、遅延も低減したと報告

ある報告によると、初期キャリアの金融職候補者の約84%が応募書類や面接回答の作成にAIを利用している
