
何が起きたか
グーグルは10月6日、Gemini 3.6 Flashベースの画像モデル「Nano Banana 2.1」を発表した。
なぜ重要か
グーグルによると、この更新は前モデルのあらゆる面、特にビジュアルデザイン、マスクベースの編集、被写体の一貫性を改善している。
注目点
グーグルは依然として、ぼやける小さな文字や長い段落、入力画像と生成画像の間の不完全なキャラクターの一貫性、左右などの空間関係の取り違えを未解決の問題として挙げているため、そうしたケースでは改善が当てはまらない可能性がある。開発者はAPIに無料枠がないことに注意すべきだ。画像出力は100万トークンあたり30ドル(Nano Banana 2の画像あたり料金のおよそ半額)だが、入力価格は100万トークンあたり0.50ドルから1.50ドルに上がった。
誰に効くか最も直接的に影響を受けるのはGemini API上で画像生成・編集機能を構築する開発者だ。Nano Banana 2.1には無料枠がなく、画像出力は100万トークンあたり30ドル、入力トークンは100万トークンあたり0.50ドルから1.50ドルに上がったからだ。Google Ads、Flow、Stitchを使うマーケティング・クリエイティブチームも、展開が届くにつれてマスクベース編集と被写体の一貫性の改善を実感するかもしれない。
こういう要約が、毎朝あなたのメールに届きます。
Nano Banana 2.1は、グーグルが2月に公開しGemini 3.1 Flash Imageとしても知られるNano Banana 2の後継として登場した。つまりその投入からおよそ8か月後の刷新だ。モデルカードによると、Gemini 3.6 Flashベースでテキストと画像の入力に対応し、最大100万トークンのコンテキストウィンドウを備える。グーグル自身の比較では、置き換えるモデルと上位機種のNano Banana Pro(Gemini 3 Pro Imageとしても知られる)の両方を、テキストから画像生成の人間評価Elo、インフォグラフィックの事実精度の自動スコア、そして複数キャラクター間の一貫性やマスク・手描き指示による編集を含む評価対象の画像編集7項目すべてで上回っている。
グーグルは未解決の限界も示した。小さな文字や長い段落はぼやけることがあり、入力画像と生成画像の間のキャラクターの一貫性は常に完璧ではなく、左右などの空間関係を取り違えることもある。こうした注意点は異例の価格変更と並んでいる。画像出力は前モデルの画像あたりコストのおよそ半額に下がったが、入力価格は100万トークンあたり0.50ドルから1.50ドルに上がり、APIには無料枠がない。短いプロンプトで大量の画像を生成する開発者にとって最も有利となりそうだが、大きな入力を送る開発者にはバランスが不利に映るかもしれない。ただし実際のコストは、各ワークロードの入力・テキスト出力・画像の組み合わせ次第だ。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
GoogleはブラウザベースのAIプラットフォーム「Playground」を公開

Qwenは2026年9月20日、7Bの生成トランスフォーマー、32層、デフォルト2048×2048、入出力4チャネルのVAEを備えたQwen-Image-2.1を公開した

Googleは、画像・動画・音声がAI生成かどうかをSynthIDで判定する新たな公開サイトを立ち上げた

ユーザーはNew Yorker風の漫画をChatGPTに頼んだだけだが、Brendan Loperの「BLoper」署名が自動で追加された

JANCTION Renderが無料ベータを公開

IEEE Access(2026年)掲載のAFP-GICは、デコーダ遅延をDC-VICの98.27 msから18.1%減の80.47 msに短縮し、1つの学習済みモデルで5つの目標ビットレート動作点を切り替えられる
