AIToday毎日のAIニュースダイジェスト

画像生成

2026年7月23日

画像生成

今日の要点

Black Forest Labsが画像、動画、音声生成に対応する最新モデル「FLUX 3」を発表し、画像生成技術が大きく進化しました。一方、AlibbaのQwen-Image-3.0も複雑なレイアウトとテキストを同時生成できる新機能を搭載するなど、各社が生成精度を競い合っています。著作権保護の観点では、CloakがAI学習を阻止するための不可視ノイズ技術を導入するなど、AI生成物をめぐる課題への対応も進んでいます。

主要ニュース

  1. 1

    Black Forest Labsが画像、動画、音声生成向けFLUX 3を発表

    Black Forest Labsは、単一のプロンプトから画像および最長20秒の音声・動画クリップを生成するマルチモーダルAIモデル「FLUX 3」をリリースした。このモデルは、個別のモデルを組み合わせるのではなく、画像、動画、音声の各領域で共同学習されている。また、ロボットビジョンとアクションにも対応している。 FLUX 3は同社初の公開動画生成モデルであり、クリエイティブ生成、シミュレーション、コンピュータ操作、ロボット工学を単一の機能の接続されたアプリケーションとして位置付けている。Black Forest Labsはこれを「ビジュアルインテリジェンス」——物理的およびデジタル環境全体で認識、予測、行動できるモデル——としており、各モダリティを別個のツールとして扱うのではなく、統合的にアプローチしている。

    FLUX 3はFLUX 3 Video、FLUX 3 Image、FLUX 3 Actの4つの製品ラインで提供される。リリースは当初限定となるため、より広い利用可能性や価格設定の詳細が後に発表される可能性がある。

  2. 2

    Blomkamp監督のAI製「ゾンビ映画」が酷評

    Neill Blomkamp監督は、新会社Barley Studiosを通じて、ByteDanceのSeedance 2.0テキスト・ツー・ビデオ生成ツールで完全に制作した13分間のSF短編『Nightborne』を発表した。Peter Watts著の2014年小説『Echopraxia』を下敷きにした本作は、32人の人間俳優の容姿を使用し、実在のコンセプトアーティストの対話を含むが、全ショットがAIツールで生成されている。 Austyn Dainesによる洗練された編集とBlomkampの本フィーチャー制作への野心にもかかわらず、この短編は背景の意味不明な看板、不自然なキャラクター演技、映画製作者が『衰えた』と批評家に指摘された創作方向性の喪失など、AI生成コンテンツ(『スロップ』)の特徴を示している。このプロジェクトは、熟練した映画製作者が従来の手法を適用しても、テキスト・ツー・ビデオモデルは人間の演技の微妙さを理解する必要があり、説得力のある完成作品を制作できないことを浮き彫りにしている。

    Blomkampは『Nightborne』を生成AIの能力を実証するための『テスト開始』と位置づけ、今後のいずれかの時点でこのフォーマットで本フィーチャーに取り組みたいと述べた。この発表は直ちに反発を招き、Blomkampを監督Darren Aronofsky失敗に終わったAI Revolutionary War シリーズと同様の状況に置いた。

  3. 3

    Disney『Ozzy Fox』、AI懸念で話題沸騰

    Disneyの新しい就学前向けアニメシリーズ『Ozzy Fox』がYouTubeで最小限のプロモーションで公開され、小道具の未完成や口パク不一致などの映像の不具合からAI生成の疑いを買い、広範な批判を招いた。逆説的にも、この反発が視聴数を増加させ、これまでに公開された2エピソードそれぞれが50万回以上の再生数を獲得している。本シリーズはDisneyとフランスのアニメーション企業Animajの共同制作で、Disney2024年アクセラレータープログラムを通じて制作された。 『Ozzy Fox』はAIをアシスタントツールとして使用している。具体的には、スケッチから姿勢予測と動きの中割りに限定されており、3Dモデル、絵コンテ、主要フレームはすべて人間のアーティストによって作成され、その後Maya動画作成ソフトで手動で確認と修正が行われる。この区別は重要である。すべての不完全なアニメーションが実はAI生成ではないのにもかかわらず「AIスロップ」とレッテルを貼られるようになれば、Disneyや他の企業がテキスト・ツー・ビデオツールのような実在の生成AI漫画を配備する際に、本来の警告信号としての力を失いかねない。

    Disneyは、OpenAIとの大型契約を含めて、アニメーションに向けた生成AIを検討してきたが、同社がSora AI動画プラットフォームの優先順位を下げたため、この契約は破談に終わった。『Ozzy Fox』の実際のワークフローに対し、一般大衆や批評家がどう反応するか、また、AIアシスタントツールとAI生成コンテンツを区別するか否かが、今後のアニメーション関連AIに対する認識を形作るだろう。

  4. 4

    Alibaba Qwen-Image-3.0が複雑レイアウトと読みやすいテキストを一度で生成

    Alibabaの Qwen チームが Qwen-Image-3.0 をリリースした。このイメージジェネレータは最大4500トークンのプロンプトを受け付け、10ピクセルまでのサイズで判読可能なテキストを生成でき、12言語をネイティブサポートしている。インフォグラフィックス、LaTeXペーパー、新聞ページなどの複雑なレイアウトを1パスで作成できる。 複数の要素を含む複雑なレイアウトと判読可能なテキストを1ステップで生成する能力は、画像生成における長年の課題に対応している。ほとんどのシステムはテキストの判読性と一貫性のある複雑な設計に苦戦している。インフォグラフィックス、学術論文、印刷レイアウトに取り組むビジネスやクリエイターにとって、手動デザイン作業の削減につながる可能性がある。

    出力がピクセル画像であり編集可能な形式ではないため、実用性は不確実である。これにより、ネイティブデザインファイルと比べて、ダウンストリーム編集と再利用が限定される。

  5. 5

    Cloak、AI学習阻止に不可視ノイズ追加

    Timothy が Claude Code で開発した無料ウェブツール「Cloak」は、画像に不可視ノイズを重ねることで、AI モデルに対して画像をウォーターマークまたは有害コンテンツとして分類させ、学習を拒否させる。ツールは L-infinity 摂動と投影勾配上昇法を使用し、CLIP 埋め込みとターゲット埋め込み間のコサイン類似度スコアを最大化して、モデルを保護された画像から遠ざける。 アーティストは AI モデル用の学習データセットを提供する自動画像スクレイパーからの脅威に直面し続けている。Cloak は他の保護ツールが埋めていないギャップに対応している。画像が学習に使用されると想定する Glaze や、大規模なデータセット表現を必要とする Nightshade とは異なり、大規模なスクレイピング パイプラインに対して効果がある。画像がトリミングまたはリサイズされても保護は有効であり、デフォルト強度で可視的なアーティファクトなしに実用的な防御層を提供する。

    Cloak は無料だが制限がある。ファイルサイズの上限は 30 メガバイト、画像の最大長は 10,000 ピクセル、処理パスの最大数は 300、1 時間あたり 60 画像。推奨されるターゲット プロンプトには「watermark」「blood」「blurry」「bad quality」「explicit content」が含まれており、スクレイパーが日常的にフィルタリングするラベルである。作成者は最大限の保護のために Cloak を Glaze および Nightshade と組み合わせて使用することを推奨している。

今後の注目点

FLUX 3やSoraなどの生成AIツールの進化が続く中で、Disney『Ozzy Fox』などの実際の制作現場での活用事例に対して、一般大衆や業界がどう評価するかが、今後のアニメーション・映像業界のAI導入の方向性を大きく左右するだろう。同時に、Cloak のような著作権保護ツールの普及と機能拡張が進むことで、クリエイターの権利保護とAI技術の活用のバランスがどう取られていくのかも注視する必要がある。

情報ソース

このニュースを友達にシェア

気になりそうな人に、今日のまとめをそのまま送れます。

AITodayで毎日のAIニュースを無料で受け取る

200以上のAIソースを毎朝1分で。Email / LINE / Slack 配信。

無料で登録する