AIToday毎日のAIニュースダイジェスト

動画生成

2026年7月23日

動画生成

今日の要点

Black Forest Labsが音声付き動画生成モデル「FLUX 3」を公開し、動画生成技術の進化が加速しています。一方、クリエイターがLLMで長編映画を制作した試みは評価されず、生成AIツールだけでは高品質なコンテンツ制作が難しい課題が浮き彫りになりました。RunwayやSynthesiaなども生成メディア向けのツールを続々ローンチしており、動画生成分野の競争が激化しています。

主要ニュース

  1. 1

    Black Forest Labs、音声付き動画生成Flux 3公開

    ドイツのAI企業Black Forest Labs(BFL)が、画像・動画・音声を統合学習するマルチモーダル基盤モデル「Flux 3」を発表しました。動画に直接音声を付加する機能をAI動画生成では初めて実装し、最長20秒のクリップに対応しています。 BFLの初期評価では、Flux 3は10秒・720pの動画でLuma Ray 3.2に対して93%の比較で、Runway Gen-4.5に対して77%の比較で優位性を示しました。単一のモダリティでは現実を完全に捉えられないという考えに基づき、複数のモダリティを組み合わせることで、より正確な「世界モデル」の構築へ向かう動きの一環とみられます。

    Flux 3 Videoは既に利用可能で、Flux 3 Imageは数週間以内のアーリーアクセス提供を予定しており、オープンウェイト版「Flux 3 Dev」の段階的公開も計画されています。また、Mimic Roboticsと協力開発した動画・行動予測モデル「Flux-mimic」はAudiの生産タスクで現在テスト中です。

  2. 2

    クリエイターがLLMで長編映画を制作、失敗だと評価

    あるコンテンツクリエイターがLLM(Claude Fable 5)を使用してウィリアム・ホープ・ホジスンの『Borderland の家』の長編映画化作品を制作し、YouTubeチャンネルにミュージックビデオとAI生成アルバムとともにアップロードした。 この実験は、大規模言語モデルが人間の介入なしに長編プロジェクト全体にわたって創作活動を継続できるかどうかを検証するもので、独立した操作を許可された場合でも、現在のAI能力では実現不可能なままである創作作業の種類は何かという問題に関わっている。

    クリエイターはこの結果を公開したにもかかわらず失敗と位置付けており、映画全体というカテゴリーではなくYouTubeチャンネルの基準のみで判断したと述べている。また、LLMの自律性や計画立案能力ではなく、詳細な記事で論じている他の要因に欠点の原因があると指摘している。

  3. 3

    Black Forest Labs、画像・動画・音声生成向けFLUX 3をローンチ

    Black Forest Labsは、単一のプロンプトから画像と最長20秒の音声・動画クリップを生成するマルチモーダルAIモデルFLUX 3をリリースした。このモデルは、別々のモデルを組み合わせるのではなく、画像、動画、音声にまたがって共同学習されており、ロボットビジョンおよびロボットアクションにも対応する。 FLUX 3は同社初の公開動画生成モデルであり、クリエイティブ生成、シミュレーション、コンピュータの使用、ロボット工学を単一の能力の関連するアプリケーションとして位置づけている。Black Forest Labsは各モダリティを個別のツールとして扱うのではなく、これを「ビジュアルインテリジェンス」として枠付けており、物理的および デジタル環境を認識、予測、作用するモデルと表現している。

    FLUX 3は4つの製品ラインを通じて提供される:FLUX 3 Video、FLUX 3 Image、FLUX 3 Actである。リリース当初は限定的であり、より広い利用可能性または価格設定の詳細は後続される可能性がある。

  4. 4

    Runwayが生成メディア向けモデルルーター「Media Router」をローンチ

    Runwayは木曜日にRunway Devプラットフォームを通じてMedia Routerをローンチした。このツールは開発者のリクエストに対して、品質、速度、コストなどの優先度に基づいて最適な画像、動画、音声生成モデルを自動選択する。Runwayは生成メディア向けに特化したモデルルーターとしては初めてだと述べている。 生成メディアモデルの数が爆発的に増加し、開発者が新リリースを評価し、各タスクに最適なモデルを理解することが難しくなっている。このルーターにより、Adobe、Cloudflare、ElevenLabs、Expedia、Shutterstock、Quoraを含む開発者らが、APIを通じてメディア生成を自社製品に直接統合できる。一方Runwayは、単一モデルの優位性に賭けるのではなく、オーケストレーションレイヤーとしてのポジションを強化している。

    開発者はルーターの選択ロジックに対して優先度を設定でき、トークン料金(2026年のエージェント型AI利用企業にとって主要なコスト懸念)とモデルの出所が含まれる。例えば、トランプ政権が中国製オープンAIモデルへの規制を検討する中、アメリカ企業のプロバイダーを中国モデルより優先するといった設定が可能だ。

  5. 5

    Synthesia、営業育成向けAIコーチングツール発表

    英国のAIスタートアップSynthesiaが水曜日、対話的トレーニング製品「Roleplay Sessions」をリリースした。営業プレゼン、人事評価、顧客対応といった高度な局面での会話をAIアバターと実践し、AIが応答・異議を唱え、ルーブリックに基づいてパフォーマンスを採点する。すでに欧州時価総額トップ3企業、フォーチュン100トップ5企業、世界有数の採用企業を含む初期顧客を確保している。 Synthesiaはビデオ生成から、トレーニングが実際に行動を変えることの実証へシフトしている。多くの企業研修は情報提供と実演に留まり、本来の学習には至らないが、Synthesiaはプラクティスとフィードバックが突破口になると主張する。ルーブリック、パフォーマンスデータ、分析をアバター技術に重ねることで、単なるAIアバターベンダーではなくパフォーマンス管理プラットフォームとしてのポジションを築き、より堅牢なビジネスモデルを確立している。CEOのVictor Ripabelliは、営業チーム全体がAIロールプレイヤーと練習することで、営業全体のパフォーマンスについて詳細なデータを収集できると指摘する。

    Rolepayは現在エンタープライズ向けだが、Synthesiaは数か月以内に推論コストの低下に伴い、中小企業、プロシューマー、教育機関への展開を予定している。また同プラットフォームは、採用面接や候補者スクリーニングへの拡張を計画する幅広い「Sessions」フレームワークの最初のリリースとなる。

  6. 6

    開発者がClaudeと動画生成モデルで短編映画を完成

    開発者がClaude(テキストを理解・生成するAI)とSeedance 2.0(動画生成モデル)を組み合わせ、完全な短編映画を制作した。15回の試行と複数段階のパイプラインを経て、2ページの物語プロンプトから始まり、Claudeとのブレーンストーミング、キャラクターと舞台設定の参照画像生成、そしてAIが生成したプロンプトを使った各シーンの動画製作へと進化した。 これは、専門知識のない人でも既存のAIツールを組み合わせることで、映画クルーや高額な機材なしに映画品質のコンテンツを制作できるようになったことを示している。著者が実施した比較テストでClaude FableとClaude Opusが同等の監督能力を発揮したため、本当の進歩は単一の革新的モデルではなくアクセスしやすいツールチェーン自体にあることが明らかになった。

    完成した映画はYouTubeで公開されている(https://www.youtube.com/watch?v=q40M08SOhGs)。このパイプラインはSeedanceのAPIラッパーとしてHiggsfield、参照画像生成用にnano banana、脚本作成用にClaude Codeを使用しており、AIで映画制作に興味のある他の開発者にも再現可能と見られる。

今後の注目点

Flux 3の段階的なリリース(Video、Image、Devの公開予定)と、Synthesia、Rolepayなどの動画生成プラットフォームの機能拡張や価格低下により、2026年にはAI動画生成がエンタープライズから中小企業・教育機関まで広く浸透する見込みです。同時に、Flux-mimicのような行動予測モデルの実用化やルーター選択ロジックの進化も、産業用途での活用可能性を大きく広げていくでしょう。

情報ソース

このニュースを友達にシェア

気になりそうな人に、今日のまとめをそのまま送れます。

AITodayで毎日のAIニュースを無料で受け取る

200以上のAIソースを毎朝1分で。Email / LINE / Slack 配信。

無料で登録する