AIToday您的AI新闻摘要

Video Generation

Jul 28, 2026

Video Generation

今日要点

Runway将AI视频模型开发中遇到的bug转化为功能并分享设计经验,而Black Forest Labs推出了支持视频、音频和机器人领域的Flux 3多模态模型,标志着视频生成技术的进一步发展。与此同时,研究发现即使标注了AI生成的视频,人们对真实视频的信任度仍会下降,这为视频生成技术的应用带来了新的伦理考量。

主要新闻

  1. 1

    Runwayがバグを機能化、AI動画モデルの設計教訓を公開

    Runway MLのRyan Phillips企業向け製品責任者がVB Transform 2026で講演し、AI生成アバターがリアルタイム動画生成中に画面外にずれるバグを、バックエンド修正ではなくフロントエンド機能として対応した事例を紹介しました。同社はRunway Charactersというリアルタイム動画モデルを展開しており、AI生成アバターとのゼロレイテンシー双方向インタラクションを実現しています。 Phillipsは基盤モデル自体を構築していない企業でも、Runwayの構築・評価・出荷方法から学べることがあると述べています。この実例は、技術的な制約に直面したとき柔軟な設計思考で対応することの重要性を示唆しており、AI製品開発に携わる組織全般にとって参考になる可能性があります。

    Runway Charactersはリアルタイム動画モデルで、5年前と比較して生成能力が大幅に向上していることが示唆されていますが、詳細なスペックや価格情報は記事では明かされていません。

  2. 2

    自主视角视频处理平台上线,寻求实验室合作伙伴

    发生了什么:一家创业公司开发了一个平台,能够自动化自主视角和空间视频的数据准备(ETL)管道,将原始视频转换为机器人和视觉语言行动(VLA)模型开发所需的即用型输出。该团队正在公开招募研究实验室和企业免费测试该服务。 为什么重要:开发物理人工智能和遥操作系统的团队目前在视频数据预处理上花费大量GPU时间和工程资源——这正是该平台旨在消除的瓶颈。通过在上游处理数据管道工作,它释放了计算资源和工程周期,让团队能专注于核心模型开发。

    值得关注:该优惠仅限于愿意提供反馈的实验室;感兴趣的团队可通过评论或直接消息讨论参与事宜。目前未公布定价、上线日期或正式推出时间表。

  3. 3

    Midjourney收购占星术应用Co-Star

    发生了什么:以图像和视频生成器著称的AI实验室Midjourney收购了社交占星术应用Co-Star。交易条款未披露。Co-Star约二十名员工已加入Midjourney。 为什么重要:Co-Star拥有约430万月活跃用户,利用AI和人工撰写生成星座运势和占星兼容性评估。此次收购表明Midjourney正在扩展业务范围,从核心的图像生成业务向面向消费者的应用拓展,这也延续了其建立医疗和水疗部门的努力。

    值得关注:Midjourney目前主要通过Discord运营,没有独立应用。Co-Star团队在开发消费者应用方面的经验表明Midjourney可能最终会开发自己的独立应用。

  4. 4

    Black Forest Labs推出FLUX 3多模态模型,涵盖视频、音频和机器人领域

    发生了什么:Black Forest Labs宣布推出FLUX 3,这是一个统一的多模态模型,采用单一架构训练,可处理图像、视频、音频生成和动作预测。该公司还推出了FLUX-mimic,这是一个基于FLUX 3的视频动作机器人模型,已与奥迪合作测试,用于在单个本地GPU上进行实际工厂部署。 为什么重要:FLUX 3再现并扩展了其他前沿实验室(Gemini Omni、Grok Imagine、Seedance 2.0)之前分别展示的功能,该团队承诺推出一个开放权重开发者版本。机器人应用表明视频世界建模可以直接转移到机器人控制,可能会降低实验室构建具有竞争力的开源模型的门槛,而无需依赖封闭生态系统。

    需要关注:FLUX 3 Video目前处于早期测试阶段。该模型在单一架构中统一图像、视频、音频和机器人控制的能力——通过联合训练而非作为独立模块——将决定多模态系统是否成为行业标准,还是仍然被任务分割。

  5. 5

    研究发现:AI视频即使标注也会动摇人们对真实视频的信任

    发生了什么:研究人员进行了分两个阶段的研究,共有100名参与者,对比了接触AI生成视频的人群与观看人类生成视频的对照组。AI接触组随后与对照组一起观看了人类生成的内容,结果报告称对后续视频的真实性产生了更多疑虑、对自身判断力的信心下降、感知干扰加剧、社交联系感减弱——尽管清晰标注了合成内容为AI生成。 为什么重要:研究结果表明,仅仅标注AI生成的视频并不能防止其破坏观众对真实视频的信任。这说明观看逼真合成内容的心理和感知效应会转移到真实素材上,即使观众知道其来源。对于平台和内容创作者来说,这表明需要采用超越检测和披露的策略来保护人们对视觉媒体的体验和信任。

    值得关注的是:该研究强调设计和政策方法必须解决AI生成视频曝露的体验和心理影响,而不仅仅关注区分假视频和真视频。这项研究在2026年CHI人机交互因素会议上发表。

  6. 6

    Black Forest Labs、音声生成対応の動画AI「Flux 3」発表

    Black Forest LabsがFlux 3を発表しました。このマルチモーダル基盤モデルは、画像・動画・音声から学習し、ネイティブ音声を含む動画を生成できます。これは同社にとって初めての機能です。 BFLの内部テストでは、Flux 3が市場リーダーのSeedance 2.0をわずかに上回る性能を示しました。ただし、独立したベンチマーク結果はまだ利用できません。

    Black Forest Labsは最終的に世界モデルの構築を目指しており、すでにFlux 3をロボティクスタスクでテストしています。

接下来关注

随着 Runway Characters、FLUX 3 Video 等实时视频生成模型的快速进展,以及 Midjourney 可能推出独立应用等产品动向,视频生成技术即将进入更成熟的商业化阶段。同时,AI生成视频如何影响人们的体验和心理健康、多模态系统是否成为行业标准等问题,将成为决定这一技术未来发展方向的关键课题。

来源

Share this with a friend

Send today's roundup to anyone who wants to keep up.

Get daily AI news free with AIToday

200+ AI sources, summarized in 1 minute. Email / LINE / Slack.

Sign up free