Video Generation
Jul 27, 2026

今日要点
视频生成领域今日动态频繁,Black Forest Labs推出了FLUX 3多模态模型,涉及视频、音频和机器人等多个领域,同时Midjourney收购占星应用Co-Star以扩展其AI能力。与此同时,研究表明AI生成视频即使被标注也会削弱观众对真实视频的信任,而创作者尝试用大语言模型制作长篇电影的实验则宣告失败。
主要新闻
- 1
自我中心视频处理平台推出,寻求实验室合作伙伴
发生了什么:一家初创公司开发了一个平台,可以自动化自我中心视频和空间视频的数据准备(ETL)管道,将原始视频转换为机器人和视觉-语言-动作(VLA)模型开发所需的可用输出。该团队公开招募研究实验室和公司免费测试该服务。 为何重要:从事物理人工智能和遥操作系统开发的团队目前在视频数据预处理上花费了大量GPU时间和工程力量——这正是该平台旨在消除的瓶颈。通过在上游处理数据管道,它可以释放计算资源和工程力量用于核心模型工作。
值得关注:该服务仅向愿意提供反馈的实验室开放;感兴趣的团队可以评论或直接发送消息讨论参与事宜。目前尚未公布定价、可用日期或正式推出时间表。
- 2
Midjourney收购占星应用Co-Star
发生了什么:以图像和视频生成器著称的AI实验室Midjourney已收购社交占星应用Co-Star。交易条款未披露。Co-Star约20名员工已加入Midjourney。 为什么重要:Co-Star拥有约430万月活跃用户,利用AI和人工撰写生成星座运势和占星相容性评估。此次收购表明Midjourney正在扩展业务范围,超越核心图像生成业务,进军面向消费者的应用领域,之前已在医疗和水疗部门有所涉足。
值得关注:Midjourney目前主要通过Discord运营,没有独立应用。Co-Star团队在开发消费者应用方面的经验表明Midjourney可能最终会推出自己的独立应用。
- 3
Black Forest Labs推出FLUX 3多模态模型,涵盖视频、音频和机器人领域
发生了什么:Black Forest Labs宣布推出FLUX 3,这是一个统一的多模态模型,采用单一架构训练,可以处理图像、视频、音频生成以及动作预测。该公司还推出了FLUX-mimic,一个基于FLUX 3的视频动作机器人模型,已与奥迪合作测试,计划在单个本地GPU上进行工厂实际部署。 为什么重要:FLUX 3复现并扩展了其他前沿实验室(Gemini Omni、Grok Imagine、Seedance 2.0)先前分别展示的能力,该团队承诺推出开放权重的开发者版本。机器人应用表明视频世界建模可以直接转移到机器人控制,有望为开发竞争力强的开源模型的实验室降低门槛,而无需依赖封闭生态系统。
值得关注:FLUX 3 Video目前处于早期测试阶段。该模型在单一架构中统一图像、视频、音频和机器人控制的能力——通过联合训练而非作为独立模块——将决定多模态系统是成为行业标准还是仍按任务类型碎片化。
- 4
AI生成视频削弱观众对真实视频的信任 即使有标签也难以阻止
发生了什么:研究人员进行了一项分为两个阶段的研究,100名参与者分别接触AI生成视频和人工生成视频(对照组)。接触AI视频的组随后与对照组一起观看人工生成内容,结果报告称对后续视频的真实性产生了更多疑虑,对自身判断的信心下降,感知干扰加剧,社交联系感降低——尽管合成内容已明确标注为AI生成。 为何重要:研究发现仅仅标注AI生成视频无法阻止其削弱观众对真实视频的信任。这表明观看逼真合成内容的心理和感知效应会转移到真实素材上,即使观众知道其来源。对于平台和内容创作者而言,这意味着需要采取超越检测和披露的策略来保护人们如何体验和信任视觉媒体。
值得关注:该研究强调,设计和政策方案必须解决AI生成视频接触的体验和心理影响,而不仅仅专注于区分虚假和真实内容。该研究在2026年CHI人机交互系统会议上发表。
- 5
Black Forest Labs、音声付き動画生成 Flux 3を公開
Black Forest LabsがFlux 3を発表しました。画像・動画・音声から学習するマルチモーダル基盤モデルで、ネイティブな音声付き動画生成を初めて実現します。最長20秒の動画を生成できます。 Black Forest Labsの社内テストでは、市場リーダーのSeedance 2.0をわずかに上回る性能を示しており、動画生成技術における競争が進展していることを示しています。独立した評価はまだ利用できません。
同社はFlux 3をロボティクスタスクでも試験中であり、最終的には世界モデル(現実世界の複雑な相互作用を学習するAI)の構築を目指しています。
- 6
创作者用LLM制作长篇电影,称其为失败
发生了什么:一位内容创作者使用LLM(Claude Fable 5)制作了威廉·霍普·霍奇森《边境之屋》的长篇电影改编版本,并将其与音乐视频和AI生成专辑一起上传到YouTube频道。 为什么重要:该实验测试了大型语言模型是否能够在整个完整项目中维持创意输出而不需要人工干预——这个问题关系到什么样的创意工作仍然超出当前AI能力范围,即使给予AI充足的时间和独立运作的权限。
值得关注:尽管发布了该作品,创作者将结果定性为失败,指出他们仅以YouTube频道标准而非整部电影作为一个完整类别来评判;他们将这种不足归因于其他因素而非LLM的代理能力或规划能力,这些因素在完整文章中有详细讨论。
接下来关注
随着 Midjourney 有望推出独立应用、FLUX 3 Video 进入早期测试阶段,以及 AI 视频生成技术在多模态和机器人控制等领域的快速进展,这些工具距离更广泛的商业化和应用还需要时间成熟,同时围绕 AI 生成内容的心理影响和伦理政策的讨论也将成为决定其最终普及方式的关键因素。
来源
- [Showcase] Built a processing engine for egocentric video and looking for labs to test it out for free
- Midjourney acquired the astrology app Co-Star
- [AINews] Black Forest Labs FLUX 3 - Multimodal Flow Models that beat Seedance 2.0, Gemini Omni and Grok Imagine, and FLUX-mimic video-action robotics model
- Seeing Is Not Believing: Realistic AI Videos Disrupt Confidence in Real Videos
- Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs
- Can an LLM make a feature-length movie on its own?
- Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
- Runway launches AI model router as generative media gets crowded
- Synthesia’s AI training platform is moving beyond videos into live coaching
- Making AI Movies
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free