Image Generation
Jul 24, 2026

今日要点
Midjourney收购了占星应用Co-Star并任命其创始人为首席设计官,而Black Forest Labs推出了功能更强大的FLUX 3多模态模型,支持图像、视频和音频生成,进一步推动了AI图像生成技术的发展。新兴平台如Textideo和Tuziyo也随之推出,让用户能够在一个界面内比较和使用多个AI生成工具。
主要新闻
- 1
Midjourney收购占星应用Co-Star,任命创始人为首席设计官
发生了什么:AI图像生成初创公司Midjourney在春季完成了对个性化占星应用Co-Star的收购。Co-Star创始人Banu Guler将继续领导该应用,同时还将成为Midjourney的首席设计官。 为什么重要:Co-Star结合人类洞察、NASA数据和AI技术提供个性化的每日星座运势和配对分析。此次收购表明Midjourney正在扩展业务范围,从图像生成拓展到消费级应用,而Guler的设计专长可能有助于Midjourney塑造其首批专属应用。
值得关注:Midjourney计划开发首批应用,其中包括一款专注于图像生成的应用。目前Midjourney的AI模型通过网络和Discord运行,这些新应用代表着向独立产品的转变。交易条款尚未披露。
- 2
Midjourney收购占星应用Co-Star
发生了什么:以图像和视频生成器闻名的AI实验室Midjourney已收购社交占星应用Co-Star。交易条款未披露。Co-Star约二十名员工已加入Midjourney。 为什么重要:Co-Star拥有约430万月度活跃用户,利用AI和人工撰写生成星座运势和占星相容性评估。此次收购表明Midjourney正在从核心图像生成业务扩展到面向消费者的应用,之前该公司还曾努力建立医疗和水疗部门。
需要关注:Midjourney目前主要通过Discord运营,没有独立应用。Co-Star团队在开发消费者应用方面的经验表明Midjourney可能最终会开发自己的独立应用。
- 3
Black Forest Labs推出FLUX 3多模态模型,涵盖视频、音频和机器人
发生了什么:Black Forest Labs宣布推出FLUX 3,这是一个统一的多模态模型,采用单一架构训练,可处理图像、视频、音频生成和动作预测。该公司还推出了FLUX-mimic,这是一个基于FLUX 3的视频动作机器人模型,已与奥迪合作测试,可在单个本地GPU上进行真实工厂部署。 为何重要:FLUX 3再现并扩展了其他前沿实验室(Gemini Omni、Grok Imagine、Seedance 2.0)之前单独演示的能力,该团队致力于推出开放权重的开发者版本。机器人应用表明视频世界建模可直接转移到机器人控制,可能降低实验室构建有竞争力的开放模型的门槛,无需依赖封闭生态系统。
值得关注:FLUX 3 Video目前处于早期测试阶段。该模型在单一架构中统一图像、视频、音频和机器人控制的能力——采用联合训练而非作为单独模块——将决定多模态系统是否成为行业标准,还是继续按任务分散。
- 4
Flux 3为Textideo平台带来文本生成图像和视频功能
发生了什么:AI视觉智能工具Flux 3现已在Textideo平台上线,用户可通过文本提示生成逼真的图像和视频。该工具支持文本生成图像和图像生成视频的工作流程,免费用户和高级用户均可使用——高级用户可以离开后稍后查看结果,而免费用户必须保持页面打开,否则任务会被取消。 为什么重要:Flux 3降低了创意工作者、营销人员和设计师进行专业视觉内容创作的门槛,无需编码或设计经验。平台自动处理构图、细节和风格,使用户能够专注于创意方向而非技术执行。Textideo将整个工作流程——从提示词到生成、预览和导出——整合到一个生态系统中。
需要关注的是:该平台表示已被全球1万多名创意工作者信任。用户可在多种工作流程中探索该工具,包括电商视觉、营销物料、社交媒体资产、广告内容和数字艺术作品,结果根据用户级别可以即时或按需提供。
- 5
Tuziyo登場、複数のAI画像生成モデルを一つのスタジオで比較
Tuziyo という AI 画像生成ツールが公開されました。複数の AI 画像生成モデルを同じインターフェース内で比較できるスタジオを提供しています。 ユーザーは異なるモデルの出力結果を並べて検証できるため、用途に応じた最適なモデルを効率よく選定できます。画像生成 AI の活用が進む中、複数モデルの一括比較は開発者やデザイナーの判断時間を短縮する可能性があります。
詳細な機能や利用可能なモデル数、価格については記事内に明記されていません。
- 6
Black Forest Labs发布FLUX 3 支持图像与20秒视频音频生成
Black Forest Labs今日推出FLUX 3,这是一个多模态模型,能从单个提示词生成图像、长达20秒的音频视频片段,以及用于机器人视觉和动作的功能。该公司表示FLUX 3是跨模态联合训练的,而非组合独立的图像、视频和音频模型。 这是Black Forest Labs首次发布公开的视频生成模型。公司将创意生成、模拟、计算机使用和机器人技术视为单一"视觉智能"能力的相关应用,该能力可以"感知、预测和作用于物理和数字环境"——这种跨模态架构可能意味着企业在这些领域有了更统一的工具。
FLUX 3将通过四条产品线提供,包括FLUX 3 Video、FLUX 3 Image、FLUX 3 Act,但初期为限量发布。
接下来关注
未来值得关注的是,Midjourney正从Discord平台向独立应用迈进,这将改变用户的使用方式和产品体验;同时,FLUX 3在单一架构中统一图像、视频和音频等多种能力的成功与否,将决定多模态AI系统是采用统一方案还是保持任务分散的行业方向。
来源
- Midjourney bought the astrology app Co-Star
- Midjourney acquired the astrology app Co-Star
- [AINews] Black Forest Labs FLUX 3 - Multimodal Flow Models that beat Seedance 2.0, Gemini Omni and Grok Imagine, and FLUX-mimic video-action robotics model
- Flux 3: From AI image generation to visual intelligence
- Show HN: Tuziyo – Compare multiple AI image models in one studio
- Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
- Anyone heading to Jeju for KDD? Let's meet up! 🙋[D]
- Neill Blomkamp’s new zombie AI ‘film’ is just slop warmed over
- Disney's Ozzy Fox is going viral thanks to 'AI slop' accusations
- Alibaba's Qwen-Image-3.0 renders full infographic grids and readable ten-pixel text in a single pass
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free