Video Generation
Jul 25, 2026

Resumo do dia
A Black Forest Labs lançou o modelo FLUX 3, uma solução avançada que gera vídeo, áudio e conteúdo para robótica de forma integrada, enquanto a Midjourney expandiu seus negócios adquirindo o app de astrologia Co-Star. Paralelamente, um estudo alerta que vídeos gerados por IA abalaram a confiança nas gravações reais mesmo quando claramente identificados como sintéticos, levantando questões importantes sobre a credibilidade do conteúdo visual na era da inteligência artificial.
Principais notícias
- 1
Plataforma de processamento para vídeo egocêntrico é lançada e busca parcerias com laboratórios
O que aconteceu: Uma startup desenvolveu uma plataforma que automatiza o pipeline de preparação de dados (ETL) para vídeo egocêntrico e espacial, convertendo gravações brutas em saídas prontas para modelos no desenvolvimento de robótica e modelos de visão-linguagem-ação (VLA). A equipe está recrutando abertamente laboratórios de pesquisa e empresas para testar o serviço gratuitamente. Por que importa: Equipes que constroem sistemas de IA física e teleoperação atualmente gastam tempo significativo de GPU e esforço de engenharia no pré-processamento de dados de vídeo — um gargalo que a plataforma foi projetada para eliminar. Ao lidar com a infraestrutura de dados a montante, libera recursos computacionais e ciclos de engenharia para o trabalho de modelo principal.
O que observar: A oferta é limitada a laboratórios dispostos a fornecer feedback; equipes interessadas são convidadas a comentar ou enviar mensagem diretamente para discutir participação. Nenhum preço, data de disponibilidade ou cronograma formal de lançamento foi divulgado.
- 2
Midjourney adquire app de astrologia Co-Star
O que aconteceu: A Midjourney, laboratório de IA conhecido por seus geradores de imagem e vídeo, adquiriu o app de astrologia social Co-Star. Os termos do acordo não foram divulgados. A equipe de cerca de duas dúzias de funcionários da Co-Star se juntou à Midjourney. Por que é importante: A Co-Star possui cerca de 4,3 milhões de usuários ativos mensais e utiliza IA e redação humana para gerar horóscopos e avaliações de compatibilidade astrológica. A aquisição sinaliza a expansão da Midjourney além de seu negócio principal de geração de imagens em direção a apps voltados para consumidores, seguindo seus esforços para construir divisões de medicina e spa.
O que observar: A Midjourney atualmente opera principalmente através do Discord sem um app independente. A experiência da equipe da Co-Star na construção de apps para consumidores sugere que a Midjourney pode finalmente desenvolver sua própria aplicação independente.
- 3
Black Forest Labs lança modelo multimodal FLUX 3 abrangendo vídeo, áudio e robótica
O que aconteceu: Black Forest Labs anunciou o FLUX 3, um modelo multimodal unificado treinado em uma única arquitetura que realiza geração de imagem, vídeo, áudio e previsão de ações. A empresa também apresentou o FLUX-mimic, um modelo de robótica vídeo-ação construído sobre o FLUX 3 e testado com a Audi para implantação real em fábrica em uma única GPU local. Por que importa: FLUX 3 reproduz e estende capacidades anteriormente demonstradas separadamente por outros laboratórios de fronteira (Gemini Omni, Grok Imagine, Seedance 2.0), com a equipe comprometida em lançar uma versão aberta para desenvolvedores. A aplicação em robótica sinaliza que a modelagem de mundo em vídeo pode ser transferida diretamente para controle de robôs, potencialmente reduzindo barreiras para laboratórios que constroem modelos abertos competitivos sem dependência de ecossistemas fechados.
Pontos de atenção: FLUX 3 Video está atualmente em acesso antecipado. A capacidade do modelo de unificar imagem, vídeo, áudio e controle de robótica em uma única arquitetura—treinada conjuntamente em vez de como módulos separados—determinará se sistemas multimodais se tornam padrão da indústria ou permanecem fragmentados por tarefa.
- 4
Vídeos de IA Abalam a Confiança em Vídeos Reais Mesmo Quando Identificados, Aponta Estudo
O que aconteceu: Pesquisadores conduziram um estudo em duas fases com 100 participantes, comparando aqueles expostos a vídeos gerados por IA contra um grupo de controle que assistiu a vídeos gerados por humanos. O grupo exposto à IA então visualizou conteúdo gerado por humanos junto com o grupo de controle e relatou aumento de dúvida sobre a autenticidade de vídeos subsequentes, redução da confiança em seu julgamento, maior perturbação perceptual e menor conexão social — apesar da divulgação clara de que o conteúdo sintético era gerado por IA. Por que importa: Os resultados revelam que simplesmente identificar vídeos gerados por IA não impede que eles prejudiquem a confiança dos espectadores em vídeos reais. Isso sugere que os efeitos psicológicos e perceptuais de ver conteúdo sintético realista se transferem para material autêntico, mesmo quando os espectadores conhecem a origem. Para plataformas e criadores de conteúdo, isso indica a necessidade de estratégias além de detecção e divulgação para proteger como as pessoas experimentam e confiam em mídia visual.
O que observar: A pesquisa destaca que abordagens de design e política devem tratar dos impactos experienciais e psicológicos da exposição a vídeos gerados por IA, e não apenas focar em distinguir falso de verdadeiro. O estudo foi apresentado na Conferência CHI 2026 sobre Fatores Humanos em Sistemas Computacionais.
- 5
Black Forest Labs lança Flux 3 com geração nativa de áudio e vídeo
O que aconteceu: A empresa de IA alemã Black Forest Labs lançou o Flux 3, um modelo de fundação multimodal que aprende com imagens, vídeos e áudio em conjunto. O modelo consegue gerar vídeos com áudio nativo de até vinte segundos pela primeira vez, suportando texto-para-vídeo, imagem-para-vídeo, vídeo-para-vídeo, transições baseadas em keyframes, diálogos multilíngues e ligações orientadas por agentes entre clipes. Por que importa: Em avaliações iniciais usando clipes de dez segundos em 720p, o Flux 3 foi preferido em relação a múltiplos concorrentes: noventa e três por cento sobre Luma Ray 3.2, setenta e sete por cento sobre Runway Gen-4.5 e sessenta e nove por cento sobre Grok Imagine Video. Contra concorrentes mais fortes, igualou ou chegou perto do Seedance 2.0 e Gemini Omni Flash (cada um com cinquenta e dois por cento de preferência), que já servem fluxos de trabalho de produção em larga escala. A BFL também desenvolveu o Flux-mimic, um modelo de ação em vídeo sendo testado em tarefas de produção na Audi, sugerindo que a arquitetura se estende a aplicações em robótica.
Fique atento: Flux 3 Image será lançado em acesso antecipado nas próximas semanas, com melhorias em prompts complexos e renderização de texto multilíngue. A previsão de ações será oferecida inicialmente através de parceiros selecionados. A BFL planeja acesso em pesos abertos à estrutura multimodal sob o nome 'Flux 3 Dev', com trabalho de longo prazo em um único modelo que combine predição de percepção, ação e linguagem.
- 6
Criador produz filme de longa-metragem usando LLM e o classifica como fracasso
O que aconteceu: Um criador de conteúdo utilizou um LLM (Claude Fable 5) para produzir uma adaptação cinematográfica de longa-metragem de The House on the Borderland, de William Hope Hodgson, que foi enviada para seu canal do YouTube junto com videoclipes e álbuns gerados por IA. Por que importa: O experimento testa se grandes modelos de linguagem conseguem sustentar a produção criativa ao longo de um projeto de comprimento total sem intervenção humana—uma questão que incide sobre que tipos de trabalho criativo permanecem além das capacidades atuais da IA, mesmo quando lhes é concedido tempo e liberdade para operarem independentemente.
O que observar: O criador enquadra o resultado como fracasso apesar de tê-lo lançado, observando que o avaliou apenas segundo os padrões de canal do YouTube e não o cinema como categoria inteira; atribui a insuficiência não à autonomia ou ao planejamento do LLM, mas a outros fatores que discute na íntegra do artigo.
Em breve
Fique atento ao lançamento do Flux 3 Image nas próximas semanas e à possível evolução da Midjourney para um aplicativo independente, sinais de como a indústria está consolidando ferramentas de IA generativa em plataformas mais acessíveis. Simultaneamente, acompanhe o desenvolvimento de arquiteturas verdadeiramente multimodais como o Flux 3 Video e a crescente atenção à pesquisa sobre impactos psicológicos dos vídeos gerados por IA—questões que definirão não apenas a capacidade técnica, mas também a responsabilidade ética dessas tecnologias nos próximos anos.
Fontes
- [Showcase] Built a processing engine for egocentric video and looking for labs to test it out for free
- Midjourney acquired the astrology app Co-Star
- [AINews] Black Forest Labs FLUX 3 - Multimodal Flow Models that beat Seedance 2.0, Gemini Omni and Grok Imagine, and FLUX-mimic video-action robotics model
- Seeing Is Not Believing: Realistic AI Videos Disrupt Confidence in Real Videos
- Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs
- Can an LLM make a feature-length movie on its own?
- Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
- Runway launches AI model router as generative media gets crowded
- Synthesia’s AI training platform is moving beyond videos into live coaching
- Making AI Movies
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free