AITodaySeu digest de notícias de IA

Video Generation

Jul 24, 2026

Video Generation

Resumo do dia

A Black Forest Labs lançou o modelo FLUX 3, capaz de gerar vídeo, áudio e conteúdo para robótica de forma integrada, marcando um avanço significativo na geração multimídia com IA. Enquanto isso, um estudo alerta que vídeos gerados por IA estão abalando a confiança do público em vídeos reais, mesmo quando identificados como sintéticos, levantando preocupações sobre a credibilidade de conteúdo visual online.

Principais notícias

  1. 1

    Plataforma de processamento de vídeo egocêntrico é lançada e busca parcerias com laboratórios

    O que aconteceu: Uma startup desenvolveu uma plataforma que automatiza o pipeline de preparação de dados (ETL) para vídeo egocêntrico e espacial, convertendo vídeos brutos em saídas prontas para modelos de robótica e desenvolvimento de modelos de visão-linguagem-ação (VLA). O time está recrutando abertamente laboratórios e empresas de pesquisa para testar o serviço gratuitamente. Por que importa: Equipes que desenvolvem IA física e sistemas de teleoperação gastam atualmente tempo significativo de GPU e esforço de engenharia no pré-processamento de dados de vídeo — um gargalo que a plataforma foi projetada para eliminar. Ao lidar com a infraestrutura de dados a montante, libera recursos computacionais e ciclos de engenharia para o trabalho principal do modelo.

    O que acompanhar: A oferta é limitada a laboratórios dispostos a fornecer feedback; equipes interessadas são convidadas a comentar ou enviar mensagem diretamente para discutir participação. Nenhum preço, data de disponibilidade ou cronograma oficial de lançamento foi divulgado.

  2. 2

    Midjourney adquire aplicativo de astrologia Co-Star

    O que aconteceu: Midjourney, laboratório de IA conhecido por geradores de imagens e vídeos, adquiriu o aplicativo de astrologia social Co-Star. Os termos do acordo não foram divulgados. O time de cerca de duas dúzias de funcionários da Co-Star se juntou à Midjourney. Por que é importante: Co-Star tem aproximadamente 4,3 milhões de usuários mensais ativos e utiliza IA e redação humana para gerar horóscopos e avaliações de compatibilidade astrológica. A aquisição sinaliza a expansão da Midjourney para além de seu negócio principal de geração de imagens, em direção a aplicativos voltados para o consumidor, seguindo seus esforços para construir divisões de medicina e spa.

    O que acompanhar: Midjourney opera atualmente principalmente por meio do Discord, sem um aplicativo independente. A experiência do time da Co-Star em construir aplicativos para consumidores sugere que Midjourney pode finalmente desenvolver sua própria aplicação independente.

  3. 3

    Black Forest Labs lança modelo multimodal FLUX 3 abrangendo vídeo, áudio e robótica

    O que aconteceu: A Black Forest Labs anunciou o FLUX 3, um modelo multimodal unificado treinado em uma única arquitetura que manipula geração de imagem, vídeo, áudio e previsão de ações. A empresa também apresentou o FLUX-mimic, um modelo de robótica vídeo-ação construído sobre o FLUX 3 e testado com a Audi para implantação em fábrica real em uma única GPU local. Por que importa: O FLUX 3 reproduz e estende capacidades demonstradas anteriormente de forma separada por outros laboratórios de fronteira (Gemini Omni, Grok Imagine, Sora 2.0), com o time se comprometendo a abrir uma versão de código aberto para desenvolvedores. A aplicação em robótica sinaliza que a modelagem de mundo em vídeo pode se transferir diretamente para controle de robôs, potencialmente reduzindo barreiras para laboratórios que constroem modelos abertos competitivos sem depender de ecossistemas fechados.

    O que acompanhar: FLUX 3 Video está atualmente em acesso antecipado. A capacidade do modelo de unificar controle de imagem, vídeo, áudio e robótica em uma única arquitetura—treinada conjuntamente em vez de como módulos separados—determinará se sistemas multimodais se tornam padrão industrial ou permanecem fragmentados por tarefa.

  4. 4

    Vídeos de IA Abalando a Confiança em Vídeos Reais Mesmo com Identificação, Aponta Estudo

    O que aconteceu: Pesquisadores conduziram um estudo em duas fases com 100 participantes, comparando aqueles expostos a vídeos gerados por IA com um grupo de controle que assistiu a vídeos produzidos por humanos. O grupo exposto a IA posteriormente viu conteúdo gerado por humanos junto com o grupo de controle e relatou maior dúvida sobre a autenticidade de vídeos subsequentes, menor confiança em seu julgamento, maior perturbação perceptual e menor conectividade social — apesar da divulgação clara de que o conteúdo sintético era gerado por IA. Por que é importante: As descobertas revelam que simplesmente identificar vídeos gerados por IA não impede que eles minem a confiança dos espectadores em vídeos reais. Isso sugere que os efeitos psicológicos e perceptuais de ver conteúdo sintético realista se estendem para filmagens genuínas, mesmo quando os espectadores conhecem a origem. Para plataformas e criadores de conteúdo, isso indica a necessidade de estratégias além de detecção e divulgação para proteger como as pessoas experimentam e confiam em mídia visual.

    O que observar: A pesquisa destaca que abordagens de design e política devem considerar os impactos experienciais e psicológicos da exposição a vídeos gerados por IA, não apenas focar em distinguir falso de real. O estudo foi apresentado na Conferência CHI 2026 sobre Fatores Humanos em Sistemas de Computação.

  5. 5

    Black Forest Labs lança Flux 3 com geração nativa de áudio e vídeo

    O que aconteceu: A empresa alemã de IA Black Forest Labs lançou o Flux 3, um modelo de fundação multimodal que aprende a partir de imagens, vídeos e áudio em conjunto. O modelo consegue gerar vídeos com áudio nativo de até 20 segundos de duração pela primeira vez, suportando text-to-video, image-to-video, video-to-video, transições baseadas em keyframes, diálogo multilíngue e links orientados por agentes entre clipes. Por que importa: Em avaliações iniciais utilizando clipes de 10 segundos em 720p, o Flux 3 foi preferido em relação a múltiplos rivais: 93% em comparação ao Luma Ray 3.2, 77% em relação ao Runway Gen-4.5 e 69% em relação ao Grok Imagine Video. Contra concorrentes mais fortes, igualou ou aproximou-se do Seedance 2.0 e do Gemini Omni Flash (cada um com 52% de preferência), que já servem fluxos de produção importantes. A BFL também desenvolveu o Flux-mimic, um modelo de ação em vídeo sendo testado em tarefas de produção na Audi, sugerindo que a arquitetura se estende a aplicações robóticas.

    Pontos a observar: O Flux 3 Image está previsto para ser lançado em acesso antecipado nas próximas semanas, com melhorias em prompts complexos e renderização de texto multilíngue. A predição de ação será inicialmente oferecida através de parceiros selecionados. A BFL planeja acesso de peso aberto ao backbone multimodal sob o nome 'Flux 3 Dev', com trabalho de longo prazo em um modelo único que combine predição de percepção, ação e linguagem.

  6. 6

    Criador produz filme de longa-metragem usando LLM e o considera um fracasso

    O que aconteceu: Um criador de conteúdo utilizou um LLM (Claude Fable 5) para produzir uma adaptação cinematográfica de longa-metragem de The House on the Borderland, de William Hope Hodgson, que foi enviada para seu canal no YouTube junto com videoclipes e álbuns gerados por IA. Por que importa: O experimento testa se grandes modelos de linguagem conseguem sustentar produção criativa ao longo de um projeto de longa duração sem intervenção humana—uma questão relevante para determinar quais tipos de trabalho criativo permanecem além das capacidades atuais da IA, mesmo quando há tempo e autonomia para operar independentemente.

    O que observar: O criador apresenta o resultado como um fracasso apesar de tê-lo publicado, observando que o avaliou apenas pelos padrões de canal do YouTube e não como filme enquanto categoria; atribui a deficiência não à capacidade de planejamento do LLM, mas a outros fatores que discute no artigo completo.

Em breve

Acompanhe o desenvolvimento do Midjourney em relação a um possível aplicativo independente e o lançamento iminente do Flux 3 Image com melhorias em prompts complexos e renderização multilíngue, enquanto a comunidade observa se sistemas multimodais unificados como o FLUX 3 Video estabelecerão um novo padrão industrial. Simultaneamente, fique atento às discussões emergentes sobre os impactos psicológicos e experienciais de vídeos gerados por IA, além de como criadores e pesquisadores estão reavaliando os critérios de qualidade e sucesso em conteúdo produzido por modelos de IA.

Fontes

Share this with a friend

Send today's roundup to anyone who wants to keep up.

Get daily AI news free with AIToday

200+ AI sources, summarized in 1 minute. Email / LINE / Slack.

Sign up free