Notícias de IA para geração de imagens e vídeos — 2026-10-02
Modelos chineses de código aberto (Qwen-Image-2.1, Z-Image Turbo) estão se aproximando dos líderes de código fechado, justamente quando a confiança no código fechado se deteriora por causa de guardrails, uso indevido e a economia do Sora.
Notícias de IA para geração de imagens e vídeos — 2026-10-02
Sério, o cenário de IA para geração de imagens e vídeos está uma loucura agora 😤. O pessoal do código fechado (GPT Image 2.5 da OpenAI, Veo 3.1/Nano Banana 2.0 do Google, Kling 2.5, Seedance 2.5 e por aí vai) não para na corrida por novos recursos, mas, ao mesmo tempo, também avançam histórias que derrubam a confiança, como reforço de guardrails, deepfakes e prejuízos enormes do Sora 💸. Já no campo aberto, empresas chinesas como a Alibaba (Qwen-Image-2.1, Z-Image Turbo) estão ganhando muito impulso, e uma cultura de experimentar pesado localmente, com o ComfyUI no centro, foi confirmada no Reddit, Lemmy e Bluesky 🔥. Desta vez, foram analisadas seis plataformas — Reddit, X, YouTube, Bluesky, Lemmy e Pinterest —, mas o X foi um fracasso completo, então isso será relatado com honestidade abaixo 👇.
Entre plataformas
- O código aberto chinês está em ascensão e frequentemente é apresentado como “alternativa ao fechado” 🇨🇳 No YouTube, dizem que o Z-Image Turbo (6 bilhões de parâmetros e funcionamento com 6 GB de VRAM) superou o Flux 2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), e o Qwen-Image-Edit é avaliado como comparável ou superior ao Nano Banana (https://www.youtube.com/watch?v=AIgYj5RG-FQ). No Lemmy, interfaces WebUI e LoRAs em torno do Qwen-Image-2.1 apareceram juntas na mesma semana (https://github.com/ogoun/fooocus-qwen-image-2.1), enquanto Simon Willison fez testes práticos do Qwen-Image no Bluesky (https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223). Como isso está ocorrendo simultaneamente em várias plataformas, parece uma tendência real.
- O reforço dos guardrails está afastando usuários 🚪 No Reddit, há pessoas migrando das recusas do ChatGPT para Midjourney, Grok e Venice AI (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/), ou indo para Seedream Unfiltered e MiniMax H3 após filtros mais rígidos no DreamFort.ai (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). No Bluesky, especialistas alertam que pesos abertos como o GLM-5.3 têm “quase nenhum guardrail” (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o), e a polarização entre maior regulação e um ambiente sem regras aparece em todas as redes.
- A “confiança” em código fechado está sendo abalada simultaneamente por vários ângulos ⚠️ Há a investigação da TIME, difundida no Bluesky, sobre o Veo 3 conseguir criar vídeos falsos de um templo hindu em chamas (https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h), e o caso no Reddit de Photoshop/Apple Photos classificarem até recortes comuns como “edição por IA” e removerem créditos (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Uso indevido e rotulagem incorreta são problemas diferentes, mas ambos levam à percepção de que “não dá para confiar em ferramentas fechadas”.
- O ComfyUI virou claramente o espaço de trabalho padrão do ecossistema aberto 🛠️ Ele aparece no Reddit (nós para MiniMax-H3, https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/), no Lemmy (inpainting LanPaint, https://github.com/scraed/LanPaint/), no Bluesky (ilustrações diárias com Krea2, https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t) e no YouTube, onde tutoriais de instalação são lançados assim que surgem novos modelos.
- Comparações lado a lado viraram conteúdo consagrado 📊 Títulos do YouTube como “WAN 2.5 is Open Source Veo3”, comparações no Lemmy colorindo a mesma página dupla de Berserk com quatro modelos (https://www.reddit.com/gallery/1wfyqdy) e gráficos neon do Pinterest dizendo “se for pago, use este; se for gratuito, use aquele”. As pessoas parecem mais interessadas em saber qual é o melhor do que em notícias isoladas.
- A tese de que vídeo com IA para o consumidor não dá lucro foi corroborada por várias fontes 💰 Há um post no Bluesky que estima cerca de US$ 5 bilhões por ano de custo operacional para o Sora2 contra cerca de US$ 1,4 milhão de receita (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o), e uma análise no Lemmy de que a OpenAI encerraria a API do Sora em 24/9 enquanto empresas corporativas, como a Kling, levantavam recursos (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
Plataforma por plataforma
Reddit 🟠 Foram analisados 12 tópicos em 9 subreddits. No lado fechado, o maior destaque foi a discussão de que o Seedance 2.5, via Higgsfield, já permite a uma pessoa produzir um curta de 10 minutos com personagens consistentes (784 pontos, https://www.reddit.com/r/accelerate/comments/1wqqr4p/). No lado aberto, o nó ComfyUI para MiniMax-H3 foi elogiado como “o melhor nó que já usei” (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). É também onde as reclamações sobre guardrails aparecem de forma mais concreta.
X ⚫️ Aqui foi um fracasso completo 😅. As 40 publicações coletadas, de 33 contas, eram todas sobre futebol, K-pop, política britânica ou reality shows, sem qualquer conteúdo de IA para geração de imagens ou vídeos. Os termos usados na coleta eram tendências do X, como “Halloween”, “Ronaldo” e “#bb28”, em vez de palavras-chave de IA. Esta parte do X não trouxe informação útil para o relatório.
YouTube 🔴 No campo fechado, vídeos sobre o recurso “Sketch” do GPT Image 2.5 (https://www.youtube.com/watch?v=LYUr4BY33h4), a disponibilização gratuita do Veo 3.1 (https://www.youtube.com/watch?v=uj6eD31OxkA) e o Nano Banana 2.0 como “superior ao Photoshop” (https://www.youtube.com/watch?v=u22-XoQvI4I) apareceram ao mesmo tempo, indicando uma competição realmente rápida por recursos. No lado aberto, FLUX.2, Z-Image e Qwen-Image-Edit estão sendo produzidos em massa no formato de tutoriais sobre como executá-los no ComfyUI. Vale observar, porém, que visualizações, inscritos e comentários não puderam ser obtidos por causa da renderização em JavaScript; a análise se baseia em títulos e dados oEmbed.
Bluesky 🔵 Foram consultados diretamente mais de 100 registros reais pela API do AT Protocol. No lado fechado, o problema de geração de conteúdo racista pelo Veo 3 (❤️842, https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y) e a discussão sobre o colapso econômico do Sora2 (❤️1.375) tiveram enorme alcance. No lado aberto, pesquisadores que realmente testam modelos, como Simon Willison e Ethan Mollick, abordam Qwen-Image e GLM-5.3. Também foram confirmadas muitas postagens cotidianas usando ComfyUI + Krea2.
Lemmy 🟢 O principal núcleo é !«メールアドレス», mas as pontuações são pequenas, normalmente entre 1 e 10. Mesmo assim, ferramentas em torno do Qwen-Image-2.1 — WebUI, LoRA e ControlNet — foram publicadas repetidamente na mesma semana, mostrando impulso. Notícias de modelos fechados, como a interrupção da API do Sora e a retirada em um dia do recurso Google Earth do Nano Banana 2 por uso indevido (https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/), chegam em grande parte por meio do bot espelho do Reddit !ai_reddit, quase sem debate próprio do Lemmy.
Pinterest 🟣 De 50 itens, 18 foram abertos e verificados. Há uma predominância esmagadora de imagens-resumo de notícias do lado fechado — logotipos de OpenAI/Google/Meta/Grok com miniaturas de rostos surpresos —, enquanto o lado aberto quase só traz o AMD Amuse 3.0 como nome específico. Uma descoberta interessante é que demonstrações de pessoas fotorrealistas, com atenção a rugas e textura, são usadas por várias empresas como visual de benchmark. As métricas de engajamento, como salvamentos e curtidas, não puderam ser obtidas, e os pins disponíveis vieram apenas da coleta prévia.
O que acompanhar
- A velocidade de expansão do conjunto de ferramentas em torno do Qwen-Image-2.1 — WebUI, LoRA e ControlNet foram publicados em sequência no Lemmy na mesma semana (https://github.com/ogoun/fooocus-qwen-image-2.1). Vale acompanhar o que virá a seguir.
- Como os problemas econômicos do Sora2 afetarão a estratégia da OpenAI — tema em alta tanto no Bluesky (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o) quanto no Lemmy, com a interrupção da API do Sora (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
- A polarização entre regulação e ausência de regras, causada por guardrails — a mesma estrutura aparece por ângulos diferentes no Reddit (https://www.reddit.com/r/generativeAI/comments/1wtzefv/) e no Bluesky (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o).
- FLUX 3 da Black Forest Labs — é uma prévia fechada e limitada, com imagens e vídeos de 20 segundos com áudio, mas o FLUX.2 também está sendo lançado em pesos abertos (https://bfl.ai/blog/flux-3). Vale acompanhar como exemplo de fronteiras cada vez menos claras entre aberto e fechado.
- A linha de baixo consumo de VRAM do Z-Image / Qwen-Image — o YouTube afirma que supera o Flux2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), o que pode ampliar o público que roda modelos localmente.
- A necessidade de refazer a pesquisa no X — desta vez, a coleta falhou por usar tendências gerais. Uma nova coleta com termos diretos como "Midjourney", "Sora" e "Nano Banana" pode revelar descobertas interessantes.
Recomendações
- Na próxima rodada, o X (Twitter) deve ser pesquisado com palavras-chave diretas de IA, como "Midjourney", "Sora", "Nano Banana", "ComfyUI" e "Flux".
- O rápido crescimento do ecossistema Qwen-Image-2.1 deve continuar sendo acompanhado como ponto fixo para observar tendências de código aberto.
- A relação entre custo operacional e receita do Sora2 deve ser acompanhada como indicador da rentabilidade de modelos fechados de geração de vídeo.
- A migração de usuários causada por guardrails deve ser mapeada continuamente, identificando de quais ferramentas eles saem e para quais migram.
- O Pinterest deve ampliar a amostragem para os 50 itens ou buscar outro meio de obter métricas de engajamento.
- Considerando a dependência do Lemmy em relação ao !ai_reddit, que é essencialmente uma republicação do Reddit, as vozes próprias do Lemmy devem ser buscadas nas comunidades da família !stable_diffusion.
Qualidade dos dados
Os dados do X eram totalmente irrelevantes para o tema, pois resultaram de uma captura equivocada da aba de tendências, e não contribuíram para esta análise. No YouTube, a renderização em JavaScript impediu verificar visualizações, data de publicação, inscritos e comentários; a análise usou apenas títulos e dados oEmbed. No Pinterest, apenas 18 de 50 itens foram verificados visualmente, e não havia métricas de engajamento disponíveis. As postagens do Lemmy foram confirmadas, mas as pontuações geralmente ficaram entre 0 e 10, indicando menor intensidade de discussão que nas outras plataformas. Reddit e Bluesky permitiram análise baseada em dados reais e, portanto, têm confiabilidade relativa maior.
Resumo por plataforma
Reddit — Notícias de IA para geração de imagens e vídeos
Onde
9 subreddits abordaram este tema no conjunto coletado (12 tópicos no total, todos encontrados pela única busca "Image and Video Generation AI News"):
- r/generativeAI — 159.938 membros — 3 tópicos (#1, #2, #7)
- r/TopologyAI — 24.052 membros — 1 tópico (#3)
- r/StableDiffusion — 1.027.672 membros — 1 tópico (#4)
- r/LocalLLaMA — 838.632 membros — 1 tópico (#5)
- r/AI_Agents — 452.911 membros — 1 tópico (#6)
- r/accelerate — 93.680 membros — 2 tópicos (#8, #12)
- r/aifails — 39.194 membros — 1 tópico (#9)
- r/VideoEditors — 81.700 membros — 1 tópico (#10)
- r/mildlyinfuriating — 12.610.232 membros — 1 tópico (#11)
O que as pessoas dizem
- Geração de vídeo “gratuita” de código fechado é um mito, segundo consenso da comunidade — Tópico #1, r/generativeAI, 71 pontos, 46 comentários, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wty6zj/). O autor argumenta que os custos de GPU em nuvem impedem vídeo realmente gratuito e ilimitado; u/opengradient reforça: “vídeos não são como LLMs baratos, ninguém pode distribuí-los de graça” (5 pontos).
- A filtragem NSFW em código fechado está ficando mais rígida e levando usuários a alternativas abertas ou sem filtros — Tópico #2, r/generativeAI, 7 pontos, 14 comentários, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). O DreamFort.ai endureceu os filtros baseados em WAN 3.0; u/opengradient observa que “muitos provedores de modelos fechados introduziram recentemente controles mais rígidos, incluindo a Alibaba, dona do Wan 3.0” e aponta Seedream 2.0 Unfiltered e MiniMax H3 como alternativas.
- Fluxo de trabalho aberto + Blender 3D é apresentado como solução para controlar geração de vídeo, mas a comunidade não sabe se é real — Tópico #3, r/TopologyAI, 437 pontos, 19 comentários, 2026-09-28 (https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/). Apesar da alta pontuação, os principais comentários são perguntas confusas (“Qual é esta ‘IA 3D’?” — u/stevester911, 5 pontos) e uma rejeição direta de u/amon_de_no: “Isso é IA falsa” (5 pontos).
- Ferramentas abertas de consistência de referência para MiniMax-H3 foram extremamente bem recebidas — Tópico #4, r/StableDiffusion, 690 pontos, 51 comentários, 2026-09-30 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Um nó gratuito do ComfyUI, Fantastic-MiniMaxH3-PromptBuilder, corrigiu o vazamento de identidade em edições de vídeo com imagem de referência; u/ClassicUse2579: “O negócio do carregador de mídia H3 é um dos melhores nós do Comfy que já usei. É muito bom!” (3 pontos).
- Pilhas locais abertas de imagem e chat já são maduras o bastante para funcionar como atração curiosa — Tópico #5, r/LocalLLaMA, 194 pontos, 96 comentários, 2026-10-01 (https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/). Um Tandy 1000 dos anos 1990 é controlado por Wi‑Fi por Qwen3.8-27B + Krea 2 (ComfyUI) executados localmente, para chat e geração de imagens. O principal comentário, porém, contesta o enquadramento: u/Aggravating-Push-207 (113 pontos): “Isso não está rodando no Tandy; ele só está fazendo requisições dentro da sua rede doméstica.”
- Guardrails de código fechado frustram usuários casuais a ponto de enviá-los para alternativas — Tópico #6, r/AI_Agents, 0 pontos, 22 comentários, 2026-09-29 (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/). Um usuário não consegue fazer o ChatGPT renderizar um super-herói por recusas de guardrail; comentaristas sugerem Midjourney, Grok, VeniceAI e modelos abertos “uncensored sdxl”.
- Na faixa gratuita ou barata, ferramentas fechadas com créditos diários ainda dominam recomendações casuais — Tópico #7, r/generativeAI, 4 pontos, 59 comentários, 2026-09-26 (https://www.reddit.com/r/generativeAI/comments/1wqfleb/). As recomendações se dividem: u/Scuzzy_Womack sugere ComfyUI offline (3 pontos, aberto), enquanto outros indicam Yodayo/MoescapeAI e Leonardo pelos créditos gratuitos diários (fechados).
- Vídeo de código fechado, Seedance 2.5 via Higgsfield, já é bom o suficiente para um curta narrativo de 10 minutos feito por uma pessoa — Tópico #8, r/accelerate, 784 pontos, 196 comentários, 2026-09-26 (https://www.reddit.com/r/accelerate/comments/1wqqr4p/). Referências de fichas de personagens são usadas em cada tomada para manter Captain Walker consistente; u/JoseLunaArts (95 pontos) diz que a ideia de “sem orçamento” subestima o custo dos tokens, e u/Nabugu (7 pontos) aponta o problema recorrente de rostos de IA bonitos e iguais.
- A geração de imagens ainda falha de formas bobas e dignas de meme — uma rejeição tratada como entretenimento, não como tendência — Tópico #9, r/aifails, 526 pontos, 76 comentários, 2026-09-28 (https://www.reddit.com/r/aifails/comments/1ws6jzs/). Um prompt de anatomia de galinha produziu absurdo anatômico; o principal comentário de u/kasimirvendom: “Tudo tem um fim, só a galinha tem dois” (52 pontos).
- Editores de vídeo recebem instruções explícitas para ainda não depender de ferramentas de IA — Tópico #10, r/VideoEditors, 4 pontos, 39 comentários, 2026-09-26 (https://www.reddit.com/r/VideoEditors/comments/1wqkx27/). Comentário principal, de u/VisibleExplanation (33 pontos): “Esqueça qualquer ferramenta de IA. Baixe o Davinci Resolve e aprenda a usá-lo... Nenhuma ferramenta de IA dará bons resultados se você não tiver conhecimento fundamental do básico.”
- Ferramentas fechadas de edição que silenciosamente rotulam pequenas edições como “IA generativa” estão provocando reação de desconfiança — Tópico #11, r/mildlyinfuriating, 1.268 pontos, 136 comentários, 2026-09-28 (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Photoshop/Apple Photos supostamente classificam recortes simples como editados por IA e removem atribuição de direitos autorais; u/Kagevjijon (41 pontos): “Não tem como isso continuar assim. É roubo de verdade.” Há uma contestação de u/teh_maxh (135 pontos): “Acabei de tentar recortar uma foto com o Photoshop e ele não adicionou metadados dizendo que usei GAI.”
- Mods de jogos gerados por IA, abertos e conduzidos pela comunidade, estão vivendo um momento forte — Tópico #12, r/accelerate, 193 pontos, 35 comentários, 2026-09-30 (https://www.reddit.com/r/accelerate/comments/1wuhyiw/). u/Chopstik0-0 (38 pontos) descreve o subreddit de modding VR mudando da resistência para o entusiasmo quando ficou claro que “ninguém mais está realmente criando novos jogos VR”.
Sinais
- Em alta: Ferramentas abertas de consistência de referência — o nó ComfyUI do tópico #4 e a pilha local Qwen+Krea2 do tópico #5 — recebem os elogios mais inequívocos: pontuações altas acompanhadas de comentários técnicos e genuinamente positivos, não apenas hype.
- Em alta: A geração de vídeo fechada atravessou a barreira da narrativa longa — o curta de 10 minutos do tópico #8, com personagens recorrentes consistentes, é o tópico de maior engajamento coletado (784 pontos, 196 comentários), e as críticas da comunidade focam roteiro e atuação de voz, não os visuais.
- Descartado: A ideia de um gerador de vídeo fechado “realmente gratuito” é tratada como resolvida e um pouco cansativa, no tópico #1 — o debate mudou de “qual site gratuito” para “qual configuração local aberta”.
- Discordância: O tópico #3 revela uma divisão entre empolgação superficial (437 pontos) e ceticismo/confusão nos comentários sobre o que de fato está sendo mostrado — um lembrete de que postagens vagas sobre fluxos de “IA 3D” podem acumular pontos sem que ninguém concorde sobre qual é a ferramenta.
- Surpresa — guardrails agora são um motor recorrente de troca de plataforma, não apenas um incômodo: tanto o tópico #2, sobre filtragem NSFW mais rígida, quanto o tópico #6, sobre os guardrails do ChatGPT bloqueando uma imagem não explícita de super-herói, mostram usuários abandonando uma ferramenta fechada especificamente por moderação e indo para outra fechada, como Grok ou VeniceAI, ou aberta, como Seedream Unfiltered ou SDXL sem censura.
- Surpresa — a reação de desconfiança contra ferramentas fechadas não tem relação com filtros de conteúdo no tópico #11: trata-se de atribuição e metadados — rotular edições comuns como “IA generativa” e remover informação autoral —, uma reclamação distinta da frustração com guardrails vista no restante do conjunto.
Limites
- O coletor usou apenas um termo de busca, “Image and Video Generation AI News”, encontrando 12 tópicos em 9 subreddits — abaixo da meta de aproximadamente 20 publicações por rede definida nos critérios. Conforme o playbook, foi lido somente o que o trabalhador já havia coletado em
output/reddit.threads.md, sem busca adicional no Reddit, pois ele bloqueia WebFetch e páginas alcançadas por busca na web. - Os tópicos #9, #11 e #12 não tinham texto de abertura capturado, apenas título; por isso, as conclusões dependem inteiramente de comentários e pontuações.
- Nenhum tópico trouxe anúncios importantes de laboratórios fechados, como lançamento nominal de modelo pela OpenAI, Google ou Midjourney — o conjunto coletado é inclinado para experiência do usuário, ferramentas e fricção com guardrails, não para notícias de lançamentos.
X
X — Notícias de IA para geração de imagens e vídeos
Contas
Nenhuma conta nos dados coletados discute IA para geração de imagens ou vídeos,
de código fechado ou aberto. As 33 contas registradas aqui (@Davesonude,
@rcostadoazeite, @ChrisExcel102, @Louissaikyoo, @DlugoszMarcin, @khtaeverse
e outras 27) são contas de memes de esporte, fãs de K-pop, fãs de Big Brother
(#BB28), contas políticas do Reino Unido (Restore Britain) e contas gerais de
memes/shitposts. Nenhuma publica sobre ferramentas de IA de imagem ou vídeo
como tema principal; portanto, não há “quem está impulsionando isso no X” a
relatar para o tema de pesquisa — ver ## Limites.
Publicações
Nenhuma publicação em output/x.posts.md (40 publicações, 33 contas) menciona
IA de geração de imagens, IA de geração de vídeo ou qualquer produto, empresa
ou projeto de código aberto relacionado, sem referências a Midjourney, Sora,
Stable Diffusion, Flux, Runway, Veo, Nano Banana, ComfyUI ou similares. Uma
verificação pontual das publicações de maior engajamento confirma isso:
- Publicação #7, @Davesonude, cerca de 291.000 visualizações, 22.958 curtidas (2026-09-30),
https://x.com/Davesonude/status/2105273235965370529 — meme de futebol sobre Ronaldo.
Encontrado pela busca por “Ronaldo”. - Publicação #19, @ChrisExcel102, cerca de 343.000 visualizações, 7.886 curtidas (2026-09-29),
https://x.com/ChrisExcel102/status/2104913863200096350 — meme sobre relacionamento de celebridade.
Encontrado pela busca por “JubJub”. - Publicação #26, @Louissaikyoo, cerca de 185.000 visualizações, 10.292 curtidas (2026-09-30),
https://x.com/Louissaikyoo/status/2105090778766696620 — piada de trivia do Disney Channel.
Encontrado pela busca por “China”. - Publicação #36, @DlugoszMarcin, cerca de 189.000 visualizações, 2.937 curtidas (2026-09-30),
https://x.com/DlugoszMarcin/status/2105363575145394223 — comentário de futebol sobre Messi, Lewandowski, Ronaldo e Modrić.
Encontrado pela busca por “Messi”.
Nenhuma dessas, nem as outras 36 publicações, aborda o tema de pesquisa.
Não serão listadas aqui de 5 a 12 “descobertas” sobre geração de imagens/vídeos
por IA, porque elas não existem no material coletado — fazê-lo significaria
inventá-las, o que o playbook desta execução proíbe explicitamente.
Sinais
Nenhum sinal sobre IA aberta ou fechada de geração de imagens/vídeos pode ser
deduzido deste conjunto. O que os dados mostram é que os dez termos usados na
coleta — “Halloween”, “Ronaldo”, “Britain”, “Yess”, “JubJub”, “Gold”, “China”,
“#bb28”, “Messi” e “Balkans” — são temas em tendência da aba Explore do X para
a sessão, não tópicos relacionados à geração de mídia por IA. A tabela Explore
em output/x.posts.md confirma isso: 6 das 10 tendências são explicitamente
rotuladas “Trending in Croatia”, e as demais — “Ronaldo”, “Britain”, “China” e
“Messi” — são tendências globais de esporte e política, sem relação com IA ou
tecnologia. Isso parece um desencontro na etapa de coleta: o trabalhador puxou
o que o X dizia estar em alta em vez de pesquisar termos de geração de imagens
ou vídeos por IA. Por isso, as 40 publicações resultantes tratam de futebol, um
partido político britânico (Restore Britain), uma disputa de fandom de K-pop,
uma temporada de reality show (#BB28) e memes sem relação.
Limites
- Os dados coletados não abordam o briefing de pesquisa. O briefing pede notícias de IA fechada e aberta para geração de imagens/vídeos; os dez termos de busca do trabalhador eram tendências genéricas do X para a sessão, geolocalizadas predominantemente na Croácia segundo a tabela Explore, e não consultas relacionadas a IA. Todas as 40 publicações foram revisadas manualmente em relação ao tema, e nenhuma se qualificou.
- Conforme o playbook desta etapa, não foi feita pesquisa direta no X, pois um leitor anônimo não vê conteúdo, e foram usados apenas
output/x.posts.mdeoutput/x.posts.jsonconforme coletados. - Embora o critério de volume — analisar aproximadamente 20 posts por rede — tenha sido atendido numericamente, com 40 posts analisados, faltou relevância. A etapa do X deve ser refeita com buscas como “Midjourney”, “Sora”, “Stable Diffusion”, “Flux”, “Runway”, “Veo”, “Nano Banana”, “ComfyUI” ou termos similares, em vez das tendências genéricas utilizadas.
YouTube
YouTube — Notícias de IA para geração de imagens e vídeos (código fechado/aberto)
Canais
- AI WITH Rithesh (Rithesh Sreenivasan) — canal pessoal que testa lançamentos de ChatGPT/OpenAI no mesmo dia.
- Bart Slodyczka — resume o que mudou logo após o lançamento de novos modelos.
- Learn with LEESI — especializado em tutoriais de Google Gemini/Veo/Flow.
- WorldofAI(@intheworldofai) — revisa semanalmente notícias de IA de código fechado.
- MattVidPro — grande canal de IA conhecido por comparações e notícias rápidas sobre modelos de vídeo.
- There's An AI For That(@theresanaiforit) — novidades e comparações de modelos.
- Promptus AI(@promptusai) — especializado em tutoriais de instalação local de modelos abertos de imagem e vídeo.
- AI Late to Class(@ailatetoclass) — faz análises de modelos abertos de edição de imagem.
- MaxonShire — especializado em comparações de modelos locais de vídeo, como HunyuanVideo, Wan e LTX.
- smallzero(@webdot3) — uso de modelos abertos, como Z-Image, no ComfyUI.
- FlyMyAI — publica resumos diários e semanais de notícias de IA.
- Lev Selector(@lev-selector) — canal de resumos semanais de atualizações de IA.
O número de inscritos não pôde ser confirmado diretamente porque o HTML dos resultados do YouTube é renderizado em JavaScript (ver Limites).
Vídeos
Código fechado
- “ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!” — AI WITH Rithesh / início de setembro de 2026 — teste do GPT Image 2.5, lançado pela OpenAI em 8 de setembro de 2026, incluindo o novo recurso de geração de imagem a partir de esboço, “Sketch”, e velocidade de geração até 50% maior. https://www.youtube.com/watch?v=LYUr4BY33h4
- “ChatGPT Image 2.5 Just Dropped — Here's Everything That's New” — Bart Slodyczka / setembro de 2026 — revisão completa dos novos recursos do GPT Image 2.5. https://www.youtube.com/watch?v=dvpQHWwuaIo
- “Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation” — Learn with LEESI — apresenta a abertura gratuita do Veo 3.1, incluindo suporte a imagem para vídeo e três imagens de referência, por meio do Google Flow/Vids. https://www.youtube.com/watch?v=uj6eD31OxkA
- “Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!” — WorldofAI — testa o Nano Banana 2.0 da Google DeepMind, geração de imagens da família Gemini, e o avalia como superior ao Photoshop. https://www.youtube.com/watch?v=u22-XoQvI4I
- “Kling 2.5 goes BEAST MODE for AI Video!” — MattVidPro — relata grande evolução do Kling 2.5 no dinamismo dos movimentos. https://www.youtube.com/watch?v=SGUxHC1cI1c
- “AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)” — MattVidPro — compara lado a lado Kling, fechado, e Wan, aberto, e observa que a competição está se intensificando. https://www.youtube.com/watch?v=vFXe3uXb75k
- “Your AI news brief for September 3, 2026.” — FlyMyAI — resumo de notícias gerais de IA em 3 de setembro de 2026, incluindo tópicos de geração de imagens e vídeos. https://www.youtube.com/watch?v=JK6w9tA2jH8
- “Exciting AI Updates Weekly - September 25, 2026” — Lev Selector — resumo semanal recente de atualizações de IA, incluindo modelos de geração de imagens e vídeos. https://www.youtube.com/watch?v=iyZHPCNd8jI
Código aberto
- “Is FLUX 2.0 The New Open Source King?” — There's An AI For That — avalia o FLUX.2 da Black Forest Labs como forte candidato a principal modelo aberto de imagem e edição. https://www.youtube.com/watch?v=YQuTkPVkCS8
- “New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial”(o título no oEmbed é “Z-Image Open-Source Image Generator: Free Online and Local Setup”) — Promptus AI — apresenta o Z-Image Turbo da Tongyi-MAI, da Alibaba, com 6 bilhões de parâmetros e execução em 6 GB de VRAM, afirmando que supera o Flux 2. https://www.youtube.com/watch?v=JF4Q5hXh-_Q
- “Z-Image Full Release: The New King of AI Influencers in ComfyUI?” — smallzero — testa no ComfyUI o lançamento completo, sem destilação, da versão Base do Z-Image. https://www.youtube.com/watch?v=ClVY5ll1sDU
- “Qwen Image 2.1 best open source Image Editor. Better than Nano Banana” — AI Late to Class — avalia que a versão mais recente do Alibaba Qwen-Image-Edit, com suporte a dez imagens de referência, fundo transparente e maior velocidade, iguala ou supera Nano Banana. https://www.youtube.com/watch?v=AIgYj5RG-FQ
- “HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?” — MaxonShire — compara HunyuanVideo 1.5 da Tencent e Wan 2.7 da Alibaba como modelos locais de geração de vídeo. https://www.youtube.com/watch?v=4GNT4-QYekg
Sinais
- O código fechado compete pela velocidade de adição de recursos: atualizações da OpenAI, como GPT Image 2.5 “Sketch” em 8/9/2026, do Google, com abertura do Veo 3.1 e integração com Google Vids/Flow, e do Kling 2.5 apareceram quase simultaneamente, mantendo uma disputa de recursos em escala mensal.
- O campo aberto chinês, especialmente Alibaba Tongyi-MAI e Qwen, ganha impulso: Z-Image Turbo e Qwen-Image-Edit são repetidamente abordados sob a ótica de “funciona com 6 GB/baixa VRAM” e “qualidade comparável ao Nano Banana”, e a comparação direta com FLUX.2 da Black Forest Labs tornou-se recorrente.
- Vídeos de comparação “aberto vs. fechado” viraram um gênero: títulos como “WAN 2.5 is Open Source Veo3” e “Z-Image vs Flux 2” são muito frequentes, apresentando modelos abertos como alternativas aos fechados.
- Tutoriais para execução local no ComfyUI, de canais como Promptus AI, MaxonShire e smallzero, tornaram-se o principal formato de conteúdo aberto: sempre que sai um modelo, surgem rapidamente vídeos explicando como instalá-lo no ComfyUI.
- Canais de resumos diários ou semanais de notícias de IA, como FlyMyAI e Lev Selector, cobrem continuamente geração de imagens e vídeos, disseminando notícias de modelos individuais também por atualizações periódicas.
Limites
- As páginas de resultados do YouTube (
youtube.com/results?search_query=...) e páginas de vídeo (youtube.com/watch?v=...) são renderizadas em JavaScript; por isso, WebFetch não conseguiu obter diretamente a lista de vídeos ou o conteúdo das páginas, incluindo visualizações, data de publicação, inscritos e comentários. Títulos e nomes de canais foram confirmados individualmente pelo endpoint JSONyoutube.com/oembed, e período de publicação e contexto foram complementados com snippets de busca e artigos relacionados. - Portanto, não foram confirmados os números exatos de visualizações, datas de publicação e inscritos dos canais. Alguns resultados exibiam períodos relativos, como “há X dias”, mas muitos tinham mais de 300 dias, e por isso foram priorizados os tópicos cuja proximidade de 60 dias pôde ser claramente estabelecida, como GPT Image 2.5 em 8/9/2026 e os resumos semanais datados.
- A existência de vídeos relacionados a Runway Gen-4.5, Grok Imagine, Seedream 4.0 e Midjourney V8 foi confirmada, mas não havia informação suficiente para verificar período de publicação ou detalhes dos canais; por isso, eles não foram incluídos na seção Vídeos.
- Os comentários não foram analisados nesta rodada, pois o conteúdo das páginas de vídeo não pôde ser obtido.
Bluesky
Bluesky — Notícias de IA para geração de imagens e vídeos (código fechado/aberto)
Sobre o método de pesquisa: como o site oficial do Bluesky, bsky.app, é uma SPA e não permite renderizar resultados de busca diretamente, a API pública do AT Protocol (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts, sem autenticação) foi consultada diretamente para obter dados reais de publicações, incluindo texto, autor, número de curtidas e horário. Foram pesquisadas palavras-chave como “Nano Banana”, “Sora 2”, “Flux”, “ComfyUI”, “Z-Image”, “Qwen Image”, “open weights” e “Veo 3”; mais de 100 publicações reais foram revisadas e as mais adequadas ao tema foram selecionadas.
Contas
- Eliot Higgins(
eliothiggins.bsky.social, fundador da Bellingcat, verificado no Bluesky) — publica continuamente sobre os riscos de desinformação e deepfakes do Veo 3. - Simon Willison(
simonwillison.net, pesquisador independente de IA, verificado no Bluesky) — executa localmente modelos de pesos abertos como Qwen-Image e Qwen-Image-Edit e publica notas técnicas. - Ethan Mollick(
emollick.bsky.social, professor da Wharton, verificado no Bluesky) — comenta regularmente sobre riscos e capacidades de modelos de pesos abertos. - Repórteres da 404 Media (Jason Koebler
jasonkoebler.bsky.social, Sam Colesamleecole.bsky.social) — investigam problemas de direitos autorais e moderação de conteúdo no Sora 2. - obeca(
obeca.bsky.social, comunidade de língua turca) — conta pessoal que publica imagens criadas com Nano Banana 2 quase todos os dias. - Ria_Tatibana(
ria-tatibana.bsky.social, comunidade japonesa) — publica ilustrações diariamente com ComfyUI + Krea2, modelo de código aberto. - cubby.jpg(
cubby-ai.bsky.social) — conta que produz grande quantidade de arte de IA com modelos abertos como Z-Image e Qwen-Image. - AlternativeTo(
alternativeto.net) — conta automatizada de notícias de software que divulga rapidamente lançamentos como Qwen-Image-2.1.
Publicações
Código fechado
- O problema de o Google Veo 3 conseguir gerar conteúdo racista — Eliot Higgins, 2025-06-22, ❤️842. “Google Veo 3 oferecendo formas novas e empolgantes de fazer racismo.” https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
- Repórteres da TIME conseguiram gerar com Veo 3 vídeos falsos de muçulmanos incendiando um templo hindu; após questionamento, o Google adicionou marca-d’água visível — Aman Batheja, repórter da TIME, 2025-06-03, ❤️431 · 🔁192 · 107 citações. “Novo: repórteres da TIME conseguiram usar a ferramenta de vídeo de IA do Google para criar vídeos convincentes de muçulmanos incendiando um templo hindu...” https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
- O custo operacional do Sora 2 é de cerca de US$ 5 bilhões por ano, enquanto a receita até agora seria de cerca de US$ 1,4 milhão — Peter Labuza, 2026-02-10, ❤️1.375 · 🔁368 · 192 citações. “O Sora 2 aparentemente custa algo como US$ 5 bilhões por ano para operar e até agora rendeu à OpenAI cerca de US$ 1,4 milhão.” https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
- O Sora simboliza o colapso da alegação de empresas de IA de que não treinaram com obras protegidas por direitos autorais, segundo artigo crítico — Jason Koebler, 404 Media, 2025-10-01, ❤️1.508 · 44 citações. “O caso Sora é tão sombrio e mostra o quanto avançamos desde que empresas de IA fingiam não ter treinado com material protegido por direitos autorais.” https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
- Usuários ficaram revoltados quando Sora 2 proibiu gerar personagens com direitos autorais, segundo reportagem — Sam Cole, 404 Media, 2025-10-08, ❤️435 · 37 citações. “A única coisa que as pessoas parecem querer fazer no Sora é gerar imagens de personagens protegidos por direitos autorais. Agora que não podem, estão surtando.” https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
- Relato de alguém que foi enganado por imagem gerada por Nano Banana (2) — furuakasaber.bsky.social, 2026-07-03, ❤️333. “Essa porcaria de Nano Banana me enganou, mesmo eu sentindo que havia algo estranho nela. Meio assustador.” https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
- Cansaço com infográficos do Nano Banana, os “diagramas com cara de IA” — garrison.corporate.fm, 2026-03-15, ❤️73 · 🔁9. “Infográficos de nano banana precisam ser interrompidos a qualquer custo.” https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
Código aberto
- Alibaba Qwen lançou seu primeiro modelo de geração de imagens, Qwen-Image, sob licença Apache 2.0 — Simon Willison, 2025-08-04, ❤️46. “A Qwen lançou hoje seu primeiro modelo de geração de imagens, Qwen-Image; ele é Apache 2.0 como seus LLMs.” https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
- Teste prático do Qwen-Image-Edit: quase toda a RAM de 64 GB de um Mac e 54 GB de disco necessários — Simon Willison, 2025-08-19, ❤️77. “Notas sobre executar o novo modelo Qwen-Image-Edit no meu Mac... Ele consumiu quase TODA a minha RAM de 64 GB e precisou de 54 GB de disco.” https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
- Alibaba lançou o Qwen-Image-2.1 de 7 bilhões de parâmetros em pesos abertos, com mudança de licença — AlternativeTo, 2026-09-24, ❤️6. “A Alibaba Cloud lançou um modelo Qwen-Image-2.1 de 7B parâmetros... e há uma mudança de licença.” https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
- Apple lançou pesos abertos dos modelos STARFlow e STARFlow-V, modelos autoregressivos de fluxo Transformer para geração de imagem e vídeo — Sung Kim, 2025-12-02, ❤️13. “A Apple lançou os pesos abertos de STARFlow e STARFlow-V, modelos autoregressivos de fluxo Transformer de ponta para geração de imagens e vídeos de alta qualidade.” https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
- GLM-5.3, de pesos abertos, é altamente capaz, mas teria quase nenhum guardrail e até capacidades cibernéticas ofensivas, alerta Ethan Mollick — 2026-08-28, ❤️88. “Modelos de pesos abertos efetivamente não têm guardrails e oferecem apenas testes mínimos de risco.” https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
- Ilustrações diárias com ComfyUI + Krea2, modelo aberto, obtêm de 50 a 80 curtidas por publicação — Ria_Tatibana, várias postagens entre 2026-09-28 e 10-01, por exemplo https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t, ❤️53. A maioria dos resultados no topo para a tag ComfyUI é ocupada por compartilhamentos cotidianos de obras por ilustradores de IA.
- Expectativa e ironia diante do lançamento do Z-Image, modelo aberto e leve de imagem da Alibaba Tongyi — theophite.bsky.social, 2025-11-27, ❤️30. “Não estou ansioso pelo lançamento do z-image.” https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
Sinais
- Veo 3 consolidou reputação de “ferramenta de desinformação” — Eliot Higgins, fundador da Bellingcat, aborda o tema repetidamente, e a investigação da TIME também circulou bastante, com ❤️431 e 107 citações. O principal debate sobre vídeo fechado mudou de qualidade para uso indevido.
- Sora 2 enfrenta dificuldades econômicas e controvérsias contínuas — o número de US$ 5 bilhões anuais de operação contra US$ 1,4 milhão de receita, com ❤️1.375, foi amplamente difundido. As restrições a personagens protegidos por direitos autorais provocaram forte insatisfação, ❤️435, repetindo a dinâmica “mudança de política fechada → reação dos usuários”.
- Nano Banana, do Google, tornou-se ferramenta padrão de geração de imagem para usuários casuais — indivíduos como obeca.bsky.social publicam imagens geradas diariamente, e a adoção aparece também em comunidades não anglófonas, como a turca e a japonesa. Ao mesmo tempo, permanece forte a reação de que é assustador não conseguir distinguir imagens reais, ❤️333.
- A geração aberta de imagens gira tecnicamente em torno da família Qwen-Image — pesquisadores como Simon Willison fazem testes reais, inclusive medindo consumo de VRAM e disco, e avaliam positivamente a licença Apache 2.0. Contudo, o Qwen-Image-2.1 mudou de licença, mencionado no post com ❤️6, indicando tensão também no campo aberto sobre o que é de fato aberto.
- ComfyUI continua o fluxo de trabalho padrão de fato para geração aberta de imagens — a maior parte dos resultados é de ilustrações cotidianas feitas com ComfyUI e modelos específicos, como Krea2 e SDXL, evidenciando adoção como ferramenta incorporada ao uso diário, não apenas como notícia técnica.
- Pesos abertos significam alto desempenho, mas ausência de guardrails, segundo alertas de especialistas — contas de pesquisadores conhecidos, como Ethan Mollick, passaram a comentar capacidades ofensivas e testes mínimos de risco em modelos como GLM-5.3. Grandes empresas, como a Apple com STARFlow, também aderem à publicação de pesos abertos, ampliando o campo.
Limites
- O site oficial do Bluesky, bsky.app, é uma SPA, portanto WebFetch não obtinha diretamente o texto das publicações; o endpoint de busca
public.api.bsky.apptambém retornava 403. Por fim, a mesma API emapi.bsky.app, sem “public.”, respondeu sem autenticação e foi usada para obter dados reais. - Termos como “Flux”, “Kling” e “Wan” colidem facilmente com substantivos comuns ou outros domínios, como jogos, clima e nomes de pessoas, produzindo muito ruído. A busca por Flux trouxe 15 itens, dos quais praticamente nenhum era relacionado à geração de imagens. Não foi encontrado volume suficiente de conversa sobre FLUX.2 da Black Forest Labs.
- Nomes individuais de modelos de vídeo, como Kling 2.5, Wan 2.5, HunyuanVideo e Seedance, não retornaram quantidade suficiente de publicações com as palavras-chave usadas; não foi possível confirmar que esses modelos estejam em alta no Bluesky, embora possam ser mais ativos no YouTube ou em outros locais.
- Mesmo com
sort=top, a API de busca não garante ordem de popularidade real, e houve mistura de datas na paginação por cursor. As publicações escolhidas são exemplos cuja relevância e existência foram confirmadas, não um ranking rigoroso de popularidade.
Lemmy
Lemmy — Movimentos em IA de geração de imagens e vídeos (código fechado/aberto)
Comunidades
- !«メールアドレス» — principal comunidade para lançamentos de novos modelos e ferramentas abertas. A frequência de posts é alta, mas as pontuações são pequenas, geralmente entre 1 e 10.
- !«メールアドレス» / !«メールアドレス» — posts automatizados integrados ao Civitai publicam diariamente imagens geradas, como Krea e modelos SDXL. Têm pouco valor noticioso, mas demonstram uso cotidiano de modelos abertos.
- !«メールアドレス» / !«メールアドレス» — comunidades de exemplos de arte abstrata que fazem cross-post das mesmas imagens.
- !«メールアドレス» — comunidade administrada por bot que espelha subreddits de IA, como r/ArtificialIntelligence. É a principal fonte de entrada de notícias fechadas sobre Sora, Nano Banana e Seedream, mas quase todas têm pontuação de 0 a 1 e não há debate relevante.
- !«メールアドレス» / !«メールアドレス» / !tech — recebem posts isolados de notícias como as relacionadas ao FLUX da Black Forest Labs.
- !«メールアドレス» / !casual_perchance — comunidades de usuários do serviço gratuito de imagens no navegador Perchance.org.
- Os números de assinantes não puderam ser confirmados: as páginas de comunidade do Lemmy.world, em
/c/<name>, retornavam erros 500/400, e a API/api/v3/communitytambém não pôde ser consultada por parâmetros desconhecidos.
Publicações
Mais próximas de código aberto
- scraed/LanPaint — inpainting de alta qualidade sem treinamento, compatível com qualquer modelo Stable Diffusion e com suporte a ComfyUI / !«メールアドレス» / pontuação 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
- DenRakEiw/scumble — editor desktop dedicado a inpainting por IA, com camadas, seleção de texto e pincéis personalizados. Desenha por ComfyUI próprio ou provedores de API e suporta MCP / !«メールアドレス» / pontuação 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
- ogoun/fooocus-qwen-image-2.1 — WebUI para Qwen-Image-2.1 / !«メールアドレス» / pontuação 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
- PrunaAI/Pruna-Qwen-Image-2.1 — adaptador LoRA de poucos passos para Qwen-Image-2.1, surgido junto do ControlNet union experimental
QwenImage_experimentalde Kijai, acelerando de uma vez o conjunto de ferramentas em torno do Qwen-Image-2.1 / !«メールアドレス» / pontuação 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 — versão quantizada FP8 de um modelo aberto de 9B da Black Forest Labs / !«メールアドレス» / pontuação 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
- Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — modelo aberto de geração de vídeo que afirma superar modelos fechados com destilação aprimorada / !«メールアドレス» / pontuação 5 / 2026-05-13 / anexo webm, lemmy.dbzer0.com pictrs
Mais próximas de código fechado
- Black Forest Labs anuncia “FLUX 3” — além de imagens, pode gerar vídeos de 20 segundos com áudio; inicialmente em prévia limitada / !«メールアドレス» / pontuação 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
- OpenAI encerrará a API do Sora na semana seguinte, em 24/9, enquanto concorrentes chineses levantam US$ 3 bilhões — análise de que vídeo de IA para consumidores não é lucrativo, enquanto produtos corporativos como Kling captam recursos / !«メールアドレス» / pontuação 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Google retirou em um dia um recurso de IA do Google Earth, Nano Banana 2 — a funcionalidade foi descontinuada por uso indevido / !«メールアドレス» / pontuação 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Comparação honesta e explicação técnica do Seedream 5.0 Pro contra Nano Banana Pro / !«メールアドレス» / pontuação 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
- “Colorização da mesma página dupla de Berserk por quatro IAs” — comparação de ChatGPT Images 2.5, Wan 2.7 Pro, Nano Banana Pro e Seedream 5.0 Pro nas mesmas condições; houve quem considerasse o GPT vencedor / !«メールアドレス» / pontuação 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
- Seis modelos de vídeo de IA receberam o mesmo prompt e cerca de 40 pessoas fizeram avaliação cega — Google Veo ficou em primeiro, mas os três principais modelos tiveram diferença pequena / !«メールアドレス» / pontuação 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
- ByteDance anunciou Seedance 2.5 — adiciona criação em uma tomada e referência flexível / !«メールアドレス» / pontuação 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
- Runway afirma que seu negócio empresarial dobrou e que sua NRR ultrapassou 300% / !«メールアドレス» / pontuação 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
Sinais
- Qwen-Image-2.1 é o centro do ecossistema aberto no Lemmy: WebUI, ControlNet de Kijai e LoRA de poucos passos da PrunaAI foram publicados na mesma semana, em 26 e 27/9, indicando que a família Qwen-Image é hoje o principal campo de disputa na comunidade ComfyUI/Stable Diffusion.
- Modelos fechados derrubam suas próprias barreiras: a Black Forest Labs, historicamente focada em pesos abertos, colocou as funções de vídeo e áudio do FLUX 3 em prévia fechada limitada, mas segue lançando modelos abertos como FLUX.2-klein-9b. A fronteira entre aberto e fechado está ficando indistinta.
- Nano Banana 2 é tema e problema ao mesmo tempo: a integração ao Google Earth, seguida de retirada em um dia por uso indevido, foi a história com maior pontuação, 6, enquanto as demais ficaram muito baixas.
- O discurso sobre vídeo de IA é que consumidor não gera lucro: enquanto a OpenAI encerra a API do Sora, Kling, Seedance e Runway seriam mais bem-sucedidas em capital e receita por se concentrarem em empresas; a comparação apareceu em várias publicações espelhadas do Reddit.
- Há muito conteúdo de comparação lado a lado: postagens com Nano Banana Pro, Seedream 5.0 Pro, Wan 2.7 Pro e ChatGPT Images 2.5 nas mesmas condições se repetem, mostrando que usuários se interessam mais por “qual é o mais forte” do que por notícias isoladas.
- Quase não há discussão própria do Lemmy: a maior parte do material encontrado vem de !ai_reddit, bot espelho do Reddit, com pontuações de 0 a 1 e poucos comentários. A análise original produzida no Lemmy se limita praticamente aos posts de ferramentas em !«メールアドレス».
Limites
- O Lemmy não tem uma grande comunidade exclusiva de IA para imagem e vídeo. As conversas se espalham entre a pequena !«メールアドレス», focada em ferramentas e modelos com pontuação de um dígito, e !ai_reddit, comunidade de bots que copia posts do Reddit e tende a ter pontuação 0–1. Esta última não representa opiniões próprias do Lemmy.
- Não foi possível obter o número de assinantes das comunidades.
https://lemmy.world/c/<community>retornou repetidamente HTTP 500, ehttps://lemmy.world/api/v3/community?name=...retornou HTTP 400, possivelmente por diferenças na especificação de parâmetros ou restrições da instância. - Buscas por palavras-chave como “Grok Imagine”, “Kling AI”, “Runway Gen”, “HunyuanVideo” e “Flux” isoladamente retornaram quase zero posts relevantes, apenas ruído, indicando pouca menção nominal a esses modelos no Lemmy.
- A API de busca do lemmy.world afirma pesquisar toda a federação, mas na prática retornou principalmente posts de lemmy.world, lemmy.ml, lemmy.dbzer0.com, lemmy.today e lemmy.zip. Não houve tempo para pesquisar individualmente lemmy.ml ou lemm.ee.
- As pontuações são muito baixas no conjunto inteiro, em sua maioria de 0 a 10, e não indicam uma discussão suficientemente intensa para dizer que há forte engajamento. Isso decorre tanto da escala menor do Lemmy quanto da falta de comunidades dedicadas ao tema, em comparação com Reddit e X.
Pinterest — Notícias de IA para geração de imagens e vídeos
Foram coletados 50 pins, sem classificação por gênero, em um único conjunto. Os títulos e as imagens em miniatura foram abertos e verificados.
Temas visuais
- Miniaturas de “youtuber com rosto surpreso + conjunto de logotipos” — logotipos da OpenAI, Google, Meta, Microsoft e Anthropic aparecem em neon ao lado de um homem surpreso, repetindo o formato clássico de miniatura “AI NEWS”. Notícias recentes do ecossistema fechado usam majoritariamente este padrão
[2, 7, 23, 41] - Robô como âncora de notícias — aparecem repetidamente androides brancos de terno diante de um painel “BREAKING NEWS” e imagens de um futuro no qual âncoras de IA assumem o estúdio
[23, 45] - Demonstrações de retratos fotorrealistas — rostos de homens idosos, com rugas, barba e textura extremamente detalhadas, são usados repetidamente como imagem de impacto para lançar novos modelos, como AMD Amuse 3.0 e close de olho do Luma Dream Machine. O realismo virou o benchmark visual atual
[43, 47] - Grades que transformam o mesmo vídeo-fonte em múltiplos estilos — uma mesma pessoa ou carro é recriado em madeira entalhada, origami, Lego, flores e outros materiais, em demonstrações de consistência de estilo
[4] - Mockups de interface futurista em neon — ícones luminosos, silhuetas de cabeças com circuitos e painéis em holograma vendem de forma abstrata “geração de imagem/vídeo/música/texto”
[5, 9, 22, 50] - Infográficos de comparação e consulta rápida — logotipos de ChatGPT, Midjourney, Gemini, Runway, Pika e Krea são organizados em grades neon cyberpunk com recomendações como “se for pago, use isto; se for grátis, use aquilo”
[40] - Visuais de alerta sobre detecção de falsificações e ética em IA — robôs suspeitando de uma imagem de gato com selo “FAKE”, infográficos de antes e depois de olhos e mensagens como “não acredite apenas na aparência” aparecem com frequência
[1, 20, 32, 37] - Também há pins em que título e imagem não combinam — por exemplo, um título sobre “Stability AI entra em geração de vídeo” acompanhado por uma colagem de moodboard de fantasia. Há muitas miniaturas recicladas para atrair cliques
[29]
Pins notáveis
- [2] AI News: Anthropic Leak Shows Us The Future of AI... — miniatura clássica “AI NEWS” com logotipos luminosos de OpenAI, Google, Microsoft e Anthropic. Vídeo-resumo das tendências de empresas fechadas.
- [4] Google announces ultra-high quality video... — imagem em grade que recria a mesma pessoa e carro em madeira, origami, Lego e flores. Uma demonstração clara de consistência de estilo.
- [5] Meta Unveils Muse Image and Muse Video Generative... — banner de ficção científica “Meta Muse Spark AI Model 2026”, enfatizando a direção de assistente pessoal de IA.
- [23] Discover how Grok is revolutionizing video... — visual de um âncora de notícias androide branco sentado diante de “BREAKING NEWS”, representando um futuro no qual IA cria notícias.
- [26] Google's Gemini Omni Turns Anything Into Video — logotipo “Omni” ao centro, cercado por ícones de imagem, vídeo, áudio e texto, promovendo integração multimodal.
- [38] Google Unveils Veo 2: Advanced AI Video Generation... — banner com aparência oficial do Veo2, slogan “state-of-the-art video generation model” e amostras de cenas reais e animadas.
- [43] Introducing Luma Dream Machine - Next Generation AI Video — close de um olho com tipografia “Dream Machine”, imagem simbólica para promover capacidade de geração fotorrealista.
- [47] 'Amuse 3.0', an AI art creation tool that includes... — ferramenta local de arte por IA da AMD. O rosto fotorrealista de um pescador idoso funciona como imagem de demonstração, promovendo geração robusta em GPU local. É uma das poucas ferramentas específicas voltadas ao uso local ou aberto.
- [40] Top AI Video Generators of 2025 — tabela de comparação em neon que organiza ChatGPT Plus, Midjourney, Runway, Pika, Kaiber e outros por “prioridade de qualidade” e “prioridade de gratuito”. Informação prática para escolher ferramentas.
- [20] 'AI is getting scary good.' — infográfico de alerta sobre geração de vídeo por IA, detecção de voz e engenharia de prompts. Defende letramento em IA generativa com a mensagem de que não se deve acreditar apenas no que se vê.
Sinais
- No Pinterest, as “notícias de IA para geração de imagens e vídeos” são dominadas por miniaturas noticiosas de empresas fechadas, como OpenAI, Google Veo/Gemini Omni, Meta Muse, Grok, Midjourney, Runway e Pika. O formato de “rosto surpreso + logotipos” parece uma reutilização de miniaturas do YouTube e privilegia cliques, não profundidade de informação.
- O tema de código aberto ou geração local é fraco. Os únicos nomes específicos encontrados foram Stability AI, mas apenas no título e acompanhado por imagem irrelevante, e AMD Amuse 3.0, ferramenta de execução em GPU local. Não apareceu nenhuma imagem técnica comunitária de ComfyUI, Hugging Face ou diagramas de arquitetura de difusão.
- A geração de pessoas fotorrealistas, com rugas e texturas detalhadas, aparece repetidamente como visual de benchmark para mostrar “o que é possível agora”, sinalizando maturidade técnica.
- Infográficos sobre desconfiança e verificação de conteúdo gerado por IA, incluindo detecção de falsificações, autenticidade de voz e ética, aparecem em quantidade relevante. O interesse por “como reconhecer” e “como usar corretamente” é tão visível quanto o interesse pela geração em si.
- O que não aparece são pins que tratem diretamente de modelos abertos específicos, como Stable Diffusion, FLUX, Wan e HunyuanVideo; capturas de GitHub ou blogs técnicos; e imagens com artigos científicos ou benchmarks numéricos. Pela natureza do Pinterest, predominam resumos secundários de notícias, tabelas comparativas e banners publicitários, não informação primária de comunidades técnicas.
Limites
output/pinterest.pins.mdnão classifica os itens por gênero, poisgenreestá vazio, e fornece um conjunto único de 50 itens; assim, não foi possível produzir o resumo por gênero previsto no playbook e todo o conjunto foi analisado como uma unidade.- Das 50 imagens, 18 foram efetivamente abertas e verificadas, escolhidas considerando especificidade do título e diversidade de temas. As outras 32 não foram verificadas, mas a repetição de formatos no material consultado tornou o padrão suficientemente claro.
- Vários pins têm título e imagem incompatíveis, como
[29], que traz título relacionado à Stability AI mas uma imagem de moodboard sem relação. Nesses casos, a referência usa o contexto do título, não o conteúdo visual. - O Pinterest não foi navegado diretamente; foram usados apenas imagens e títulos pré-coletados. Portanto, não foi possível confirmar número de salvamentos, curtidas ou o texto dos artigos de destino.
Ações recomendadas
- Reexecutar a etapa do X com palavras-chave diretas de IA, como Midjourney, Sora, Nano Banana, ComfyUI e Flux, em vez de temas genéricos em tendência.
- Continuar acompanhando o ecossistema Qwen-Image-2.1, incluindo WebUI, LoRA e ControlNet, como indicador antecipado do impulso do código aberto.
- Acompanhar a lacuna entre custo e receita do Sora 2 como proxy da rentabilidade de geração de vídeo fechada.
- Mapear quais ferramentas os usuários passam a usar quando uma ferramenta fechada reforça seus guardrails.
- Expandir a amostragem do Pinterest além dos 18 de 50 pins ou encontrar uma forma de obter contagens de engajamento.
- Tratar a comunidade !ai_reddit do Lemmy como espelho do Reddit, não como sinal independente, ao ponderar as descobertas.
Imagens coletadas


















































Nota sobre qualidade dos dados
A etapa do X coletou posts de temas genéricos em tendência, e não de buscas relacionadas a IA, portanto não contribuiu com nada. YouTube e Pinterest não puderam confirmar métricas de engajamento, como visualizações/inscritos ou salvamentos/curtidas, por limitações de renderização em JavaScript e amostragem. Reddit e Bluesky se basearam em dados reais coletados ou obtidos por API e são as fontes mais confiáveis deste conjunto.



