Notícias de IA para Geração de Imagens e Vídeos — 2026-09-08
O lado de código fechado viu surgir de forma independente no Reddit, X e Bluesky um novo gênero: “em vez de modelos de difusão, agentes LLM (GPT-6 Astra) operam ferramentas GUI e Blender para criar imagens e vídeos 3D”. Já os movimentos de código aberto se concentraram nas comunidades ComfyUI do Lemmy e em canais de análise no YouTube, sendo quase inexistentes no Bluesky, Pinterest, Reddit e X.
Notícias de IA para Geração de Imagens e Vídeos — 2026-09-08
Nesta pesquisa transversal por seis plataformas, o sinal mais forte foi o surgimento independente, em três plataformas, de um novo gênero no lado de código fechado: “em vez de modelos de difusão, agentes LLM (GPT-6 Astra) operam diretamente ferramentas GUI e Blender para criar imagens e vídeos 3D”. No geral, o lado de código aberto foi menos visível, mas permaneceu ativo no nível das comunidades de desenvolvedores: na comunidade !stable_diffusion do Lemmy, de cinco a seis nós de aceleração para ComfyUI voltados a modelos de vídeo MiniMax H3 foram lançados em sequência na mesma semana; no YouTube, a disputa pela liderança entre Flux.2/Flux 2 Klein e Qwen-Image segue sendo analisada continuamente. Pinterest e a maior parte das publicações no Reddit e X concentraram-se em nomes de produtos de código fechado (Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream etc.), e praticamente não apareceram nomes próprios de projetos open source. Em todas as plataformas, também se destacaram menos as tendências técnicas em si e mais disputas sobre a autenticidade de algo ser ou não IA, além do impacto social de agentes de IA assumindo funções e tarefas humanas.
Entre plataformas
- A geração visual por agentes GPT-6 Astra virou assunto de forma independente em três plataformas: o caso em que Astra operou o Blender para renderizar uma cena foi tratado separadamente no Reddit (r/DefendingAIArt) e no Bluesky (@simonwillison.net); uma demonstração de criação de cidades 3D com Astra gerou uma cadeia de imitações no X (@synabreu, @GulatiYajat). Em vez de “evolução dos modelos de difusão”, o maior tema transversal desta pesquisa foi a nova perspectiva de “agentes LLM tomando controle de ferramentas existentes para produzir arte e 3D”.
- A avaliação sobre a consistência de personagens e cenas na geração de vídeo continua dividida: tanto no Reddit (r/generativeAI, r/aivideomaking) quanto no X — entre o elogio de @atlas_remake ao Seedance 2.5 e a crítica de @Aiden_Tech_Ai às falhas em cenas complexas — houve publicações simultâneas defendendo posições opostas.
- A presença do código aberto varia drasticamente por plataforma: o
!stable_diffusiondo Lemmy está tão ativo que nós ComfyUI para MiniMax H3, como ComfyUI-Ref2VA-VSA, são lançados em paralelo; o YouTube também publica comparações contínuas entre Qwen-Image, FLUX e Wan 2.2. Já no Bluesky, Pinterest, Reddit e X, quase não foram encontradas publicações com nomes específicos de modelos abertos, como novas versões de Stable Diffusion, FLUX, Wan e HunyuanVideo. Diversas seções de limitações das plataformas apontam a mesma fragilidade estrutural: não está claro se o código aberto não está sendo discutido ou se foi simplesmente perdido por buscas inclinadas a produtos fechados. - Disputas de autenticidade e impacto social acompanham as tendências técnicas: publicações cuja origem real ou gerada é contestada — Reddit r/isthisAI, o vídeo de Thor debatido entre r/pj_explained e r/NewRockstars —, o aimod.social do Bluesky, que rotula automaticamente imagens geradas por IA, vídeos falsos na eleição para governador de Nova York (Bluesky/404media) e miniaturas do Pinterest com selos “FAKE” mostram, de forma independente em várias plataformas, mais interesse em “identificar e desconfiar” do que simplesmente em “criar”.
Plataforma por plataforma
Reddit: entre 12 tópicos, subreddits voltados a debates sobre IA e verificação de autenticidade (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars) tiveram mais engajamento que comunidades especializadas em geração de imagem e vídeo (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI). Como houve apenas uma consulta de busca, praticamente não foi possível comparar diretamente código fechado e aberto.
X: os principais assuntos foram o anúncio do Sol-H3 da NVIDIA — inferência de vídeo mais rápida que reprodução em tempo real — e sua reprodução local por usuários individuais, além da cadeia de imitações de cidades 3D geradas com GPT-6 Astra. De 40 itens, poucos estavam diretamente ligados à IA de imagem e vídeo; muitos eram irrelevantes devido à mistura de tendências regionais, em especial do Explore na Croácia.
YouTube: números de visualizações e inscritos não puderam ser obtidos por causa da renderização JavaScript, mas foram identificados canais de comparação e análise que cobrem tanto código fechado — Midjourney V8.2, Grok Imagine e Google Gemini “Omni” — quanto código aberto — Qwen-Image-2.0, FLUX e Wan 2.2. Entre as seis plataformas, foi a fonte que mais facilitou a comparação entre os dois lados.
Bluesky: como a API de busca (app.bsky.feed.searchPosts) retornou 403 durante toda a coleta, foi necessário mudar para a verificação individual de feeds de contas conhecidas, como @simonwillison.net e @404media.co. Assim, não foi atingido o critério de conclusão de 20 itens analisados. A única publicação concreta sobre código aberto foi um relato de execução local do Qwen 3.7 27B.
Lemmy: a controvérsia sobre uma possível mudança da Midjourney para equipamentos de ultrassom médico (!techtakes) foi o maior assunto isolado. No lado aberto, houve uma sequência de lançamentos de nós ComfyUI para MiniMax H3 e competição de benchmarks no Qwen-Image-Bench, com LLaDA-Image e Boogu-Image-0.1. Foi a única das seis plataformas com ampla densidade de informação primária sobre código aberto.
Pinterest: foram verificadas 30 das 50 publicações pré-coletadas, mas uma consulta única e sem classificação por gênero produziu sobretudo infográficos de comparação e tutoriais de produtos fechados. Não apareceu sequer um nome de modelo ou projeto open source. Datas e métricas de engajamento também não constavam no manifesto, tornando impossível avaliar atualidade.
O que acompanhar
- Inferência de vídeo mais rápida que tempo real no MiniMax H3 / Sol-H3 e a proliferação de nós de otimização para ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA e outros). Até que ponto as implementações de pesos abertos alcançarão os anúncios em nuvem.
- Expansão da geração visual por agentes GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Até onde a cadeia de imitações irá crescer.
- Disputa pela liderança open source entre FLUX.2/Flux 2 Klein e Qwen-Image — YouTube (SECourses, Urban Decoders). Como os resultados de mais de 700 testes influenciarão adoções futuras.
- Novidades sobre a controvérsia da mudança para equipamentos médicos pela Midjourney (Midjourney Medical) — Lemmy (via pivot-to-ai.com). Se a guinada de uma empresa de geração de imagens terminará como piada ou será implementada.
- Repercussões do abuso de vídeo de IA em publicidade política, na eleição para governador de Nova York — Bluesky (404media.co). Se haverá movimento regulatório ou resposta das plataformas.
- Evolução na resolução do problema de consistência de personagens e cenas em vídeo — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Se ferramentas tudo-em-um estão realmente chegando perto de resolvê-lo.
Recomendações
- Manter a geração visual por agentes GPT-6 Astra — operação do Blender e geração de cidades 3D — como tema específico de acompanhamento nas próximas edições.
- Para não perder anúncios open source, acrescentar nas próximas buscas transversais nomes como "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" e "ComfyUI".
- Assumir que o 403 da API de busca do Bluesky persistirá e ampliar previamente a lista de contas monitoradas.
- Como o Pinterest não fornece data da publicação nem métricas de engajamento, restringi-lo a observação recorrente de reconhecimento de ferramentas, em vez de usá-lo para comparações de notícias urgentes que dependem de atualidade.
- Como a controvérsia sobre a mudança da Midjourney para equipamentos médicos ainda não tem autenticidade ou situação confirmadas, evitar citações categóricas até que surja uma fonte primária, como um anúncio oficial da Midjourney.
- Priorizar o
!stable_diffusiondo Lemmy e canais analíticos do YouTube como fontes centrais para acompanhar tendências open source.
Qualidade dos dados
Bluesky — limitado à verificação de contas individuais porque a API de busca retornou 403 continuamente e sem atingir 20 itens — e Pinterest — sem datas ou métricas de engajamento no manifesto, portanto sem possibilidade de avaliar atualidade, além de nenhuma menção open source em uma consulta única — tiveram a menor densidade informacional. Reddit e X ficaram restritos a uma única consulta, o título do próprio briefing; por isso, não coletaram deliberadamente publicações que comparassem claramente código fechado e aberto. Como resultado, discussões sobre código aberto concentraram-se no Lemmy e no YouTube. No YouTube, visualizações e números de inscritos não puderam ser recuperados devido às limitações de renderização JavaScript.
Resumo por plataforma
Reddit — Notícias de IA para geração de imagens e vídeos
Principais espaços de discussão (subreddits)
Os 12 tópicos coletados vieram todos de subreddits diferentes, um de cada. Comunidades especializadas em IA de imagem e vídeo foram minoria; destacaram-se subreddits de filmes, verificação de falsificações e controvérsias sobre cultura de IA.
| Subreddit | Membros | Tópicos coletados |
|---|---|---|
| r/whenthe | 813,975 | 1 |
| r/isthisAI | 406,607 | 1 |
| r/antiai | 317,903 | 1 |
| r/aiwars | 167,158 | 1 |
| r/generativeAI | 151,385 | 1 |
| r/RemoteWorkers | 75,332 | 1 |
| r/DefendingAIArt | 72,770 | 1 |
| r/pj_explained | 96,256 | 1 |
| r/NewRockstars | 15,523 | 1 |
| r/freetoolsAI | 7,887 | 1 |
| r/aivideomaking | 6,517 | 1 |
| r/GoogleFlow | 1,789 | 1 |
A única consulta foi "Image and Video Generation AI News". Os resultados se concentraram mais em comunidades de controvérsia sobre IA — r/antiai, r/aiwars e r/DefendingAIArt — e de verificação “isto é IA?” — r/isthisAI, r/pj_explained, r/NewRockstars e r/whenthe — do que em comunidades especializadas como r/generativeAI, r/aivideomaking, r/GoogleFlow e r/freetoolsAI.
Reações da comunidade
- GPT-6 desenha ilustrações “à mão” com controle do mouse e também pode falsificar time-lapses (tópico 2, r/antiai, 7.013 pontos e 1.009 comentários, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). A publicação afirma que, em vez de um modelo de difusão, um LLM (GPT-6) recebeu controle de mouse e teclado para desenhar em software digital e gerar até um time-lapse aparentemente autêntico. O principal comentário, de u/Nayutantantan (2.507 pontos), expressou desânimo: “não tenho mais energia nem para gravar time-lapses como prova”.
- GPT-6 “Astra” cria renderização fotorrealista no Blender (tópico 9, r/DefendingAIArt, 143 pontos e 13 comentários, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). O destaque foi que a IA não gerou diretamente o vídeo: um agente de IA operou o Blender para produzir a renderização. u/TheMaliciousSquid comentou que GPT-6 pode se tornar o mais forte em tarefas visuais e questionou se superaria Claude em programação.
- Extensão “AutoFlow” para Google Flow passa a oferecer geração de vídeo contínua (tópico 12, r/GoogleFlow, 12 pontos e 6 comentários, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Foi adicionado o recurso “Continue from Last Frame”, que transfere automaticamente o último quadro de um clipe para o primeiro do próximo, além de filas de múltiplas gerações e gerenciamento de imagens de referência. A próxima função anunciada é unir clipes em um único vídeo contínuo.
- Há forte demanda por anúncios de ferramentas gratuitas de geração de imagens por IA (tópico 3, r/freetoolsAI, 39 pontos e 48 comentários, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Uma apresentação de serviço gratuito, ilimitado e sem cadastro atraiu comentários. u/Puzzleheaded_Lab4757 afirmou ter economizado centenas de dólares e muitas horas, enquanto u/thecragmire questionou a sustentabilidade: “como eles cobrem os custos operacionais?”.
- Vídeo de IA ainda esbarra em duração e consistência de personagens (tópico 10, r/generativeAI, 4 pontos e 15 comentários, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). Para alguém que queria produzir um vídeo cinematográfico de ficção científica de 2 a 4 minutos, u/Missy_Desu sugeriu criar quadros com GPT Image 2 e convertê-los em vídeo com Seedance 2.5, alertando que o custo pode chegar a cerca de US$100 por minuto concluído. u/KissinglyPolished afirmou que manter consistência de personagens ao passar de imagem estática para vídeo é extremamente difícil e que ferramentas tudo-em-um ainda não resolveram isso.
- Geração de vídeo gratuita em hardware leve segue impraticável (tópico 8, r/aivideomaking, 6 pontos e 15 comentários, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). A alguém que queria criar gratuitamente um vídeo de IA de 45 segundos usando apenas celular e iPad, u/NewLifeWares respondeu que 45 segundos exigem recursos de datacenter; gratuitamente, o máximo seria algo como cinco segundos com marca-d’água, que depois precisariam ser unidos.
- Imagens de comida feitas por IA para publicidade ainda recebem críticas por parecerem pouco apetitosas (tópico 4, r/aiwars, 4 pontos e 177 comentários, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Houve críticas à adoção de imagens de alimentos geradas por IA em anúncios. u/LCI_Jake disse que parecia uma imagem grotesca gerada intencionalmente, como um ninho de insetos. Por outro lado, u/Bassed_Hummble compartilhou um resultado criado localmente com Krea 2 em 40 segundos e argumentou que o resultado pode melhorar com o prompt certo.
- Vaga remota para avaliar legendas de IA recebe muitas reações (tópico 5, r/RemoteWorkers, 152 pontos e 739 comentários, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). A vaga pagava US$30 por hora para verificar erros em legendas geradas por IA, como objetos, cores e textos interpretados incorretamente. A maior parte dos comentários foi uma reação padronizada pedindo o link de candidatura, com pouca discussão sobre o conteúdo.
- Dois debates sobre autenticidade de vídeos de IA excessivamente realistas (tópicos 1/6, r/NewRockstars e r/pj_explained, republicação do mesmo post, 2026-09-02). Uma publicação sustentava que o suposto vazamento de Thor colidindo com um pilar era CGI, não IA. O principal comentário em r/pj_explained, de u/ceaserisnothome, respondeu que a explosão perfeitamente circular era prova de IA. O mesmo vídeo recebeu conclusões opostas.
- Vídeo de ondas surgindo dentro de uma janela divide os comentários entre IA e filmagem real (tópico 7, r/isthisAI, 0 pontos e 79 comentários, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). O autor apontou como estranho que a água surgisse dentro do ambiente sem quebrar a janela. u/RioReiser85 interpretou como erro de perspectiva em uma filmagem real; u/bulbousEd argumentou que o movimento da espuma na proa seria fisicamente impossível e indicaria IA.
Sinais
- O que está crescendo: a preocupação de que a IA não pareça IA. A grande repercussão do tópico 2 — 7.013 pontos e 1.009 comentários — mostra forte apreensão com a chegada de LLMs capazes de operar diretamente ferramentas GUI e falsificar até evidências de desenho manual.
- O que está sendo descartado: pedidos por vídeos longos, gratuitos e de alta qualidade são repetidamente rejeitados pela comunidade (tópicos 8 e 10). A percepção compartilhada no Reddit é que limites de hardware e custo ainda são severos.
- O que surpreendeu: subreddits especializados em geração de imagem e vídeo — r/generativeAI, r/aivideomaking e r/GoogleFlow — tiveram menos intensidade de discussão e engajamento do que comunidades de verificação de autenticidade e controvérsia sobre IA, como r/isthisAI, r/antiai, r/aiwars, r/pj_explained, r/NewRockstars e r/whenthe. No Reddit atual, as “notícias” de IA para imagem e vídeo são tratadas mais como atrito social sobre “isto é IA ou não?” do que como evolução de modelos.
- Sinais conflitantes: os comentários em r/NewRockstars e r/pj_explained chegaram a conclusões diametralmente opostas sobre o mesmo vídeo vazado de Thor (tópicos 1/6). O mesmo equilíbrio entre defensores de filmagem real e de IA aparece no tópico 7, indicando que a avaliação visual de usuários comuns já não é confiável.
Limitações
- A única consulta foi "Image and Video Generation AI News"; não foram feitas buscas alternativas como "Stable Diffusion", "Midjourney", "Sora", "Kling" ou "geração de imagens open source". Portanto, quase não foram coletadas publicações que permitissem comparar claramente produtos fechados — Midjourney, DALL-E, Sora, Veo, Runway — e o ecossistema aberto — Stable Diffusion, Flux e ComfyUI.
- Os 12 tópicos pertencem a 12 subreddits diferentes, um de cada, sem aprofundamento dentro de uma mesma comunidade para comparar vários tópicos sobre o mesmo tema.
- Os tópicos 9 e 11 não tinham corpo de texto, apenas título e comentários, deixando pouca informação primária sobre a intenção da publicação.
- Os tópicos 1 e 6 são, na prática, republicações do mesmo conteúdo em subreddits diferentes; ao contá-los como dois itens independentes, a amostra efetiva cai para cerca de 11 itens.
- Pela natureza da coleta em navegador, não foram feitas nesta execução novas consultas no Reddit com outros termos nem expansão de todos os comentários dos tópicos.
X
X — Notícias de IA para geração de imagens e vídeos
Contas
Os 40 itens coletados vieram de 37 contas. A maioria é de tipo pontual: uma única publicação que viralizou ou passou despercebida. A única conta relacionada a IA de imagem e vídeo com várias publicações em sequência foi @yu_ichi_suzuki.
| Conta | Publicações | Tendência |
|---|---|---|
| @yu_ichi_suzuki(鈴木憂一) | 2 | Publicou uma sequência técnica sobre executar MiniMax H3 localmente em uma RTX 5090, totalizando 309 curtidas; formato de explicação passo a passo, não um viral isolado |
| @xieenze_jr(Enze Xie) | 1 | Publicação do próprio pesquisador da MiniMax anunciando novo modelo: 349 curtidas e cerca de 85.000 visualizações |
| @voxelphotonics | 1 | Demonstração de Duke Nukem 3D em display volumétrico, com 6.097 curtidas e cerca de 297.000 visualizações |
| @synabreu | 1 | Modelo de cidade 3D de Seul feito com GPT-6 Astra, com 2.700 curtidas e cerca de 235.000 visualizações |
| @GulatiYajat(Yajat Gulati) | 1 | Cidade 3D de Gurgaon criada com GPT-6 Astra, 574 curtidas |
| @luccacerf | 1 | Demonstração da combinação Blender MCP + Astra + Tripo, 445 curtidas |
| @He1s_Sammy | 1 | Thread longa sobre a transformação de vídeos infantis de IA sem mostrar o rosto em negócio, 388 curtidas |
| @SD_Tutorial(Stable Diffusion Tutorials) | 1 | Conta de explicações técnicas sobre Sol-H3, com resposta menor: 22 curtidas |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | 1 cada | Contas de médio e pequeno porte discutindo qualidade e limites de Seedance 2.5 e vídeo de IA |
Exceto por @xieenze_jr, não eram os próprios desenvolvedores, mas usuários que testaram ou construíram algo. A discussão foi conduzida por dois níveis: alguns posts virais grandes — @voxelphotonics e @synabreu — e compartilhamentos de procedimentos por indivíduos técnicos — @yu_ichi_suzuki e @SD_Tutorial.
Publicações
- MiniMax anuncia Sol-H3, geração de vídeo mais rápida que reprodução em tempo real (#2 @xieenze_jr, 349 curtidas, 62 reposts, 23 respostas e cerca de 85.000 visualizações, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). O anúncio afirma: “Five seconds of world. 1.653 seconds to infer.” Com 8× NVIDIA B300 Blackwell, cinco segundos de vídeo em 1344×768 poderiam ser gerados em 1,653 segundo. A publicação originou a tendência nº 1 do X Explore: “NVIDIA Speeds Up AI Video Generation Past Real-Time Playback”.
- Explicação técnica do anúncio se espalha (#3 @SD_Tutorial, 22 curtidas e cerca de 2.100 visualizações, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). A publicação descreve uma pilha de inferência de vídeo de alto desempenho desenvolvida pela NVIDIA Research, capaz de executar MiniMax-H3 mais rápido que reprodução em tempo real, e aponta para as páginas Sol-Engine/Sol-H3 em nvlabs.github.io. Contas técnicas acompanharam rapidamente o anúncio original.
- Procedimento para rodar MiniMax H3 localmente em RTX 5090 (#4–5 @yu_ichi_suzuki, 295+14 curtidas e cerca de 18.000+1.100 visualizações, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). O autor compartilhou um fluxo de trabalho para gerar aproximadamente 15 segundos de vídeo em resolução superior a 2K em cerca de nove minutos usando MiniMax H3 local, LoRA destilado da Alibaba para selecionar bons resultados em 480p e RTX Video Super Resolution para ampliar para 2688×1536. Em contraponto ao anúncio em nuvem, mostra uso intenso de pesos abertos por indivíduos.
- Vídeo de moda criado com Seedance 2.5 (#1 @Strength04_X, 68 curtidas, 2 reposts, 35 respostas e cerca de 7.700 visualizações, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). A publicação afirma ter criado com Seedance 2.5 no Dreamina_ai um vídeo musical cinematográfico fotorrealista de moda e viagem de 30 segundos, junto com o prompt completo.
- Mundo no estilo Toy Story criado com Seedance 2.5 (#14 @atlas_remake, 3 curtidas e cerca de 133 visualizações, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). A publicação elogia a maneira como Seedance 2.5 lida com múltiplos personagens e objetos animados, avaliando positivamente a consistência de vários personagens.
- Crítica: “vídeo de IA ainda é uma máquina caça-níquel” (#12 @Aiden_Tech_Ai, 1 curtida, 2 reposts, 4 respostas e cerca de 494 visualizações, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). O post descreve o ciclo de gerar repetidamente porque sempre há algo errado, sobretudo com múltiplos espaços, movimento de câmera, bloqueio de personagens e continuidade. O engajamento foi pequeno, mas o argumento contrasta com a avaliação otimista do item 5.
- Duke Nukem 3D reproduzido em display 3D volumétrico (#10 @voxelphotonics, 6.097 curtidas, 921 reposts, 130 respostas e cerca de 297.000 visualizações, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Foi o post de maior engajamento do período. Não é geração de imagem ou vídeo em si, mas uma demonstração de tecnologia de renderização e exibição que impulsionou a tendência nº 3 do Explore, “Duke Nukem 3D Brought to Life in True 3D Display”.
- GPT-6 “Astra” transforma toda Seul em uma cidade 3D (#20 @synabreu, 2.700 curtidas, 451 reposts, 81 respostas e cerca de 235.000 visualizações, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Como aplicação de geração 3D conversacional, o autor afirmou ter construído toda a cidade de Seul em 3D em seu primeiro projeto com GPT-6 Astra, descrevendo isso como uma pequena revolução na geografia digital.
- Gurgaon também é recriada como cidade 3D com GPT-6 Astra (#22 @GulatiYajat, 574 curtidas, 28 reposts, 53 respostas e cerca de 46.000 visualizações, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). O autor disse que viu todos criando demonstrações legais com Astra e decidiu tentar também, evidenciando que havia seguidores aderindo à onda do item 8. Também publicou o site dedicado gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
- Demonstração da combinação Blender MCP + Astra + Tripo (#21 @luccacerf, 445 curtidas, 20 reposts, 11 respostas e cerca de 31.000 visualizações, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). O post descreve a primeira experiência construindo uma GUI com Blender MCP, Astra e Tripo, chamando o resultado de insano e sugerindo que a prévia HTML para IA está morta. É um exemplo de integração de várias ferramentas de IA via MCP.
- Vídeos infantis de IA sem mostrar o rosto tornam-se negócio de conteúdo (#23 @He1s_Sammy, 388 curtidas, 96 reposts, 17 respostas e cerca de 19.000 visualizações, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). O post, sobre monetização e renda extra com vídeos gerados por IA, afirma que esse tipo de conteúdo está se tornando um negócio sério e que um celular, notebook ou iPad basta para começar a experimentar.
Sinais
- O que está crescendo: experiências em que agentes conversacionais criam mundos 3D — cidades 3D com GPT-6 Astra e integração com Blender MCP — foram as que mais geraram imitações e seguidores no período. Depois de ver o post de synabreu no item 8, GulatiYajat disse explicitamente no item 9 que também decidiu fazer um, sinalizando uma cadeia de imitações e não apenas uma notícia isolada.
- O que está crescendo, em segundo lugar: inferência de vídeo mais rápida que reprodução em tempo real — Sol-H3, itens 2/3 — e o movimento de reproduzi-la em GPU local — @yu_ichi_suzuki — apareceram praticamente ao mesmo tempo. No X, anúncio de código fechado e uso individual de pesos abertos avançam lado a lado sem atraso visível.
- O que é subestimado ou divide opiniões: a consistência de múltiplos personagens e espaços no vídeo de IA segue sem consenso. O elogio no item 5, de que o sistema lida bem com múltiplos personagens animados, e a queixa no item 6, de que é um problema de máquina caça-níquel, foram publicados no mesmo período.
- O que surpreendeu: das nove tendências do Explore que originaram os 40 posts coletados, apenas as três primeiras tinham relação direta com IA de imagem e vídeo: NVIDIA/Sol-H3, o retorno animado da VTuber Veibae e o display volumétrico de Duke Nukem 3D. As seis restantes — Croatian, Building, $song, Harvey, Ukrainian, Democrats — eram tendências regionais ou assuntos sem relação com o tema. Ainda assim, uma busca por “Building” trouxe acidentalmente as demonstrações de alta qualidade de cidades 3D com GPT-6 Astra, itens 8 a 10.
- Caso da VTuber Veibae: a busca pela tendência nº 2, “VTuber Veibae Teases Return with Sunflower Farm Animation”, retornou somente contas que compilavam bilheteria norte-americana, como @mediamanint, com publicações repetidas e sem relação. Não foi coletada nenhuma publicação da própria Veibae ou sobre a produção da animação.
Limitações
- Entre as três principais tendências do Explore, “VTuber Veibae Teases Return with Sunflower Farm Animation” poderia estar diretamente ligada a IA de imagem e vídeo, mas a busca não reuniu publicações relevantes; os itens #6 a #9 eram posts repetidos e irrelevantes sobre bilheteria. Não foi possível confirmar se a animação da VTuber usou IA.
- As seis tendências restantes do Explore — Croatian, Building, $song, Harvey, Ukrainian e Democrats — eram quase inteiramente tendências regionais ou notícias sem relação com IA de imagem e vídeo. Dos 40 itens coletados, 29 — #6 a #9, #13, #15 a #19, #24 a #40 — foram excluídos deste relatório como fora de escopo.
- As buscas ficaram limitadas aos títulos literais das tendências. Não houve consulta por nomes centrais como "Stable Diffusion", "Midjourney", "Sora", "Kling" ou "ComfyUI". Por isso, quase não foram reunidos posts que permitissem comparar claramente ferramentas fechadas — Midjourney, Sora, Runway e Veo — com ferramentas abertas — Stable Diffusion, Flux e ComfyUI.
- O Explore estava ligado à localização do servidor desta sessão, aparentemente a região da Croácia, e não representa necessariamente tendências globais do X.
- A coleta foi interrompida em 40 itens; não houve aprofundamento adicional, como examinar outras publicações das mesmas contas, expandir respostas ou buscar hashtags.
YouTube
YouTube — Tendências recentes em IA de geração de imagens e vídeos
Canais
- 動画編集の中の人 (canal) — publica muitas comparações de uso prático de IA de geração de imagens.
- AI大学【AI&ChatGPT最新情報】 (canal) — produz principalmente vídeos mensais de resumo de ferramentas de IA generativa.
- 【さき】のAIでええやん。 (canal) — explica atualizações do Google I/O e do ecossistema Gemini.
- Qwen(oficial) (canal) — publica vídeos oficiais de anúncio da série Qwen-Image.
- AIOnTrend (canal) — faz comparações diretas de modelos de imagem open source.
- Urban Decoders (canal) — explica arquitetura de modelos da linha Flux.
- SECourses (canal) — realiza avaliações amplas de geração de imagens local, como testes com mais de 700 casos.
- Woollyfern (canal) — acompanha atualizações mensais do Midjourney.
- 寺田部チャンネル (canal) — analisa na prática geração local de vídeo com ComfyUI.
- 東京大学 吉田幸 研究室 (canal) — publica explicações regulares de tendências em IA generativa a partir de uma universidade.
O número de inscritos não pôde ser obtido das páginas de resultado ou de vídeo do YouTube devido à renderização JavaScript, conforme as limitações abaixo.
Vídeos
Código fechado
- 【Após gastar muito, ficou claro】Estas são as IAs de geração de imagem recomendadas para 2026! Comparação detalhada entre NanoBananaPro, Seedream4.0, Midjourney e AdobeFirefly! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — comparação prática, após pagar pelos serviços, entre Nano Banana Pro, Seedream 4.0, Midjourney e Adobe Firefly, com uma conclusão sobre a melhor recomendação em 2026.
- 【Novidades do inverno de 2026】Seis ferramentas populares e gratuitas de IA para geração de vídeo que mais evoluíram nos últimos meses: Sora 2, Veo 3.1, Kling 2.6 e outras — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — apresenta seis ferramentas gratuitas de geração de vídeo, incluindo Sora 2, Veo 3.1 e Kling 2.6, destacando o grande ritmo de evolução nos últimos meses.
- 【1º lugar mundial no ranking de desempenho】Explicação detalhada da IA de geração de vídeo Grok Imagine, da xAI: como criar vídeos de nível Sora/Veo de graça — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — afirma que Grok Imagine, da xAI, alcançou o primeiro lugar em um ranking de desempenho e explica como criar gratuitamente vídeos de nível Sora e Veo.
- 【Novidade】O Google atualizou fortemente os modelos Gemini e anunciou o Omni de geração de vídeo no Google I/O 2026 — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — explica a grande atualização do Gemini anunciada no Google I/O 2026 e o novo modelo de geração de vídeo “Omni”.
- Atualização do Midjourney | Julho de 2026: V8.2 CHEGOU! Personalização, NIJI Style Creator e mais! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — relata o lançamento do Midjourney V8.2, com personalização e NIJI Style Creator, como a edição mais recente de uma sequência mensal: V8 Alpha em março de 2026, V8.1 em abril, prévia V8.2 em junho e versão final V8.2 em julho.
Código aberto
- 🚀 Apresentando Qwen-Image-2.0 — nosso modelo de geração de imagens de próxima geração! — canal oficial Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — vídeo oficial da equipe Alibaba Qwen apresentando Qwen-Image-2.0 como modelo open source de geração de imagens de nova geração.
- Qwen Image domina texto para imagem: mais de 700 testes revelam por que ele é melhor que FLUX — presets publicados — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — avalia, com base em mais de 700 testes, os pontos em que Qwen Image supera FLUX e publica presets.
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro — qual IA de imagem vence? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — compara os modelos open source Flux 2 Klein, Qwen e Z Image Turbo com o Nano Banana Pro de código fechado usando o mesmo prompt.
- Flux.2: novo rei do código aberto? Guia COMPLETO de arquitetura + comparações com Nano Banana Pro — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — explica a arquitetura de Flux.2, lançado pela Black Forest Labs, e investiga se ele é o novo campeão open source ao compará-lo com Nano Banana Pro.
- Flux 2 Klein acabou de chegar — este modelo de edição de imagem não é só sobre velocidade! — https://www.youtube.com/watch?v=JXgBe3twxbc — notícia rápida sobre o lançamento do Flux 2 Klein, um modelo leve de edição de imagens da Black Forest Labs que pode ser executado localmente.
- Wan 2.2, FLUX e Qwen Image atualizados: tutorial definitivo dos modelos SOTA open source de geração de imagem e vídeo — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — tutorial que reúne as atualizações de Wan 2.2, da Alibaba, FLUX e Qwen Image, entre outros modelos abertos de ponta.
- 【Grátis e ComfyUI】É fácil criar um longa-metragem com IA de vídeo local? É extremamente difícil — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — relato prático sobre produzir vídeos longos com ComfyUI e IA de vídeo local, com dificuldades e aprendizados francos.
Sinais
- No código fechado, a disputa é preço e velocidade versus qualidade: vários conteúdos de comparação afirmam que Nano Banana Pro vence 63% dos testes de fotorrealismo (vídeos 1 e 9), enquanto alternativas gratuitas ou baratas, como Grok Imagine (vídeo 3), promovem de modo provocativo a promessa de “Sora/Veo de graça”.
- Midjourney continua melhorando a série V8 em ritmo mensal: o canal Woollyfern acompanha uma sequência de V8 anunciado em fevereiro de 2026, Alpha em março, V8.1 em abril, prévia V8.2 em junho e V8.2 final em julho. O ritmo de atualização se destaca (vídeo 5).
- O anúncio do Gemini “Omni” para geração de vídeo no Google I/O 2026 foi tratado como uma grande notícia própria, com explicação rápida também em canal japonês (vídeo 4).
- O lado open source disputa liderança entre Qwen Image e FLUX: canais mais aprofundados, como SECourses com mais de 700 testes (vídeo 7) e Urban Decoders com explicações de arquitetura (vídeo 9), seguem publicando avaliações sobre qual dos dois é superior, indicando alto interesse comunitário.
- Flux 2 Klein, da Black Forest Labs, é tratado como uma variante focada em leveza e execução local, recebendo cobertura própria (vídeo 10), separadamente do Flux.2 completo.
- Wan e Qwen Image, da Alibaba, são tratados como os dois pilares abertos para vídeo e imagem, a ponto de figurarem juntos em um mesmo tutorial (vídeo 11).
- A geração local de vídeo continua sendo considerada difícil na prática: uma análise direta conclui que a produção de vídeos longos com ComfyUI é extremamente trabalhosa (vídeo 12). Além da qualidade, o peso operacional é apresentado como desafio do vídeo open source.
Limitações
- As páginas de resultados do YouTube (
/results?search_query=...) e as páginas de vídeo são renderizadas em JavaScript. Por isso, a coleta web recebeu apenas HTML estático com links de rodapé sobre termos e direitos autorais; não foi possível ler listas de vídeos, visualizações, datas, descrições ou comentários diretamente. Isso conflita com a premissa do playbook de que o HTML da página contém título, canal, visualizações e data. - Como alternativa, foram combinados busca web
site:youtube.com, que ofereceu títulos, URLs, resumos do mecanismo de busca e algumas datas, com o endpointoembeddo YouTube, que forneceu título oficial, nome e URL do canal em JSON. Ainda assim, visualizações, inscritos, texto das descrições e comentários não puderam ser obtidos e não foram incluídos. - Buscas em japonês por notícias de agosto e setembro de 2026 retornaram pouca informação específica sobre IA de geração de imagem e vídeo, misturando canais de notícias diárias de IA em geral e notícias meteorológicas irrelevantes. Não foram encontrados boletins especializados publicados na última semana, de 1 a 8 de setembro.
- Reddit, X, Bluesky, Lemmy e Pinterest não foram analisados nesta etapa do YouTube, conforme o briefing; cada um foi tratado em outra etapa.
Bluesky
Bluesky — Notícias de IA para geração de imagens e vídeos
Contas
| Handle | Perfil | Seguidores etc. | Observação |
|---|---|---|---|
| @simonwillison.net | Pessoa física, conhecido blogueiro técnico de IA e autor de Datasette | — | Compara capacidades de geração de imagem usando seu benchmark próprio de “pedir uma imagem de pelicanos andando de bicicleta” sempre que surge um novo modelo. Foi a fonte mais densa desta coleta. |
| @404media.co | Veículo de mídia, com várias contas editoriais e de repórteres da 404 Media | — | Focado em cobertura de vigilância, mas ocasionalmente publica furos sobre mídia gerada por IA. |
| @aimod.social | Operação comunitária, rotulador de imagens suspeitas de IA | 2.555 seguidores e 94 posts | Serviço oficial de rotulagem do Bluesky que marca automaticamente imagens suspeitas de terem sido geradas por IA. É infraestrutura, não fonte de notícias. |
| @stablediffusion.bsky.social | Pessoa física, compartilhamento de prompts SDXL/Stable Diffusion | — | Não publica desde janeiro de 2025. |
| @bm63ai.bsky.social | Pessoa física, arte com ComfyUI/Flux/Midjourney | — | Publicava arte de IA até abril de 2025. O último post, de junho de 2026, é sobre criar um aplicativo com Codex via vibe coding; a publicação de arte de IA praticamente cessou. |
| @petapixel.bsky.social | Veículo de mídia especializado em fotografia | — | Aborda criticamente recursos de IA generativa da Adobe, como Firefly e Lightroom, mas a última publicação recente é de fevereiro de 2025 e não entra neste ciclo de notícias. |
Publicações
- O benchmark de pelicano em bicicleta volta com GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 curtidas, 9 reposts e 18 respostas, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Com “Got access to GPT-6 Astra. Want to see some pelicans?”, o autor publicou uma grade comparando ilustrações SVG de pelicanos em bicicleta produzidas por GPT-6 Astra, GPT-5.6 Sol, Terra e Luna, em três níveis de raciocínio. Segundo o texto alternativo, Astra produziu resultados refinados e consistentes, Sol variou nas proporções, Terra apresentou anatomia estranha e Luna fez poses mais simples e rígidas. Uma resposta observou que Astra foi o primeiro modelo a entender que uma criatura quadrúpede fictícia precisaria de uma bicicleta tandem.
- GPT-6 Astra opera o Blender e gera uma cena 3D de pelicano (@simonwillison.net, 2026-09-05, 400 curtidas e 30 reposts, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Com três instruções sucessivas — usar o Blender já instalado para renderizar um pelicano andando de bicicleta, adicionar fundo e estilo, e melhorar bastante o resultado — o autor publicou a cena 3D criada por meio de um agente de programação. O mesmo tema, GPT-6 Astra produzindo renderização fotorrealista no Blender, apareceu independentemente no r/DefendingAIArt do Reddit, confirmando alcance transversal.
- Qwen 3.7 27B open source desenha um pelicano localmente (@simonwillison.net, 2026-08-14, 183 curtidas e 14 reposts, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). O autor afirmou que o novo Qwen 3.7 27B, executado como GGUF de 17 GB no LM Studio de um MacBook Pro M5 Max, desenhou o melhor pelicano em bicicleta que ele já viu entre modelos capazes de rodar no notebook. É uma das poucas publicações concretas sobre evolução de geração de imagem local e aberta.
- Candidato a governador de Nova York usa vídeo falso gerado por IA contra adversários (@404media.co, 2026-09-02, 124 curtidas, 22 reposts e 7 respostas, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). A publicação relata que o candidato republicano ao governo de Nova York criou um vídeo perturbador gerado por IA sobre Mamdani e Hochul. Um post citado ironiza que agora vivemos numa época em que se cria um falso comercial de Viagra para humilhar adversários, com 194 curtidas e 36 reposts (https://bsky.app/profile/404media.co/post/3muk7u6iepk2h). É um caso de uso de vídeo generativo em desinformação política.
- Empresa por trás de Cocomelon instrui artistas a experimentar IA (@404media.co, 2026-09-06, 84 curtidas, 23 reposts e 21 respostas, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). A Moonbug Entertainment, produtora de Cocomelon, Blippi e outros conteúdos infantis populares, afirmou que começará a usar IA, mantendo sempre um humano no circuito. É uma declaração de adoção de IA de imagem e vídeo em um caso de uso importante: produção audiovisual infantil.
- O rotulador de imagens suspeitas de IA aimod.social tem mais de 2.500 seguidores (análise de perfil, https://bsky.app/profile/aimod.social). O serviço se apresenta como rotulador para sinalizar imagens suspeitas de IA e mantém manual de critérios e canal de recurso. Não é uma notícia, mas mostra demanda comunitária por mecanismos que suspeitam e rotulam automaticamente imagens geradas por IA no Bluesky.
- Contas tradicionais de arte de IA estão em silêncio (análise dos feeds de @stablediffusion.bsky.social e @bm63ai.bsky.social). stablediffusion.bsky.social não atualiza desde 22 de janeiro de 2025, quando publicou o prompt “the liberty statue playing electric guitar” com #SDXL e #StableDiffusion. bm63ai.bsky.social parou as publicações de arte de IA após “Star Trek: The Muppet Generation”, de 25 de abril de 2025, com #comfyui #midjourney #flux; seu último post, em 8 de junho de 2026, mudou para um aplicativo musical feito com agente de programação.
- Críticas antigas aos recursos generativos da Adobe, como referência (@petapixel.bsky.social, 2025-02-12 e 2025-01-09, 7 e 33 curtidas). Houve crítica ao recém-anunciado recurso texto-para-vídeo da Adobe, considerado não pronto para custar dinheiro, e relato de que o Generative Remove do Lightroom gerou um logotipo de Bitcoin ao tentar remover objetos. São posts anteriores ao ciclo de setembro de 2026, mantidos apenas como registro de continuidade da crítica a ferramentas comerciais fechadas.
Sinais
- O que está crescendo: tarefas visuais produzidas por GPT-6 Astra — desenho SVG de pelicano e operação do Blender para renderização 3D — foram abordadas independentemente no Reddit, em r/DefendingAIArt e r/antiai, e no Bluesky, por @simonwillison.net. Trata-se do maior assunto transversal, embora seja mais precisamente um novo gênero em que agentes LLM produzem visuais por código e ferramentas 3D, e não geração por difusão.
- O que está sendo deixado de lado: o lado open source é extremamente escasso; só foi encontrado um relato de execução local do Qwen 3.7 27B. Não apareceram posts sobre lançamentos de modelos especializados como FLUX, novas versões de Stable Diffusion, Wan ou HunyuanVideo.
- O que surpreendeu: contas antes ativas em arte de IA, como stablediffusion.bsky.social e bm63ai.bsky.social, ficaram silenciosas, enquanto um serviço que suspeita e rotula automaticamente imagens de IA, aimod.social, permaneceu e cresceu como infraestrutura comunitária. O centro de gravidade do Bluesky pode estar migrando de “criar” para “identificar e moderar”.
- Sinais conflitantes: as notícias concretas sobre vídeo generativo se destacaram menos pela competição técnica de modelos e mais por usos controversos, como o vídeo político falso na eleição para governador de Nova York. No Bluesky, IA de vídeo tem mais visibilidade como problema social do que como tendência tecnológica.
Limitações
- A API pública de busca do Bluesky,
app.bsky.feed.searchPosts, retornou HTTP 403 de forma consistente para toda consulta em inglês e japonês, incluindo "image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo" e "Kling".app.bsky.actor.getProfileeapp.bsky.feed.getAuthorFeedfuncionaram na mesma sessão, sugerindo bloqueio ou exigência de autenticação apenas no endpoint de busca. - A interface web
bsky.app/searché uma SPA renderizada no cliente; os textos das publicações não estavam presentes no HTML, portanto a ferramenta de coleta não conseguiu ler resultados da busca. - Por isso, o procedimento previsto — busca por palavras-chave e leitura das publicações — não pôde ser aplicado. Foram usados feeds individuais de contas conhecidas, identificadas por busca web: simonwillison.net, 404media.co, petapixel.bsky.social, aimod.social, stablediffusion.bsky.social e bm63ai.bsky.social. A coleta é uma amostra de contas, não substitui uma busca abrangente por palavras-chave.
- Contas esperadas como OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica e Engadget não existiam no Bluesky, retornaram HTTP 400 por conta não encontrada ou não possuíam posts relevantes de imagem e vídeo em seus feeds.
- Não foi possível atingir o critério de aproximadamente 20 posts analisados por plataforma. Apenas os oito itens desta seção, mais uma referência antiga, puderam ser analisados; nos demais feeds obtidos não havia publicações pertinentes.
- Não foram encontradas publicações concretas sobre modelos abertos de imagem e vídeo, como FLUX, novas versões de Stable Diffusion, Wan e HunyuanVideo. O método empregado não permite distinguir entre ausência de discussão e perda de resultados devido à impossibilidade de buscar.
Lemmy
Lemmy — Notícias de IA para geração de imagens e vídeos
O Lemmy é uma rede social federada com escala muitas centenas de vezes menor que o Reddit; por isso, “viralizar” aqui significa dezenas de votos positivos, e não centenas. Mesmo assim, surgiram informações densas, principalmente em !«メールアドレス» — lançamentos de ComfyUI e modelos —, !ai_reddit — um bot que republica notícias de r/ArtificialIntelligence —, e !technology e !techtakes, mais irônicos. As buscas foram feitas repetidamente em lemmy.world/api/v3/search com palavras-chave diferentes.
Comunidades
!«メールアドレス»— 5.709 inscritos, dos quais 893 locais. Hub de nós personalizados para ComfyUI e lançamentos de modelos; há posts quase todos os dias.!«メールアドレス»— 2.362 inscritos. Galeria de trabalhos feitos com Stable Diffusion, Flux e Krea2.!«メールアドレス»— dedicada a arte de IA em estilo anime. O número de inscritos não estava disponível, mas a atividade é comparável à anterior.!«メールアドレス»— 87.904 inscritos. Reproduz artigos de grandes veículos de tecnologia; a controvérsia da Midjourney também apareceu aqui.!«メールアドレス»— 2.690 inscritos. Comunidade de crítica sarcástica à indústria de IA, que atacou duramente a possível guinada da Midjourney.!«メールアドレス»— conta de republicação RSS de r/ArtificialIntelligence. A contagem de inscritos não foi obtida pela API, mas é onde a densidade de notícias foi maior.!«メールアドレス»— 8.154 inscritos. Comunidade anti-IA, onde também circularam artigos criticando a cadeia de suprimentos da IA generativa.
Publicações
Mais próximas de código fechado
- Midjourney muda para ultrassom médico “Midjourney Medical” (?) — 2026-06-18–19, gerou grande discussão em
!techtakese!hackernews. The Register ironizou uma espécie de spa de medicina estética com luz dourada, e pivot-to-ai.com comparou a mudança a uma guinada para Theranos. Pontuação entre 40 e 58.
https://lemmy.world/post/48384985 (artigo original: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/) - Midjourney exige que estúdios de Hollywood revelem como usam IA — artigo da TechCrunch, com pontuação 73 em
!technology, como continuação da controvérsia sobre processos de direitos autorais.
https://lemmy.world/post/49069400 - Google lança Nano Banana 2 Lite — versão leve do modelo de geração de imagens da DeepMind, compartilhada via
!hackernewse mídia técnica suíça itmagazine.ch, entre 2026-06-30 e 07-02.
https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/) - MAI-Image-2.5, da Microsoft, alcança Nano Banana 2 em benchmarks — via the-decoder.com, em
!ai_reddit, 2026-05-28.
https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - Análise comparativa séria do ByteDance Seedream 5.0 Pro — menciona força em edição e geração iterativa, em
!ai_reddit, 2026-07-10.
https://www.reddit.com/gallery/1usc03q - Recurso Earth AI do Google é interrompido um dia após ser lançado — usuários começaram a sobrepor imagens falsas a lugares reais, levando à cobertura da Fortune, em
!ai_reddit, 2026-08-07.
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/ - Negócio corporativo da Runway dobra, com NRR acima de 300% — discussão de crescimento empresarial da empresa de vídeo generativo, em
!ai_reddit, 2026-08-30.
https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says-enterprise-business-doubled-nrr-over/ - Amnesty International critica os principais sistemas de IA como ilegais desde a concepção — contexto de pressão regulatória contra IA generativa em
!ai_reddit, 2026-06-24.
https://reddit.com/r/ArtificialInteligence/comments/1ue64s2 - Pax Silica: a instrumentalização da cadeia de suprimentos de IA — análise da guerra econômica entre EUA e China por semicondutores e capacidade computacional para IA, tratada como risco geopolítico das grandes empresas de tecnologia em
!fuck_ai, com pontuação 14, 2026-09-06.
https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare - Pediram a “Astra 6 max” que criasse arte capaz de emocionar o próprio autor — geração de arte filosófica e autorreferencial com modelo comercial fechado, em
!ai_reddit, 2026-09-05.
https://i.redd.it/3h241pocalnh1.png
Mais próximas de código aberto
- LLaDA-Image é lançado — novo modelo que combina um Diffusion Transformer de 6B com módulo congelado de compreensão visual e linguística, baseado em LLaDA2.0-Mini. Obteve pontuações SOTA de 53,53 em inglês e 53,38 em chinês no Qwen-Image-Bench. A versão rápida LLaDA-Image-Turbo, que gera em dois a quatro passos, também foi lançada, com pesos, código de treinamento e receitas todos abertos.
!stable_diffusion, 2026-09-04.
https://lemmy.dbzer0.com/post/74988021 (artigo: arxiv.org/abs/2609.03796, código: github.com/inclusionAI/LLaDA-Image) - Boogu-Image-0.1 é lançado — família de modelos abertos com variantes Base, Turbo e Edit; licença Apache-2.0 permite uso comercial. Com 10B de parâmetros, atingiu a maior pontuação entre os modelos open source no Qwen-Image-Bench, 53,58.
!stable_diffusion, 2026-06-17.
https://boogu.org/ (artigo: arxiv.org/abs/2607.13125) - ComfyUI-Ref2VA-VSA: nó de aceleração de inferência para MiniMax H3 — melhora muito a velocidade de inferência em geração de vídeo,
!stable_diffusion, 2026-09-08.
https://github.com/Kablex/ComfyUI-Ref2VA-VSA - ComfyUI-AetherScale: ampliador de vídeo nativo para GPUs NVIDIA —
!stable_diffusion, 2026-09-05.
https://github.com/vizart-vj/ComfyUI-AetherScale - ComfyUI-VDN-H3: atenção híbrida Video Delta Net — nó de eficiência para modelos de geração de vídeo,
!stable_diffusion, 2026-09-05.
https://github.com/Saganaki22/ComfyUI-VDN-H3 - ComfyUI-Majoor-OmniCam: ferramenta de layout e animação de câmera — nó para controlar trabalho de câmera em geração de vídeo e imagem,
!stable_diffusion, 2026-09-04.
https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam - FastH3-Ref2V-Stream-Controller — ferramenta de controle de streaming para geração de vídeo baseada em MiniMax H3,
!stable_diffusion, 2026-09-04.
https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller - ComfyUI-InpaintCanvas: interface de inpainting ao estilo Krita —
!stable_diffusion, 2026-09-08.
https://github.com/DenRakEiw/ComfyUI-InpaintCanvas - ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — três nós de aceleração e redução de peso para a linha MiniMax H3 foram publicados em rápida sucessão entre 2026-09-01 e 02. É evidência de um ecossistema open source de vídeo generativo extremamente ativo.
https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE - InterleaveThinker: pesquisa de aprendizado por reforço para geração intercalada por agentes — acrescenta a modelos de geração de imagem existentes a capacidade de produzir iterativamente texto e imagem com múltiplos agentes,
!stable_diffusion, 2026-06-12.
https://arxiv.org/abs/2606.13679 - Sequência de trabalhos feitos com Flux/Krea2 turbo —
!stable_diffusion_arte!share_anime_artrecebem diariamente vários trabalhos de arte e anime gerados com Flux e Krea2. Não é uma notícia isolada, mas um sinal contínuo de que modelos de pesos abertos são usados no dia a dia.
https://lemmy.dbzer0.com/post/75150630 e muitos outros
Sinais
- 🔥 O maior assunto foi a aparente deriva da Midjourney. A alegação de que uma empresa de geração de imagens entraria no mercado de ultrassom médico teve repercussão em
!techtakese!technology, predominantemente em tom de “isso parece muito errado”. Entre as notícias do lado fechado, foi a de maior pontuação, entre 40 e 73. - 🛠️ No lado open source, cinco ou seis nós ComfyUI para modelos de vídeo MiniMax H3 foram lançados em sequência na mesma semana. É um padrão típico de comunidade de desenvolvedores se concentrando rapidamente em um modelo-base e competindo por otimizações. Há diversos nomes de desenvolvedores do universo chinês, como nazgut e lisitskyaa, sugerindo alcance global.
- 📊 A comunidade de benchmarks está usando o Qwen-Image-Bench como referência comum. LLaDA-Image, com 53,53, e Boogu-Image-0.1, com 53,58, competem no mesmo benchmark, tornando a disputa de desempenho entre projetos abertos visível em números.
- 😤 Até comunidades críticas à IA, como
!fuck_ai, recebem artigos sobre riscos geopolíticos de empresas fechadas, sinal de que o assunto ultrapassou comunidades técnicas. - 🤖 Como o Lemmy tem uma base pequena, seu padrão de viralização é completamente diferente do Reddit e do X: uma pontuação na faixa de 70 já representa grande notícia. É preciso avaliar o engajamento de forma relativa, não pelos números absolutos.
Limitações
- O Lemmy é federado e as buscas variam por instância. A API de
lemmy.worldreuniu principalmente posts da própria instância ou de instâncias federadas. Embora tenham sido tentadoslemm.eeelemmy.ml, a coleta foi limitada alemmy.worldpor tempo; não houve cobertura de todas as instâncias. - As buscas por "Kling AI", "Stability AI", "Wan 2.2" e "Runway Gen" devolveram zero resultados ou material irrelevante, como notícias políticas. No Lemmy, praticamente não há discussão separada de Kling, Wan ou Stability AI; vídeo generativo apareceu quase apenas pelo nome MiniMax H3 na comunidade de desenvolvimento ComfyUI.
!ai_reddité um bot que republica automaticamente r/ArtificialIntelligence; portanto, seu conteúdo é essencialmente notícia oriunda do Reddit, e não informação primária original do Lemmy.- O critério de cerca de 20 posts analisados foi atingido, além de muitos resultados duplicados ou irrelevantes examinados, mas o universo de publicações do Lemmy é muito menor que o de Reddit e X. Em termos de informação primária de alta qualidade, a plataforma é menos densa.
Pinterest — Notícias de IA para geração de imagens e vídeos
Foram verificadas visualmente 30 das 50 imagens coletadas previamente (output/pinterest.pins.md / images/pinterest/manifest.json), sem separação por gênero e com a consulta única "Image and Video Generation AI News". As observações abaixo se baseiam nesse material.
Temas visuais
- Miniaturas de “notícias de IA” em estilo clickbait: homem barbado com expressão surpresa e logotipos de ferramentas em neon ([11]), rosto semelhante ao de Sam Altman sorrindo diante de explosão ([19]) e apresentador metade robô com microfone “B” ([44]) são comuns. A maioria é fixada de vídeos do YouTube, não de artigos propriamente ditos.
- Infográficos de ranking “melhores ferramentas” de produtos fechados: listas em molduras neon de Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora e Google Veo aparecem repetidamente [9, 27, 33]. Há versão semelhante para imagens com ChatGPT, Nano Banana, Ideogram, GenTube e Z-Image [36].
- Representações de IA como persona de robô ou apresentador: robô branco em uma bancada de notícias ([32]), vídeos sintéticos com aparência de âncora feminina ([38, 49]) e cenas médicas com robôs ao lado de enfermeiras ou pessoas ([50]) aparecem mais que capturas de tela das próprias ferramentas. A metáfora é IA assumindo papéis humanos, como jornalista e profissional médico.
- Imagens que exploram ansiedade sobre deepfakes e autenticidade: foto de gato com selo “FAKE” e número de curtidas ([3]), quiz “Which is AI?” comparando duas paisagens ([10]) e detector com forma de onda de áudio dizendo “97% likely AI generated” ([25, uma das imagens internas, e 35]). A detecção e a suspeita são tão presentes quanto a criação.
- Visuais genéricos e impessoais de IA, em estilo banco de imagens: imagens em neon roxo-azul, silhuetas de cérebro, circuitos e efeitos de partículas, apenas com texto de manchete ([2, 4, 5, 15, 20, 30]). São preenchimento visual “com cara de IA”, sem produto ou captura de tela específicos.
- Grades de demonstração antes/depois de image-to-video: uma foto ou vídeo de origem transformado em vários estilos — LEGO, origami, pessoa coberta de flores, carro de brinquedo — em grade comparativa ([7]), além de diagramas que transformam uma foto em linha do tempo de cinco quadros ([1, 6]). São publicações que tornam visível a função “uma imagem → vídeo”.
- Há nomes de produtos reais, mas quase todos fechados: Veo 2/3 ([13, 24]), VASA-1 da Microsoft Research ([41]), Grok ([32]), Sora, ChatGPT e Nano Banana ([36]) aparecem bastante. Nenhum nome de modelo ou repositório comprovadamente open source surgiu nas 30 imagens analisadas.
- Infográficos que defendem uma “pipeline de IA”: um fluxo de quatro agentes — “Scout→Script→Generate→Animate” — cria automaticamente um vlog a partir de um link de vídeo viral ([47]). Mostra o deslocamento de ferramentas isoladas de geração de vídeo para fluxos automatizados.
Pins de destaque
- [1] Image to Video AI: How It Works and Why It Matters — diagrama mais concreto tecnicamente: uma imagem estática percorre controles deslizantes de intensidade de movimento, consistência temporal e controle visual até gerar uma linha do tempo de vídeo.
- [7] (sem título, grade de conversão LEGO/origami/flores) — grade antes/depois 3×5 que transforma vídeos de pessoas, um panda de pelúcia e um Tesla em blocos de madeira, origami, LEGO e flores. É uma das poucas demonstrações em que se veem resultados reais de geração.
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — dez ferramentas gratuitas de vídeo de IA: Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva e Hyperwrite. Oferece uma visão geral do estado dos planos gratuitos de produtos fechados.
- [24] (sem título, image-to-video de personagem monstro roxo) — demonstração de três vídeos de saída que colocam uma única imagem de entrada em cenários completamente distintos, como sala de servidores, ruínas submersas e cidade de doces. O título está relacionado ao Veo 3.
- [27] 5+ Best AI Video Generation Websites — compara Runway, Pika, Kling AI, Luma e Canva/Hailuo, especificando ao final usos para YouTube Shorts, TikTok, pins de vídeo do Pinterest e vídeos de produtos. Isso mostra que o próprio Pinterest é considerado canal de distribuição para vídeos de IA.
- [36] Top AI Image Generation Tools — lista ChatGPT, Nano Banana, GenTube, Ideogram e Z-Image como ferramentas de geração de imagens em 2026. Nomes mais recentes, como Nano Banana e Z-Image, já chegaram a conteúdos de SEO no Pinterest.
- [39] The Latest AI Developments (três notícias em estilo breaking news) — único pin com notícias concretas e organizações identificáveis: IA fazendo o primeiro atendimento de chamadas 911 em Nova Orleans; Meta lançando gratuitamente o modelo offline de agentes Muse Glimmer; e o grupo norte-coreano Kimsuky automatizando documentos de phishing com sua própria pilha de IA.
- [41] Microsoft Unveils VASA-1 — demonstração técnica da Microsoft Research para gerar animação facial conversacional em tempo real de múltiplas pessoas a partir de uma imagem e clipe de áudio, com sinal opcional de controle de expressão. É uma das poucas imagens oriundas de pesquisa.
- [16] AI Image Video: Best Quality vs Best Free — guia de decisão que contrapõe ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber e Synthesia a Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape e CapCut. Inclui critérios como legibilidade de texto, disponibilidade de GPU e necessidade de edição SVG.
- [47] AI video creation just got crazy — propõe uma pipeline automatizada de quatro agentes: “Scout→Script→Generate→Animate”, capaz de transformar um link viral em vlog concluído. Vai além de uma ferramenta isolada.
Sinais
- No Pinterest, o espaço de “Image and Video Generation AI” é dominado por infográficos de comparação de ferramentas e tutoriais voltados a SEO ou afiliados, não por notícias urgentes. Quase não há links diretos para fontes primárias, como anúncios oficiais, artigos científicos ou posts de redes sociais; a maior parte direciona a blogs ou vídeos do YouTube.
- Entre os itens coletados, há pouca informação primária que possa realmente ser chamada de notícia recente: os três casos do item [39], além de anúncios de Veo 2/3, VASA-1 e Grok. Não há cerca de 20 itens de informação primária recente.
- A presença de código fechado é esmagadora: Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT, Nano Banana e Ideogram aparecem repetidamente. Já nomes de modelos ou projetos open source não aparecem nos materiais examinados: não há menção a Stable Diffusion, ComfyUI, Open-Sora ou equivalentes. Pinterest é uma fonte fraca para descrever tendências abertas.
- Imagens sobre IA assumindo papéis humanos — apresentador de notícias, enfermeira e operador de 911 — e sobre desconfiar da autenticidade de conteúdos — selo FAKE, perguntas “Which is AI?” e detectores — formam um par recorrente. Uma parcela significativa das imagens enfatiza impacto social e insegurança sobre confiabilidade, não a tecnologia de geração.
- Entre os usos de vídeo generativo, são particularmente visíveis animar uma foto e converter o estilo de um vídeo existente — para LEGO, origami etc. —, mais do que gerar vídeo texto-para-vídeo do zero.
Limitações
- Os 50 itens coletados previamente não foram classificados por gênero — o campo
genreestá vazio em todos — e resultam de uma única consulta. Não houve busca deliberadamente separada por código fechado e aberto. - Por limitação de tempo, apenas 30 das 50 imagens foram abertas e verificadas. Não foram verificadas, entre outras, as de índices 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45 e 48. Seus títulos indicam comparação de ferramentas de lip sync, edição de vídeo e detecção de conteúdo de IA, temas que se sobrepõem aos já observados e não sugerem tendência distinta capaz de alterar as conclusões.
- O Pinterest não foi navegado diretamente; a análise usa apenas as imagens e títulos pré-coletados, conforme o playbook. Datas de publicação e números de engajamento — curtidas e salvamentos — não constam no manifesto ou na tabela de pins, portanto não é possível saber atualidade nem alcance.
- Como não houve menções relevantes a open source no Pinterest, a plataforma não deve ser usada como fundamento para descrever a evolução aberta no relatório integrado posterior.
Ações recomendadas
- Manter a geração visual por agentes GPT-6 Astra — operação do Blender e criação de cidades 3D — como tema específico de acompanhamento nas próximas edições.
- Para não perder anúncios open source, adicionar nas próximas buscas transversais os termos "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" e "ComfyUI".
- Ampliar previamente a lista de contas observadas no Bluesky, assumindo que o 403 da API de busca continuará.
- Como o Pinterest não fornece data de publicação nem métricas de engajamento, não usá-lo em comparações de notícias urgentes que dependem de atualidade; limitar seu uso ao acompanhamento recorrente de reconhecimento de ferramentas.
- Como a controvérsia da mudança da Midjourney para equipamentos médicos ainda não tem autenticidade ou situação confirmadas, evitar citações categóricas até que surja uma fonte primária, como anúncio oficial da Midjourney.
- Priorizar o
!stable_diffusiondo Lemmy e os canais analíticos do YouTube como fontes centrais para acompanhar tendências open source.
Imagens coletadas


















































Nota sobre a qualidade dos dados
No Bluesky, a API de busca retornou 403 continuamente e não foi possível atingir o critério de 20 itens. No Pinterest, datas de publicação e métricas de engajamento não puderam ser obtidas, inviabilizando a avaliação de atualidade. Reddit e X utilizaram uma única consulta, sem comparação deliberada entre código fechado e aberto; por isso, os assuntos de código aberto ficaram concentrados no Lemmy e no YouTube.



