Notícias de IA para geração de imagens e vídeos — 2026-09-09
O cenário fechado é dominado por Google Nano Banana Pro e OpenAI GPT Image 2, enquanto a Sora caminha para o fim; no código aberto, Qwen-Image/FLUX/Wan/HunyuanImage já se aproximam da qualidade dos modelos fechados
Resumo de notícias sobre IA para geração de imagens e vídeos — 2026-09-09
Bora, juntei tudo aqui 🔥 Em resumo: no lado fechado, o Nano Banana Pro do Google (Gemini 3 Pro Image) e o GPT Image 2 da OpenAI são os dois grandes rivais, enquanto o app independente da Sora já parece estar chegando ao fim. Em vídeo, Kling, Seedance e Veo — com a disputa entre empresas chinesas e o Google — são o principal campo de batalha 😤 Já no lado open source, Qwen-Image, Z-Image, FLUX, Wan e HunyuanImage chegaram ao nível de fazer pensar: “dá para fazer tudo isso de graça!?”; e as comunidades de ComfyUI e execução local continuam super ativas 💪 Só o X foi um fracasso completo nesta rodada, então vale registrar isso com transparência.
Entre plataformas
Insights sobre código fechado (10) 🏢
- O Nano Banana Pro (Gemini 3 Pro Image) tem a reputação de “dominar completamente os demais modelos” em geração de imagens e monopolizou as conversas no YouTube → https://www.youtube.com/watch?v=UV9GqinedQ8
- Chegou o GPT Image 2 da OpenAI. Tem mais de 99% de precisão de texto em mais de 12 idiomas, gera até oito imagens por prompt no modo Thinking e avança para suporte a 4K → https://www.youtube.com/watch?v=blOlUnC75O4
- Em 17 de agosto de 2026, o Google encerrou totalmente o Imagen e unificou sua oferta na linha Nano Banana. A geração de imagens fechada está se concentrando no Google.
- A OpenAI encerrou o app Sora em 26 de abril, e a API da Sora também deve ser descontinuada em 24 de setembro. Na prática, a marca Sora parece estar chegando ao fim → https://lemmy.world/post/44721138
- O usuário dahara1, no Bluesky, também relatou que a versão gratuita da Sora deixou de funcionar após o fim dos créditos → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
- O Grok Imagine Image 2.0 da xAI, lançado em 7 de agosto, ficou em segundo lugar por pouca diferença em relação ao GPT Image 2 no Arena, formando uma disputa a três.
- O Seedance 2.5, da ByteDance, abriu sua API ao público em 7 de agosto e se tornou uma das opções principais ao lado de Veo 3.1 e Kling 3.0.
- Usuários do Reddit compararam Seedance 2.5 e o Wan 3.0 aberto usando o mesmo prompt, com opiniões fortemente divididas → https://www.reddit.com/r/generativeAI/comments/1w60fip/
- A Midjourney surpreendeu ao mudar da geração de imagens para o negócio de scanners médicos por ultrassom, gerando controvérsia e comparações irônicas com a Theranos → Lemmy (via theregister.com)
- ByteDance e Hollywood (MPA) chegaram a um acordo global sobre proteção de direitos autorais em IA, sinalizando uma intensificação das medidas de copyright → pesquisa no Pinterest
- No Reddit, técnicas para falsificar “timelapses genuínos de desenho à mão” usando IA causaram enorme repercussão, com 7.088 pontos e pedidos de obrigatoriedade na rotulagem de IA → https://www.reddit.com/r/antiai/comments/1w81kdd/
- Só no Bluesky, entre dezembro de 2025 e fevereiro de 2026, surgiram em sequência novos modelos de Kling, Runway, PixVerse, Vidu, Seedance e Niji; o ritmo dos modelos chineses é evidente.
Insights sobre código aberto (10) 🛠️
- Qwen-Image 2512 (Alibaba, licença tipo Apache) e Z-Image Turbo são as duas grandes tendências, com uma enxurrada de vídeos comparativos → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- O Flux 2.0 está sendo colocado à prova contra Qwen-Image 2512 e Z-Image em 15 testes de estresse → https://www.youtube.com/watch?v=54zvSiAWz2Y
- O LTX-2.3 da Lightricks, com 22 bilhões de parâmetros, sincronização de áudio e 4K/50 fps, é apontado como tendo qualidade de modelo fechado → https://www.youtube.com/watch?v=qQXzlk134Sw
- Há vídeos práticos defendendo que o Wan 2.5 da Alibaba superou o Veo 3 fechado → https://www.youtube.com/watch?v=yvD8TxNsR4Q
- Surgiu o agente gratuito “WanGP”, que reúne múltiplos modelos OSS — LTX-2.3, Qwen, Flux.2 Klein e Z-Image — e mostra o avanço de fluxos de trabalho integrados → https://www.youtube.com/watch?v=h-k6xOEITx4
- O HunyuanImage 3.0 da Tencent, um MoE com mais de 80B de parâmetros, continua sendo uma referência entre os grandes modelos abertos de imagem.
- O FLUX 3, da Black Forest Labs, oferece imagens e vídeos de 20 segundos com áudio em lançamento limitado → https://bfl.ai/blog/flux-3
- Há variantes leves como FLUX.2-klein-9b-kv-fp8 e o início do FLUX Creator Program, que conta até com Martin Scorsese como conselheiro.
- Mesmo com cerca de 5.000 membros, comunidades de Stable Diffusion no Lemmy continuam recebendo diariamente trabalhos em ComfyUI, SDXL e Krea2, demonstrando grande profundidade de uso real.
- Simon Willison relatou no Bluesky ter executado localmente o Qwen 3.7 27B em um MacBook M5 e obtido, com um GGUF de 17 GB, sua melhor imagem de um pelicano até então; isso vem alimentando uma cultura de benchmarks locais → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
- O modelo-base aberto de vídeo SkyReels V1, baseado em HunyuanVideo, e o fluxo OSS integrado gratuito “Open Creative Studio” também seguem recebendo atualizações graduais → https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Ponto que mais se destacou entre plataformas: a oposição entre fechado e aberto reaparece no Reddit, YouTube e Lemmy como “fechado, prático, mas caro e censurado” versus “aberto, livre, mas trabalhoso”. Também há ceticismo compartilhado por várias comunidades em relação a ferramentas que prometem ser “gratuitas e ilimitadas” 🙅♂️. O Pinterest foi uma exceção interessante: essa divisão quase não aparece ali, onde predominam apresentações de ferramentas e miniaturas de notícias.
Plataforma por plataforma
Reddit: foram coletadas 12 threads. Uma thread anti-IA, com 7.088 pontos, viralizou a ponto de chamar mais atenção do que todos os tópicos técnicos juntos, mostrando como a rejeição ao mau uso da IA tende a ser mais visível. Subreddits centrais, como r/StableDiffusion, não apareceram nesta rodada, deixando uma lacuna na cobertura.
X: honestamente, foi um zero à esquerda 😅 Os termos de busca usados pelo worker, como “Harvey” e “$LAPTOP”, não tinham relação com o tema; assim, nenhum dos 40 posts coletados tratava de IA para geração de imagens ou vídeos. Essa é a única lacuna real entre as seis plataformas indicadas no briefing.
YouTube: há bastante conteúdo de análise e comparação. No lado fechado, a disputa entre Google, OpenAI e xAI aparece com força; no aberto, foi possível cobrir Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage e até fluxos integrados com WanGP. Porém, visualizações e número de inscritos não puderam ser obtidos por dependerem de JavaScript, então não foi possível comparar relevância recente por métricas numéricas.
Bluesky: a API de busca (searchPosts) retornou 403 para todas as consultas. A análise precisou migrar para leitura de feeds de contas, o que deu boa cobertura do vídeo fechado, principalmente via luok.ai, mas pouca visibilidade para vídeo aberto. Só SkyReels V1 apareceu com clareza.
Lemmy: notícias fechadas se concentraram na polêmica mudança da Midjourney para a área médica e nas ironias sobre o fim da Sora. No código aberto, a Black Forest Labs e a linha FLUX foram o destaque dominante, com movimentos concretos a cada trimestre.
Pinterest: as 50 imagens foram verificadas. Predominaram miniaturas de notícias com rostos de robôs e néon, além de infográficos com listas de ferramentas. Nenhuma das 50 imagens representava a cultura aberta e auto-hospedada de Stable Diffusion/ComfyUI. Métricas de engajamento também ficaram indisponíveis.
O que acompanhar
- Descontinuação da API Sora da OpenAI, prevista para 24 de setembro de 2026 — Lemmy https://lemmy.world/post/44721138
- Evolução do ranking do Arena entre Grok Imagine Image 2.0 e GPT Image 2 — YouTube, comparativos do tipo Marin Method
- A disputa open source entre Qwen-Image, Z-Image e FLUX e qual deles se tornará padrão — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Se o negócio de scanners médicos por ultrassom da Midjourney realmente se viabiliza — Lemmy, via theregister.com
- Regras práticas decorrentes do acordo de copyright entre ByteDance e Hollywood — pesquisa no Pinterest [24]
- Até onde agentes integradores OSS, como WanGP, conseguirão se disseminar — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4
Recomendações
- A coleta adicional para o X deve ser refeita com termos diretamente ligados ao tema, como “Midjourney”, “Stable Diffusion”, “Sora”, “Nano Banana” e “Qwen-Image”.
- Pesquisas no Reddit devem incluir obrigatoriamente, nas próximas rodadas, subreddits grandes e centrais como r/StableDiffusion, r/midjourney e r/comfyui.
- Como alternativa à API de busca do Bluesky, as contas principais encontradas nesta rodada — luok.ai, simonwillison.net e outras — devem virar uma lista de acompanhamento contínuo.
- Para evidenciar a divisão entre fechado e aberto, comentários no Reddit e no Lemmy devem receber prioridade sobre o Pinterest, onde as opiniões são menos densas.
- O fim da API Sora em 24/9 e novos desdobramentos da mudança de rumo da Midjourney devem ser itens prioritários na próxima pesquisa.
Qualidade dos dados
No X, a incompatibilidade dos termos de busca impediu a coleta de qualquer post relacionado a IA de geração de imagens ou vídeos, deixando a plataforma efetivamente sem dados. Bluesky e Pinterest não forneceram suas APIs de busca ou métricas de engajamento — como visualizações e curtidas —, impossibilitando confirmar quantitativamente a disseminação dos temas. No YouTube, o corpo dos vídeos e as visualizações também não puderam ser acessados devido à dependência de JavaScript, e a análise dependeu de snippets de busca. Nas demais plataformas, Reddit e Lemmy, o material foi em geral suficiente em quantidade e qualidade.
Resumo por plataforma
Reddit — Notícias de IA para geração de imagens e vídeos
Onde
As 12 threads coletadas estão distribuídas por oito subreddits.
| Subreddit | Número de membros | Número de threads coletadas |
|---|---|---|
| r/generativeAI | 151,605 | 4 |
| r/antiai | 319,039 | 1 |
| r/RemoteWorkers | 75,979 | 1 |
| r/Seedance_AI | 20,508 | 1 |
| r/freetoolsAI | 7,942 | 1 |
| r/aivideomaking | 6,614 | 2 |
| r/AItips101 | 1,153 | 1 |
| r/Unrouted_AI | 517 | 1 |
O r/generativeAI, voltado à IA generativa em geral, teve o maior número de threads: quatro. Já a thread com folga maior em pontuação e comentários foi a única do r/antiai, crítico à geração de imagens por IA, com engajamento muito superior ao das demais threads somadas.
O que as pessoas dizem
- Plataformas integradas, sem censura e focadas em liberdade estão ganhando espaço: a thread 1 (r/AItips101, 81 pontos, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) apresentou o “WildOwl.ai”, um serviço de cobrança por uso, sem assinatura, que oferece acesso a mais de 35 modelos, incluindo Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image. Nos comentários, u/reliablemicrophone84 avaliou que “WildOwl really does solve that exact problem you mentioned about not having to choose between cutting-edge models and creative freedom”, enquanto u/Clear-Assistance449 recomendou o plano ilimitado do Mage.space como contraponto.
- Forte ceticismo sobre promessas de “grátis e ilimitado”: nas threads 2 (r/aivideomaking, 2 pontos, 22 comentários, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) e 5 (r/generativeAI, 1 ponto, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/), predominou a visão de que nada é realmente gratuito e ilimitado. u/ai_art_is_art (thread 5, 3 pontos) resumiu de forma contundente: “Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations.”
- Pedido de vídeo de 45 segundos recebeu risadas: na thread 4 (r/aivideomaking, 13 pontos, 22 comentários, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/), alguém queria criar gratuitamente um vídeo de IA de 45 segundos usando apenas celular e iPad. u/NewLifeWares (2 pontos) apontou a barreira técnica: “45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator...with a watermark”.
- Falsificação de “desenhos genuínos à mão” por IA gerou enorme reação negativa: a thread 3 (r/antiai, 7.088 pontos, 1.023 comentários, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) descreveu como LLMs de nível GPT-6 podem controlar mouse e teclado para falsificar um “timelapse real” em software de pintura. Foi, de longe, a thread com maior pontuação da coleta. u/Nayutantantan (2.512 pontos) lamentou que “the trends of creating fake timelapses are getting common”, e u/Soggy_Supermarket100 (171 pontos) exigiu rotulagem imediata: “EVERY SINGLE online space NEEDS AI filtering”.
- Deepfakes de celebridades reais convergem para o argumento de “responsabilidade do usuário”: na thread 6 (r/Seedance_AI, 0 pontos, 22 comentários, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/), u/Jean_velvet (7 pontos) explicou: “Recent court cases put it in the responsibility of the user...It's the distribution and sharing that's the potential crime”. Em contraste, u/Alchemist42 (1 ponto) sugeriu o uso de outra ferramenta, afirmando: “They don't use Seedance”.
- Confronto entre modelos fechados e abertos: a thread 10 (r/generativeAI, 110 pontos, 31 comentários, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) comparou Seedance 2.5, fechado e ligado à ByteDance, com Wan 3.0, de pesos abertos e ligado à Alibaba, usando o mesmo prompt. u/SpecialistDragonfly9 (5 pontos) considerou que “it looks like seedance is the by FAR superior one”, mas u/Positive-Key6640 (5 pontos) questionou a própria metodologia: “Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better”.
- Novo modelo de imagem da OpenAI repercutiu discretamente: a thread 7 (r/Unrouted_AI, 2 pontos, 6 comentários, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) compartilhou o link para o post oficial da OpenAI “introducing-chatgpt-images-2-5”. u/Ok_Homework_1859 destacou o recurso de esboço: “I'm really interested in the the Sketch feature, which lets you draw in ChatGPT to guide your image”.
- Insatisfação com restrições para gerar personagens protegidos por copyright: na thread 11 (r/generativeAI, 2 pontos, 2 comentários, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/), houve reclamações sobre não conseguir criar nem fanart de uso pessoal de personagens Disney no Grok. u/frighten sugeriu: “PixelForge might work for you on iOS, it has no restrictions built in”.
- Nostalgia e correções sobre os dez anos de geração de imagens por IA: a thread 9 (r/generativeAI, 15 pontos, 9 comentários, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) reuniu a evolução do StackGAN, em 2016, até imagens geradas por ChatGPT em 2026. u/noctalla apontou uma omissão histórica: “Google DeepDream was an AI image generator that predated these...around 2015”.
- Novos “bicos com IA” surgem ao redor da geração de imagens: a thread 8 (r/RemoteWorkers, 169 pontos, 787 comentários, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) divulgou um trabalho remoto de US$ 30/hora para revisar legendas geradas por IA. Apesar do alto número de comentários, os principais eram quase todos repetidas solicitações pelo link de candidatura, “Images”, sem discussão substancial.
- Dúvidas sobre a sustentabilidade de ferramentas gratuitas: na thread 12 (r/freetoolsAI, 40 pontos, 50 comentários, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/), foi apresentado o aifreeforever.com, que promete uso gratuito, ilimitado e sem cadastro. u/thecragmire perguntou: “How do you maintain this? It's got to cost you something, right?”, enquanto u/Relevant_Syllabub895 reclamou da rigidez das regras para NSFW.
Sinais
- Em alta: agregadores que oferecem “vários modelos integrados e sem censura”, como WildOwl.ai, Venice, Mage.space e PixelForge, foram citados em múltiplas threads como alternativa a assinaturas individuais. Serviços que vendem “escolha livre de modelos + filtros menos rígidos” estão se destacando mais que modelos isolados.
- Afirmação rejeitada: serviços de geração de imagem e vídeo que prometem “grátis e ilimitado” recebem ceticismo ou rejeição quase unânime em r/aivideomaking, r/generativeAI e r/freetoolsAI. O consenso é que custos de hardware ou cobrança acabarão existindo de algum modo.
- Conflito de opiniões: na comparação Seedance versus Wan da thread 10, houve desacordo sobre qual modelo é melhor e também sobre se comparações com o mesmo prompt são suficientes. Na thread 6, também há diferença entre quem atribui a responsabilidade ao usuário e quem defende que a plataforma deve intervir.
- Surpresa: entre as 12 threads coletadas, a thread anti-IA (thread 3, 7.088 pontos / 1.023 comentários) teve engajamento em uma ordem de grandeza muito superior aos tópicos técnicos, como comparações de modelos e lançamento de ferramentas. Ela quase iguala a soma de pontos de todas as demais threads, cerca de 7.600, sugerindo que no Reddit a reação ao abuso e ao engano com IA é mais facilmente visível do que o entusiasmo técnico.
- Configuração aberto/fechado: a oposição explícita entre open source e código fechado se concentrou na comparação Wan, de pesos abertos, versus Seedance, fechado, e no contraste entre geração local com ComfyUI/Civitai/Hugging Face e serviços de nuvem pagos. A avaliação recorrente é que soluções abertas são “livres, mas trabalhosas”, enquanto as fechadas são “práticas, mas limitadas por censura e custo”.
Limites
- Foram coletadas somente 12 threads, abaixo da meta aproximada de 20 solicitada por brief.md. Foi usada apenas a consulta “Image and Video Generation AI News”, sem buscas adicionais direcionadas especificamente a soluções fechadas ou abertas.
- Subreddits grandes e centrais de geração de imagens e vídeos, como r/StableDiffusion, r/midjourney, r/aivideo e r/comfyui, não aparecem na coleta. Essa é uma lacuna de cobertura e impede que os resultados sejam tratados como representativos de todo o Reddit.
- Na thread 8, de r/RemoteWorkers, os comentários principais eram essencialmente spam de candidatura com a palavra “Images”, deixando quase nenhum conteúdo útil de discussão.
- Este agente não pôde acessar diretamente o Reddit nem suas páginas de resultado de busca, devido à recusa do WebFetch. Portanto, a análise se limita ao material previamente coletado pelo worker em
output/reddit.threads.mde.json; não foi possível verificar outras threads ou comentários.
X
X — Notícias de IA para geração de imagens e vídeos
Observação inicial: a coleta não corresponde ao tema
Após examinar output/x.posts.md, os termos efetivamente pesquisados pelo worker nesta etapa foram
“Harvey”, “#Crypto”, “#sweepstakes”, “#Chance”, “#giveaways”, “Serbia”,
“$LAPTOP”, “Arsenal”, “Germans” e “Nazis”. Nenhum deles se relaciona a IA para geração de imagens ou vídeos, e nenhum dos 40 posts coletados, de 39 contas, corresponde ao tema. A lista própria de tendências do Explore do X, associada à localização Croácia do servidor, também não apresentou nenhum item de IA.
| # | Tendência | Onde |
|---|---|---|
| 1 | Harvey | Em alta na Croácia |
| 2 | #Crypto | Negócios e finanças · Em alta |
| 3 | #sweepstakes | Em alta na Croácia |
| 4 | #Chance | Em alta na Croácia |
| 5 | #giveaways | Em alta na Croácia |
| 6 | Serbia | Política · Em alta |
| 7 | $LAPTOP | Em alta na Croácia |
| 8 | Arsenal | Esportes · Em alta |
| 9 | Germans | Política · Em alta |
| 10 | Nazis | Política · Em alta |
Seguindo a regra 7, que proíbe fabricar fontes, não apresentarei posts não relacionados como se fossem insights do tema. Abaixo estão apenas os fatos obtidos com o material coletado.
Contas
As 39 contas coletadas se agrupam em nichos desconexos: fãs de reality shows românticos, traders de criptomoedas, perfis de promoção de sorteios e brindes, discussões políticas dos Bálcãs, comunidades de memecoins, torcedores do Arsenal e debates sobre revisionismo histórico e antissemitismo. Nenhuma conta foi identificada como discutindo IA de geração de imagens ou vídeos, ou publicando conteúdo explicitamente marcado como produzido por essas ferramentas. Há posts assinalados como “has an image”, mas sem menção a IA generativa nem indicação de que a imagem foi gerada. As maiores métricas de engajamento ficaram com @saintjupitr, 64.747 curtidas em um único post, e @Kwin8675309, 42.021 curtidas em um único post; ambos são casos de posts políticos virais sem relação com o tema.
Posts
Nenhum. Dos 40 posts, zero tratavam de IA para geração de imagens ou vídeos, seja em soluções fechadas, seja abertas. Posts individuais, como os de número 21–24 sobre política sérvia, 29–32 sobre futebol do Arsenal e 33–40 sobre debates históricos envolvendo Alemanha e nazismo, tiveram números altos de engajamento, mas não são relacionados a IA visual e não entram como achados.
Sinais
- Não foi possível detectar sinais sobre crescimento, queda ou outras tendências do tema, porque não há dados pertinentes.
- O único fato que se pode afirmar é que os resultados do Explore estavam geolocalizados para a Croácia, a partir do servidor de conexão, e que as consultas usadas eram termos sem relação com o tema, como “Harvey” e “$LAPTOP”.
Limites
- Os termos de busca não correspondem ao tema: as entradas “Found by searching “…”” em
output/x.posts.mdregistram apenas termos alheios à geração de imagens e vídeos por IA: Harvey, #Crypto, #sweepstakes, #Chance, #giveaways, Serbia, $LAPTOP, Arsenal, Germans e Nazis. Isso indica um problema de configuração das consultas do worker. Como o playbook instrui que o material já havia sido coletado, não foram feitas novas buscas; será necessária uma nova coleta com termos como “AI image generation”, “Midjourney”, “Stable Diffusion”, “Sora”, “Veo” e “オープンソース 画像生成AI”. - Dos 40 posts coletados, zero oferecem insights sobre tendências fechadas ou abertas de IA para geração de imagens e vídeos. Assim, a meta do briefing de analisar cerca de 20 posts não pôde ser cumprida.
- O Explore do X, com tendências de 1 a 10, também continha apenas tendências gerais da Croácia, sem itens de IA.
- A sessão era válida e a coleta de posts funcionou, sem erros como “session expired”; o problema foi exclusivamente a escolha das consultas.
YouTube
YouTube — Tendências recentes de IA para imagens e vídeos, fechada e aberta
Canais
- AICodeKing — Focado em análises práticas de ferramentas de IA, incluindo uma análise de acesso antecipado ao Google Nano Banana Pro (Gemini 3 Pro Image). https://www.youtube.com/@AICodeKing
- Theo - t3.gg — Canal de explicações técnicas para desenvolvedores, com vídeo sobre Nano Banana Pro. https://www.youtube.com/@t3dotgg
- ElevenLabs (oficial) — Canal oficial da empresa de IA de voz, que também explica notícias de geração de imagem, como GPT Image 2. https://www.youtube.com/@Elevenlabs
- AIOnTrend — Especializado em comparativos de modelos abertos de geração de imagens, como Qwen-Image 2512. https://www.youtube.com/@aiontrend
- BMF MEDIA — Análises de modelos abertos de vídeo, como LTX-2.3. https://www.youtube.com/@BeerMoneyForum
- Marin Method — Comparativos diretos de modelos fechados de vídeo, incluindo Kling, Grok Imagine, Runway e Veo. https://www.youtube.com/@MarinMethod
- Jack Vs. AI — Canal de fluxos de trabalho práticos com ferramentas como Wan 2.5. https://www.youtube.com/@JackVsAI
- Youri van Hofwegen — Testes comparativos de modelos recentes de vídeo, como Seedance 2.0. https://www.youtube.com/@Yourivanhofwegen
- AI Late to Class — Explicações sobre fluxos locais de código aberto com ComfyUI e WanGP. https://www.youtube.com/@ailatetoclass
- AI大学【AI&ChatGPT最新情報】 — Canal japonês que explica comparativos de IA de imagem, incluindo GPT Image 2 versus Nano Banana. https://www.youtube.com/@AIAIChatGPT-cj4sh
- Referência: Matt Wolfe (@mreflow) é um grande canal de notícias de IA, com cerca de 965 mil inscritos e resumos semanais do setor. Não foi um resultado direto desta coleta, mas é um canal representativo da área.
Vídeos
-
“Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN”
Canal: Theo - t3.gg|Publicado por volta de 26 de novembro de 2025|https://www.youtube.com/watch?v=UV9GqinedQ8
→ Vídeo que defende que o Nano Banana Pro do Google, Gemini 3 Pro Image, supera com ampla vantagem os demais modelos de geração de imagens. É um marco da fronteira de modelos fechados. -
“Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...”
Canal: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
→ Análise de acesso antecipado ao Gemini 3 Pro Image, com muitos exemplos e avaliação de que é algo “impressionante”. -
“GPT Image 2 Is Here — Everything You NEED to Know”
Canal: ElevenLabs|Publicado em 23 de abril de 2026|https://www.youtube.com/watch?v=blOlUnC75O4
→ Explica o GPT Image 2 da OpenAI, também chamado ChatGPT Images 2.0. Apresenta mais de 99% de precisão de texto em mais de 12 idiomas, até oito imagens por prompt em modo Thinking e suporte a 4K em API/beta, como uma das maiores evoluções do ano em modelos de imagem. -
【Superando Nano Banana】O que é o novo modelo de geração de imagens da OpenAI, “GPT Image 2”?
Canal: AI大学【AI&ChatGPT最新情報】, em japonês|https://www.youtube.com/watch?v=ZrO7tv-uv1E
→ Explicação em japonês do GPT Image 2 em comparação com Nano Banana, cobrindo desempenho, uso e casos práticos. -
“Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison”
Canal: Marin Method|Publicado em 10 de março de 2026|https://www.youtube.com/watch?v=x5fMQvhKP60
→ Confronto direto entre quatro modelos fechados de vídeo. O vídeo considera Kling 3.0 o melhor no conjunto, e Grok Imagine especialmente forte em imagem-para-vídeo. -
“Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison”
Canal: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
→ Comparativo que afirma que o Seedance 2.0, da ByteDance, superou os principais modelos fechados existentes. -
“New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)”
Canal: AIOnTrend|Publicado no início de janeiro de 2026|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
→ Compara o modelo aberto Qwen-Image 2512, da Alibaba, com o popular Z-Image Turbo, destacando as vantagens de ser gratuito e ter licença do tipo Apache. -
“Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)”
https://www.youtube.com/watch?v=54zvSiAWz2Y
→ A linha Flux, da Black Forest Labs, é comparada com Qwen-Image 2512 e Z-Image em 15 testes de estresse, sugerindo mudanças no equilíbrio do ecossistema aberto de geração de imagens. -
“LTX-2.3 Review: The Open-Source AI Video Model Built for Creators”
Canal: BMF MEDIA|Publicado cerca de um mês antes da busca, em agosto de 2026|https://www.youtube.com/watch?v=qQXzlk134Sw
→ Análise do LTX-2.3, da Lightricks: modelo aberto de 22 bilhões de parâmetros, com sincronização de áudio e 4K/50 fps, avaliado pela ótica de criadores. É um conteúdo recente, publicado nos 60 dias anteriores. -
“WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)”
Canal: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
→ Fluxo prático que sustenta que o Wan 2.5 open source, da Alibaba Tongyi, supera o Google Veo 3 fechado. -
“This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image”
Canal: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
→ Apresenta o agente gratuito WanGP, que reúne LTX-2.3, Qwen, Flux.2 Klein e Z-Image para produção automatizada de vídeos. É evidência de uma integração crescente no ecossistema open source. -
“HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)”
https://www.youtube.com/watch?v=32lhiZKhgOY
→ Apresenta o HunyuanImage 3.0 da Tencent, modelo aberto de texto para imagem com mais de 80 bilhões de parâmetros, arquitetura MoE e 13 bilhões de parâmetros ativos. Defende que ele iguala ou supera Nano Banana. A estreia foi em setembro de 2025, mas o modelo continua sendo uma referência de grande porte no open source.
Sinais
Movimentos no lado fechado
- O Google encerrou completamente a linha Imagen em 17 de agosto de 2026 e a concentrou na família Nano Banana, incluindo Gemini 3 Pro Image. A oferta principal de geração de imagens fechada está se consolidando na linha Gemini.
- A OpenAI encerrou o app Sora em 26 de abril de 2026, e a própria API deve terminar em 24 de setembro de 2026. Como produto independente de vídeo, a marca Sora está efetivamente em fim de ciclo, com recursos da OpenAI migrando para GPT Image 2 e integração ao ChatGPT.
- O GPT Image 2, de abril de 2026, ocupa posição de liderança no Arena tanto em texto-para-imagem quanto em edição. O Grok Imagine Image 2.0, da xAI, lançado em 7 de agosto de 2026, ficou em segundo por margem estreita. A geração de imagens fechada se tornou uma disputa entre OpenAI, Google e xAI.
- O Seedance 2.5, da ByteDance, abriu sua API publicamente em 7 de agosto de 2026 e cresce rapidamente como opção principal, ao lado de Google Veo 3.1 e Kling 3.0.
- Em comparativos de vídeo fechado, uma divisão de papéis parece estar se formando: Kling 3.0 pelo conjunto, Veo 3.1 pela qualidade cinematográfica e Runway Gen-4.5 pela liberdade criativa.
Movimentos no lado aberto
- Na geração de imagens, Qwen-Image 2512, da Alibaba e de licença tipo Apache, e Z-Image Turbo, executável em oito passos com 16 GB de VRAM, são as duas maiores tendências. A abundância de vídeos comparativos indica alta atenção.
- O Flux.2 Klein, da Black Forest Labs, com 4B de parâmetros, 13 GB de VRAM em uma RTX 3090 e licença Apache 2.0, é citado frequentemente como alternativa aberta e leve.
- O HunyuanImage 3.0 da Tencent, com mais de 80B e arquitetura MoE, continua sendo uma referência para grandes modelos abertos de imagem.
- Em vídeo, Wan 2.2/2.5 da Alibaba Tongyi, com difusão MoE e até versão GGUF de 8 GB, e LTX-2.3 da Lightricks, com áudio sincronizado, 4K/50 fps e 22B de parâmetros, são avaliados por vários canais como modelos de qualidade comparável à de soluções fechadas.
- Vídeos sobre agentes e fluxos como ComfyUI e WanGP, que conectam vários modelos abertos, estão aumentando. O interesse está migrando da comparação de modelos isolados para fluxos de trabalho integrados.
- Em geral, análises e comparativos compartilham a percepção de que a diferença de qualidade entre aberto e fechado está diminuindo, e que muitas equipes de criação agora avaliam alternativas abertas primeiro.
Limites
- Neste ambiente, páginas de resultados e de vídeos do YouTube dependem de JavaScript. Por isso, o WebFetch não pôde acessar diretamente número de visualizações, datas de publicação ou inscritos dos canais. Nomes de canais foram obtidos via API oEmbed do YouTube, mas esse método também não fornece visualizações nem inscritos.
- Por isso, números de visualização e inscritos foram tratados como desconhecidos. Foram usadas apenas datas e contexto presentes em snippets de busca, e não foi possível fazer uma comparação numérica de recência.
- Como o conteúdo dos vídeos e os comentários principais também não puderam ser lidos diretamente, a análise se baseia indiretamente em títulos, snippets de busca e resumos de artigos relacionados. Não são citações literais dos vídeos.
- O vídeo sobre HunyuanImage 3.0 é de setembro de 2025, fora da janela recomendada de 60 dias, e foi mantido apenas como referência contínua de grandes modelos abertos de imagem.
- Houve apenas um resultado em canal japonês, AI大学, portanto não foi possível confirmar a profundidade do debate em japonês em comparação com o ambiente anglófono.
Bluesky
Bluesky — Tendências recentes de IA para geração de imagens e vídeos
Contas
- Simon Willison @simonwillison.net — Desenvolvedor conhecido de IA. Sempre que surgem novos modelos, publica imagens de benchmark de “um pelicano andando de bicicleta” para comparar capacidades visuais. Possui muitos seguidores e diversos posts com mais de 100 a 500 curtidas.
- Ethan Mollick @emollick.bsky.social — Professor da Wharton School, da Universidade da Pensilvânia. Publica frequentemente experimentos em que modelos como GPT-6 Astra e Fable 5.1 geram conteúdo 3D no Blender.
- Alessandro Perilli @perilli.com — Desenvolvedor do “Open Creative Studio”, antes chamado AP Workflow: um fluxo aberto e integrado para ComfyUI que gera texto, imagens, vídeo e áudio. Continua anunciando atualizações.
- luokai @luok.ai — Conta que apresenta em sequência atualizações de IA fechada para vídeo, como Kling, Runway, Vidu, PixVerse, Seedance e Niji.
- dahara1 @dahara1.bsky.social — Engenheiro que publica em japonês suas impressões sobre LLMs e IA generativa, além de criar ferramentas como tradutores automáticos. Acompanha temas atuais, incluindo fim da Sora e comparativos de Nano Banana. É uma conta pequena, com 113 seguidores.
- Midjourney Experience Newsletter @midjourneynews.bsky.social — Conta não oficial de fãs/newsletter, e não da Midjourney. Publica experimentos de prompts e fragmentos de notícias, com baixo engajamento.
- Stable Diffusion online AI @stablediffusion.bsky.social — Feed de compartilhamento de trabalhos de SD/Midjourney. Os posts mais recentes pararam em janeiro e fevereiro de 2025, portanto não serve como fonte de notícias atuais.
- Resultado da busca por contas oficiais: não foram encontradas contas oficiais no Bluesky de Black Forest Labs, Runway, Stability AI ou Civitai; elas podem não existir ou ter handles desconhecidos. A aparente conta oficial
midjourney.bsky.socialnão tem posts.
Posts
-
“Fim da Sora” — dahara1, 2026-04-28, 0 curtidas/0 reposts
https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
Comentou sobre o fim do serviço de vídeo Sora da OpenAI, dizendo que a empresa aparentemente não tinha grande apego ao produto. A informação foi confirmada por busca na web: a OpenAI encerrou o app da Sora e a API para desenvolvedores por volta de março de 2026. -
A versão gratuita da Sora consumiu os créditos e deixou de gerar — dahara1, 2026-04-04
https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
Relatou que não conseguia criar vídeos mesmo restando um crédito, sinalizando deterioração do serviço e coerente com os relatos de encerramento. -
Comparativo de marca-d’água entre Nano Banana gratuito e ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 curtida
https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
Observou que o ChatGPT Images 2.0, assim como a versão gratuita do Nano Banana, não tem uma marca-d’água chamativa e é mais confortável de usar. -
Seedance 2 supera outros modelos — luokai, 2026-02-10, 5 curtidas
https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
Com um vídeo original criado em um dia, elogiou fortemente o desempenho do modelo de vídeo Seedance 2. -
Lançamento do Niji 7 — luokai, 2026-01-10, 3 curtidas
https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
O modelo especializado em anime Niji 7 foi apresentado com olhos mais definidos, maior consistência e melhor adesão a prompts. -
Runway Gen-4.5 — luokai, 2025-12-02, 4 curtidas/1 repost
https://bsky.app/profile/luok.ai/post/3m6xsakpud226
Apresentado como uma elevação do padrão em movimento, fidelidade e controle por prompt, com destaque para sua base em world modeling. -
Kling IMAGE O1 — luokai, 2025-12-03, 3 curtidas
https://bsky.app/profile/luok.ai/post/3m72caiexw225
Renovação full-stack da geração de imagens Kling, sob a promessa de aceitar, entender e gerar qualquer coisa. -
Kling VIDEO 2.6 — luokai, 2025-12-05, 2 curtidas
https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
Promove geração de vídeo centrada em narrativa, com áudio sincronizado, lip sync e consistência entre cenas. -
PixVerse V5.5 — luokai, 2025-12-02, 4 curtidas/2 reposts
https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
Destaca geração de múltiplas tomadas com um toque e adição automática de efeitos sonoros para simplificar a produção. -
Modelo de imagem Vidu AI Q2 — luokai, 2025-12-02, 5 curtidas/2 reposts
https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
Promete “geração 4K em 5 segundos” e anunciou uma campanha de geração ilimitada até 31 de dezembro. -
SkyReels V1, modelo-base aberto de vídeo — luokai, 2025-02-18, 3 curtidas/1 repost
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
Apresentado como o “primeiro modelo-base aberto de vídeo centrado em humanos”, ajustado a partir do HunyuanVideo com mais de 10 milhões de vídeos, para reproduzir 33 expressões e mais de 400 movimentos naturais. O post tem mais de um ano, mas foi a única menção clara a um modelo aberto de vídeo encontrada nesta conta. -
Open Creative Studio v13.0, fluxo integrado aberto para ComfyUI — Alessandro Perilli, 2026-01-26, 0 curtidas
https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Divulgado como o fluxo all-in-one mais completo para ComfyUI, capaz de gerar texto, imagens, vídeo, áudio, música, efeitos sonoros e letras, enfatizando gratuidade e uso ilimitado. -
Geração local de imagem pelo Qwen 3.7 27B, o pelicano — Simon Willison, 2026-08-14, 183 curtidas/14 reposts
https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
Relatou que o Qwen 3.7 27B, executado via LM Studio em um M5 Max MacBook Pro com um GGUF de 17 GB, produziu “o melhor pelicano em bicicleta” já obtido em um modelo executável em seu laptop. É um exemplo do avanço local de modelos de pesos abertos. -
Grade comparativa de pelicanos: GPT-6 Astra versus família GPT-5.6 — Simon Willison, 2026-09-04, 202 curtidas/9 reposts
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2i
Publicou uma grade de 12 imagens comparando GPT-6 Astra e os quatro modelos GPT-5.6 Sol/Terra/Luna, mantendo a prática de benchmark visual de modelos fechados. -
Geração 3D no Blender pelo GPT-6 Astra, maquete arquitetônica — Ethan Mollick, 2026-09-05, 163 curtidas/17 reposts
https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
Relatou que, a partir apenas de esboço e descrição, o GPT-6 Astra modelou no Blender o “Cenotáfio de Boullée”, um projeto arquitetônico do século XVIII que nunca foi construído, e gerou até um passeio narrado. Em outro post, de 7/9, observou que a capacidade de criar presença visual passou a ser uma força dos LLMs fechados. -
“A Midjourney tornou-se parte da Meta.ai” — Midjourney Experience Newsletter, 2026-02-03, 1 curtida
https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
⚠️ Atenção: é um post de conta não oficial e provavelmente simplifica demais os fatos. A verificação por busca na web indica que a Meta anunciou, em agosto de 2025, uma parceria para licenciar a “tecnologia estética” da Midjourney; não houve aquisição, e a Midjourney continuou independente (referência: TechCrunch, implicator.ai).
Sinais
- O vídeo fechado está em um cenário de disputa intensa: somente entre dezembro de 2025 e fevereiro de 2026, o feed de luok.ai registrou pelo menos sete novos modelos ou versões: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 e Niji 7. O impulso de modelos chineses — Kling, Vidu, PixVerse e Seedance — é particularmente claro.
- A Sora perdeu força e caminha para o fim: os posts de dahara1 mostram que, em abril de 2026, os créditos gratuitos da Sora já não funcionavam e, no fim daquele mês, o encerramento da Sora foi declarado explicitamente. Isso coincide com relatos de fim do app e da API para desenvolvedores por volta de março. A liderança em vídeo parece ter migrado para grupos chineses e recursos incorporados a modelos generalistas do Google e da OpenAI.
- Geração visual está virando recurso de LLM e benchmark recorrente: os posts de Simon Willison e Ethan Mollick não tratam imagens como produto isolado, mas como uma capacidade de LLMs generalistas, como GPT-6 Astra, Claude Fable 5.1 e Qwen 3.7/3.8 27B. A capacidade visual vem se consolidando como indicador de força nas redes sociais, especialmente com exemplos como geração de arquiteturas 3D no Blender pelo GPT-6 Astra.
- Vídeo open source tem pouca visibilidade no Bluesky: nas buscas e feeds explorados, o único post claramente sobre modelo aberto de vídeo foi SkyReels V1, baseado em HunyuanVideo, de fevereiro de 2025. Não foram encontradas menções a Wan2.2, Qwen-Image ou Z-Image, embora sejam modelos que deveriam estar em discussão em 2026. Em ComfyUI, há principalmente os anúncios individuais do Open Creative Studio de Alessandro Perilli, mais próximos de divulgação de projeto do que de uma onda de discussão.
- A relação entre Midjourney e Meta é facilmente mal interpretada: uma conta não oficial afirmou de modo simplista que “Midjourney tornou-se parte da Meta.ai”, embora a realidade seja uma parceria de licenciamento tecnológico, não aquisição. É um bom exemplo da necessidade de cautela com a precisão de posts em redes sociais.
Limites
- A API oficial de busca do Bluesky,
app.bsky.feed.searchPosts, retornou 403 Forbidden em todas as consultas desta rodada, seguindo o procedimento registrado no playbook. Outros endpoints públicos, comoapp.bsky.actor.getProfile,app.bsky.feed.getAuthorFeedeapp.bsky.feed.getPostThread, funcionaram normalmente, indicando que a limitação está provavelmente concentrada no endpoint de busca. - A página web de busca em
https://bsky.app/search?q=...também é renderizada no cliente e não forneceu o conteúdo dos posts via fetch. - Em substituição à busca por palavras-chave, foram encontradas contas relevantes por busca na web e lidos seus feeds com
getAuthorFeed. Esse método depende de contas que apareceram por acaso nos mecanismos de busca e pode ter introduzido viés, especialmente a baixa cobertura de vídeo aberto. - Buscas na web por posts do Bluesky sobre Wan2.2, Qwen-Image, Z-Image e HunyuanVideo retornaram principalmente artigos do arXiv ou contas sem relação, sem posts relevantes identificados.
- Não foi possível confirmar os handles oficiais de grandes empresas como Black Forest Labs, Runway, Stability AI e Civitai; as tentativas de descoberta retornaram 400 ou nenhum resultado.
- O feed
stablediffusion.bsky.socialparou em janeiro e fevereiro de 2025 e não pôde ser usado como fonte de tendências atuais. - Embora o critério de conclusão indicasse analisar cerca de 20 posts por rede, foram examinados mais de 100 posts de seis feeds e selecionados 16 que eram pertinentes ao tema.
Lemmy
Lemmy — Tendências recentes de IA para imagens e vídeos
O Lemmy é federado e distribuído entre instâncias. A pesquisa usou principalmente a API do lemmy.world, em /api/v3/search, e o lemmy.today, que espelha comunidades de lemmy.dbzer0.com, além de buscas na web como site:lemmy.world. Foram examinados cerca de 25 posts ao todo.
Comunidades
- !«メールアドレス» — Cerca de 5.050 inscritos. É a principal comunidade de geração de imagens aberta, voltada à família Stable Diffusion.
- !«メールアドレス» (
lemmy.today, exibida como “Stable Diffusion Art”) — 2.362 inscritos. Publica diariamente vários trabalhos feitos com SDXL, ComfyUI e Krea2, com muitos links para civitai.com. - Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry e Stable Werewolves, todas comunidades de
lemmy.dbzer0.comfocadas em gêneros específicos — os números de inscritos não são públicos, mas há posts diários em setembro de 2026. - c/«メールアドレス» — Comunidade geral de tecnologia, onde se concentram notícias grandes de modelos fechados, como a polêmica do scanner médico da Midjourney e notícias da Sora.
- c/genart — Comunidade pequena, com 47 inscritos, que declara apoiar modelos generativos open source e de licenças abertas.
- c/«メールアドレス» — Comunidade voltada ao sentimento anti-IA. Não é exclusiva de geração visual, mas um post sobre querer escapar da dependência de ferramentas de IA chegou a 83 pontos.
- c/euroai — Comunidade de nicho que publica listas de empresas europeias de IA e LLMs abertos.
Posts
Mais próximos de código fechado
- “Midjourney pivots from AI image generation to body scanning medical spa” (2026-06-18, pontuação 58, technology) https://lemmy.world/post/... via theregister.com — Discussão sobre a entrada da Midjourney em scanners de ultrassom/TC para a área médica, afastando-se da geração de imagens. O The Register observou que a tecnologia-base existe, mas que parceiros não foram revelados.
- “Midjourney AI pivots to Theranos: Ultrasonic CT” (2026-06-19, pontuação 40, techtakes) via pivot-to-ai.com — Post que ironiza a mudança, comparando-a à Theranos, empresa fraudulenta de exames de sangue.
- “I was wrong about the Midjourney ultrasound scanner” (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — O autor, inicialmente cético, verificou os fatos e recuou de sua posição.
- “Midjourney wants Hollywood studios to reveal details of their AI usage” (2026-07-05, pontuação 73, technology) via techcrunch.com — No processo contra três estúdios, a Midjourney pediu a divulgação de como Hollywood usa IA.
- Post reagindo ao fim da Sora pela OpenAI: “OpenAI: decides to shut down their AI slop video generating model Sora” https://lemmy.world/post/44721138 — Ironiza o fim do app independente da Sora, anunciado em 24 de março de 2026, interrompido em 26 de abril, e a previsão de fim da API Sora 2 em 24 de setembro de 2026.
- “OpenAI collapses media reality with Sora AI video generator” https://lemmy.world/post/12056737 — Compartilha artigo que expressa preocupação com a perda de confiança em vídeos anônimos.
- “OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports” https://lemmy.world/post/36665644 — Críticas à política de exigir que titulares de direitos façam opt-out.
- “Elon Musk maakt complete AI-film met zijn versie van The Odyssey” (2026-07-22, films) via ad.nl — Musk anunciou a produção de um longa de IA sobre “A Odisseia” usando Grok Imagine.
- Post compartilhando análise de receita do ChatGPT (2026-07-15, ai_reddit) — Analisa que a maior parte da receita de Grok, da xAI, viria de conteúdo pago NSFW de imagens e vídeos.
- “Video AI” — Post com pergunta sobre a franquia gratuita para geração de vídeo no Adobe Firefly. O Firefly oferece apenas duas gerações gratuitas; alternativas como Hailuo, Kling, Runway, Pixverse e Hunyuan foram comparadas.
Mais próximos de código aberto
- “Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio” (2026-07-24, pontuação 1, tech) https://bfl.ai/blog/flux-3 — Lançamento limitado do FLUX 3, modelo multimodal capaz de gerar imagens e vídeos de 20 segundos com áudio.
- “FLUX.2-klein-9b-kv-fp8 optimized variant” (2026-03-14, pontuação 8, stable_diffusion) via huggingface.co — Variante leve derivada de FLUX.2 com suporte a KV cache.
- “Black Forest Labs Opening up the first FLUX Creator Program” (2026-05-06, pontuação 3, stable_diffusion) — Anúncio do início de programa para criadores.
- “Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf” (2026-06-03, films) via nu.nl — O cineasta Martin Scorsese tornou-se conselheiro da Black Forest Labs.
- “FLUX Chroma (The Perchance T2i model)” (cerca de um ano atrás, comunidade Perchance) via huggingface.co(lodestones/Chroma) — Modelo derivado que usa NAG, Normalized Attentive Guidance, com comentários positivos sobre descrições de lip sync.
- Exemplos de posts diários em comunidades de Stable Diffusion, de 6 a 9 de setembro de 2026, todos gerados localmente com SDXL, ComfyUI ou Krea2: “Erika - Mahouka Koukou No Rettousei” (pontuação 16), “Colors in Quiet Water” (pontuação 14), “Giant Wire Walker” (pontuação 11) e “Karin - Umi Monogatari” (pontuação 13), todos com links para civitai.com.
- “Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp” https://lemmy.world/post/3243205 — Apresentação de uma interface OSS com edição por camadas não destrutivas, semelhante ao GIMP.
- “Europäische KI- & LLM-Anbieter” (2026-02-15, euroai) — Lista de empresas europeias de IA e LLMs abertas, orientadas por soberania tecnológica e proteção de dados, incluindo modelos de geração de imagem.
- “Your Lemmy Crash Course to Free Open-Source AI” https://lemmy.world/post/76020 — Guia introdutório de ferramentas locais como text-generation-webui, Automatic1111 e ComfyUI+Pinokio.
Sinais
- O principal tema fechado é a polêmica da “virada médica” da Midjourney, com pontuações entre 40 e 73. A mudança de geração de imagens para equipamentos de diagnóstico por ultrassom provocou debate em technology, hackernews e techtakes. Há reações que tratam a iniciativa como suspeita, com comparações à Theranos, mas também houve quem corrigisse críticas após confirmar os fatos.
- A Sora da OpenAI é reiteradamente tratada como símbolo de “AI slop”. Mesmo após o fim do app, em março e abril de 2026, a previsão de descontinuação da API Sora 2 em 24 de setembro continua mantendo o tema ativo.
- No aberto, a Black Forest Labs e a linha FLUX dominam: FLUX 3, com imagens e vídeos de 20 segundos com áudio; versão leve FLUX.2-klein; Creator Program; e a entrada de Scorsese como conselheiro mostram movimentos concretos em cada trimestre.
- Comunidades de criação cotidiana em Stable Diffusion Art/Anime/Abstraction e similares são pequenas, com 2.000 a 5.000 inscritos, mas mantêm posts diários em setembro de 2026 com SDXL, ComfyUI e Krea2 rodando localmente. Isso evidencia a profundidade de uso prático do open source.
- O sentimento anti-IA também é um sinal relevante: um post em c/fuck_ai sobre querer deixar a dependência de IA atingiu 83 pontos, acima de posts normais sobre IA. Isso aponta para uma rejeição persistente a conteúdo generativo em parte da comunidade Lemmy.
- Notícias de modelos fechados no Lemmy são, em geral, reações ou repostagens de artigos de veículos como TechCrunch, The Register e WSJ, e não descobertas originadas dentro da plataforma.
Limites
- O Lemmy tem base de usuários e volume de posts menores que o Reddit, e as discussões dedicadas a IA de imagens e vídeos são menos densas. Não foram encontradas comunidades especializadas que aprofundassem especificamente vídeo, como Sora, Veo, Kling ou Runway.
- A busca de texto completo da API do
lemmy.worldtem precisão baixa: consultas genéricas, como “AI image generation”, retornaram posts irrelevantes sobre mapas da ONU ou reprodução de corujas. Consultas por modelos específicos, como Sora, Midjourney e FLUX, foram necessárias para encontrar material relevante. - Algumas páginas, como
lemmy.world/post/44721138e um post relacionado a DLSS 5 emlemmy.world/post/44347792, retornaram HTTP 500 ou falharam na obtenção de conteúdo. Nesses casos, a análise se baseia apenas no título e em snippets de busca. - Buscas por Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana/Gemini e Veo encontraram muito poucas menções diretas no Lemmy. Grok Imagine apareceu apenas uma vez, no contexto de produção de filme. Esses modelos parecem ter pouca repercussão na plataforma.
- Instâncias como lemmy.ml e lemm.ee foram pesquisadas individualmente, mas os resultados em geral repetiam o material do lemmy.world ou espelhavam os mesmos posts pela federação, sem informações independentes adicionais.
Pinterest — Notícias de IA para geração de imagens e vídeos
As 50 imagens coletadas foram abertas e verificadas uma a uma. Não houve divisão por gêneros: todas vieram de uma única consulta, “Image and Video Generation AI News”.
Temas visuais
- Proliferação de modelos visuais de “rosto de robô + notícia urgente”: miniaturas repetem close de meio rosto de robô humanoide branco com textos em néon, como “AI NEWS” e “BREAKING NEWS”, em vermelho e azul. Há robô sentado à mesa de telejornal [22], composições com um YouTuber homem surpreso e rosto de robô [29], e robô feminino com “THE FUTURE IS AI” [39]. A paleta azul-marinho escura com néon ciano, magenta e laranja domina.
- Miniaturas com rostos de reação de YouTubers: fotos de homens brancos com expressão de surpresa ou desconfiança aparecem com ícones circulares em néon de OpenAI, Google, Meta, Anthropic, Grok, Notion e outras marcas [4, 18]. Parecem ser repostagens de vídeos do YouTube.
- Infográficos em lista, do tipo “X melhores”: infográficos verticais em tons escuros de roxo e preto, organizando ferramentas em cartões numerados, são o formato mais frequente. Runway, Pika, Kling AI, Luma AI/Dream Machine, Canva AI e Hailuo AI aparecem repetidamente como grupo quase fixo [9, 10, 27, 36, 50].
- Antes/depois e formato de quiz comparativo: imagens com duas fotos de montanhas e a pergunta “Which is AI?” [13], ou grades que transformam vídeo de origem em personagens de blocos de madeira, origami, Lego ou flores [11], destacam tanto a dificuldade de reconhecer material gerado quanto o poder de transformação da IA.
- Robôs e humanos colaborando, inclusive em cenas médicas: há CGs fotorrealistas de robôs humanoides brancos usando hologramas ao lado de profissionais de saúde [3, 33], bem como ilustrações de médicos com estetoscópios junto de robôs [32], em um tom mais calmo de convivência entre IA e pessoas.
- Estética tecnológica em fundos escuros e néon: fundos índigo a pretos, circuitos de néon em ciano, magenta e roxo e partículas luminosas aparecem em aproximadamente 70% do conjunto, indicando um estilo padronizado de imagens de notícias de tecnologia no Pinterest.
- Anúncios de geração de vídeo com avatares e personalidades: há publicidade de explicadores em vídeo feitos por IA, em estilo Fiverr, usando uma imagem composta de Jeff Bezos [38], e demonstrações fotorrealistas do Amuse 3.0 da AMD, como o rosto de um pescador idoso [46]. Vários pins usam rostos famosos ou retratos realistas como vitrine de qualidade.
- Imagens sobre ser possível ou não detectar IA: composições com robôs diante de celulares, selos “FAKE”, fotos de gatos e silhuetas de pessoas encapuzadas [3], além de anúncios de ferramentas de detecção [37], visualizam preocupações com autenticidade e desinformação.
Pins notáveis
- [11] Demonstração de transformação de materiais no estilo Luma AI: compara cinco transformações do mesmo vídeo de origem — pessoa, panda de pelúcia e carro — em blocos de madeira, origami, blocos de Lego e flores. É o pin que mostra com maior concretude a capacidade de transformação de texturas da IA de vídeo.
- [24] Acordo de copyright entre ByteDance e Hollywood: captura de artigo com a manchete “ByteDance and Hollywood reach global deal on AI copyright”. Indica que ByteDance e a Motion Picture Association, MPA, chegaram a acordo global para reforçar a proteção de propriedade intelectual nas ferramentas de imagem e vídeo por IA. É um conteúdo próximo de uma fonte primária sobre a reação de grandes empresas fechadas a copyright.
- [35] Resumo de notícias de IA de 12 de agosto de 2026: três destaques: “Grok 4.6 drops”, capaz de executar dezenas de etapas de forma autônoma e se verificar; “Gemini hits 1 billion users”, com o Google alcançando 100 milhões de usuários no ritmo mais rápido de sua história, dois em cada três usando entrada por voz e 150 milhões de imagens geradas por dia; e “Honor's robot phone”, com braço de titânio que sai da traseira para rastrear automaticamente o alvo da câmera. É um dos raros pins de caráter mais informativo, com data e números explícitos.
- [36] Ranking “Best AI Video Generators of 2026”: Google Veo 3.1, Runway Gen 4.5 e Kling 3.0 ocupam os três primeiros lugares com ícones de coroa; depois aparecem Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 e HeyGen. A lista apresenta gerações recentes de modelos com números de versão.
- [42] Vidu S1, da ShengShu Technology: visual de produto para modelo chinês de vídeo com interação em tempo real, anunciado como “The World's Most Advanced Model for Real-Time AI Interaction”. É um dos poucos exemplos que mostram atores chineses além dos modelos ocidentais.
- [45] Artigo que antecipa nova ferramenta de imagem da OpenAI: imagem de matéria com a manchete “OpenAI's Secret Image Generation Tool to Debut Soon”, estimulando expectativa sobre uma ferramenta ainda não anunciada.
- [25] Resumo especial do Google I/O 2026: reúne anúncios de Gemini 3.5 Flash, Gemini Omni e Gemini Spark, a mudança rumo à busca com IA e a competição entre Apple e Google em óculos XR, datado de 20 de maio de 2026. Mostra movimentos do ecossistema adjacente, não apenas de geração de imagens.
- [9] Infográfico comparativo de ferramentas de vídeo “Just Nail It”: organiza Runway, Pika, Kling AI, Luma AI, Canva AI e Hailuo AI por recursos e público-alvo, acrescentando a estimativa de que 80% do conteúdo online incluirá vídeo até 2026.
- [8] Conjunto de ícones de criação de conteúdo por IA para banco de imagens: imagem de stock do tipo Adobe Stock, “Ai Content Creation Concept”, representando geração de texto, imagem, música e vídeo. Não é notícia em si, mas sinaliza a demanda por esse tipo de material visual.
- [43] Infográfico histórico da IA generativa: linha do tempo em tons de roxo, do ELIZA nos anos 1950 ao GPT nos anos 2020, contextualizando historicamente a onda atual de IA generativa.
Sinais
- A oposição entre aberto e fechado não é facilmente legível em imagens isoladas: os pins do Pinterest são predominantemente apresentações de ferramentas, miniaturas de notícias e resumos de dicas. Não há comparativos explícitos entre aberto e fechado, como Seedance versus Wan, comuns no Reddit e no X. Vidu S1 [42], da chinesa ShengShu, e Amuse 3.0 [46], relacionado à AMD e mais próximo de execução local, aparecem apenas como alternativas pontuais aos grandes produtos fechados dos EUA, como Google Veo, OpenAI Sora e Runway.
- Conteúdo de resumo, comparação e tutorial predomina; notícias de última hora são minoria: entre 50 pins, apenas [24], [25], [35] e [45] trazem datas ou informações específicas de lançamentos. A grande maioria são listicles perenes, como “Best AI Video Generators” e “10 Smart Ways”, ou conteúdos com perfil de afiliado, mais fáceis de salvar no Pinterest.
- A preocupação com autenticidade é visível: imagens como [3], [22] e [37], com selos “FAKE”, robôs apresentadores e ferramentas de detecção, mostram que também há interesse do público do Pinterest em dúvidas sobre veracidade e ceticismo em relação a conteúdo gerado.
- As gerações dos modelos estão se renovando rapidamente: [36] lista Veo 3.1, Runway Gen 4.5, Kling 3.0 e Seedance 1.5 Pro como versões atuais de 2026. Junto de Grok 4.6 e Gemini com 1B de usuários em [35], isso sugere que atualizações trimestrais se tornaram rotina.
- Ausência: não apareceu, entre os 50 resultados, nenhuma imagem que simbolizasse a cultura local e auto-hospedada de pesos abertos, como Stable Diffusion, ComfyUI ou Hugging Face, recorrente no Reddit. Os resultados visuais do Pinterest são fortemente inclinados a material promocional de SaaS e ferramentas comerciais, com quase nenhuma visibilidade para conteúdo comunitário verdadeiramente open source.
Limites
- A coleta foi feita previamente por um navegador headless operado pelo worker; este agente não navegou diretamente pelo Pinterest, seguindo o playbook.
- Não houve divisão em gêneros por seções
## <genre> (n); os 50 pins são resultados agregados de uma única consulta, o que impossibilita comparar tendências por categoria. - Cinco pins tinham título “(untitled)”: [5, 13, 15, 20, 24]. O pin [24] também não tinha título capturado, embora fosse possível inferir seu conteúdo a partir da manchete na imagem.
- Embora as URLs dos pins, em
pinterest.com/pin/..., estejam registradas, os destinos não foram abertos e verificados; os julgamentos se baseiam apenas em imagem e título. Data, curtidas e outras métricas de engajamento não foram coletadas. Fora pins com data impressa na própria imagem, como [25] e [35], não foi possível determinar o período de publicação. - Quanto ao critério de conclusão de obter no mínimo dez insights fechados e dez abertos, o Pinterest isoladamente oferece poucos insights claramente classificáveis no lado aberto, limitados principalmente a Vidu [42] e Amuse/AMD [46]. Essa lacuna deve ser compensada pelas demais plataformas, como Reddit.
Ações recomendadas
- Refazer a coleta no X usando termos diretamente relacionados ao tema, como Midjourney, Stable Diffusion, Sora, Nano Banana e Qwen-Image.
- Incluir r/StableDiffusion, r/midjourney e r/comfyui entre os alvos nas próximas pesquisas no Reddit.
- Criar uma lista de acompanhamento das contas relevantes encontradas nesta rodada como alternativa à busca indisponível do Bluesky.
- Priorizar na próxima rodada o fim da API Sora da OpenAI, previsto para 24 de setembro de 2026, e novos desdobramentos da mudança de rumo da Midjourney.
Imagens coletadas


















































Nota sobre qualidade dos dados
O X não coletou nenhum post relacionado ao tema por incompatibilidade dos termos de busca, portanto não há dados da plataforma. Bluesky, Pinterest e YouTube tiveram limitações parciais em APIs de busca e métricas de engajamento, o que enfraquece alguns trechos de validação quantitativa.



