KEN’S CAT LOG

Notícias de IA para Geração de Imagens e Vídeos — 2026-09-05

O GPT-6 "Astra" dominou o burburinho sobre modelos fechados no X e no Bluesky nesta semana, enquanto modelos abertos de vídeo/imagem (LTX-2.5, MiniMax H3 e Qwen-Image-3.0) acompanharam o ritmo quase inteiramente dentro do ecossistema ComfyUI. A maior história isolada, porém, foi a guinada da Midjourney, que deixou a geração de imagens para investir em hardware de ultrassom médico.

Resumo das notícias de IA para geração de imagens e vídeos — fechado vs. aberto — 2026-09-05

Oi! O cenário de IA para imagens e vídeos nesta semana foi um caos total www🔥 Do lado fechado, o GPT-6 "Astra" da OpenAI explodiu no X (antigo Twitter), com mais de 100 milhões de visualizações, e parece ter levado tudo😳 Enquanto isso, o lado de código aberto não ficou para trás: modelos muito fortes como LTX-2.5, MiniMax H3 e Qwen-Image-3.0 foram lançados um após o outro com pesos abertos, e o ComfyUI está se tornando uma verdadeira nave-mãe🛠️ E uma notícia discretamente insana: a Midjourney teria parado de gerar imagens para fazer uma guinada para uma empresa de scanners de ultrassom médico😱 Foi realmente chocante. Outra descoberta desta edição é que, mais do que a evolução técnica, a discussão sobre o tratamento jurídico de conteúdos gerados por IA foi o que mais chamou a atenção do pessoal do Reddit.

Entre as plataformas

Plataforma por plataforma

Reddit: o resumo mensal de r/StableDiffusion (uma enxurrada de lançamentos de modelos abertos como Qwen3.8, DeepSeek-V4-Pro, Ling-3.0 e Gemma-4-31B, num ritmo que nem os comentários conseguem acompanhar) é uma thread excelente https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ 。Também chamou atenção o Atlas da World Labs, uma tecnologia capaz de gerar instantaneamente mundos 3D a partir de vídeos/fotos e com potencial para robótica https://www.reddit.com/r/accelerate/comments/1w5ye9s/ 。Mas o que mais cresceu não foi notícia técnica: foi a thread sobre a decisão de que pornografia infantil gerada por IA seria constitucional; temas jurídicos e éticos parecem mobilizar mais o Reddit.

X: a busca acabou trazendo apenas quatro itens relacionados ao Astra, tornando o GPT-6 Astra a estrela absoluta🎤 Entre eles, o post mais técnico foi a demonstração, pelo desenvolvedor @Dimillian, de um pipeline 3D “do Blender ao UE5” https://x.com/Dimillian/status/2095596700815516004 。Nenhum item de código aberto (Stable Diffusion, Flux, Wan etc.) apareceu no recorte de busca desta vez — uma lacuna real.

YouTube: no lado fechado, há muitas análises comparativas de Nano Banana 2, Kling 3.0 vs Veo 3.1 vs Sora 2, Seedance 2.5 e Seedream 5.0 Pro https://www.youtube.com/watch?v=AAD7wJ3DWiA 。No lado aberto, aparecem LTX-2.5 (um modelo extremamente rápido, capaz de gerar 10 segundos em 720p em 6,8 segundos) https://www.youtube.com/watch?v=RjlbDhs1MPk e HunyuanImage3.0 (MoE de 80 bilhões de parâmetros) https://www.youtube.com/watch?v=U-8RjjU7x14 , mostrando que modelos com pesos abertos já são comparados com os fechados logo após o lançamento. Também surgiu a notícia de que a OpenAI encerraria a API do Sora para concentrar recursos no próximo modelo, “Spud” (o vídeo do YouTube em si não foi confirmado; a informação veio por notícias).

Bluesky: o recorrente “benchmark de imagens de pelicanos” de Simon Willison tornou-se um ponto de observação contínua para checar a qualidade de modelos fechados https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c 。A conta oficial da Replicate funciona como hub de notícias rápidas sobre lançamentos de modelos de vídeo como Kling3.0, Seedance2.0, Runway Gen-4.5 e Vidu Q3 https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c 。Quase não há comunicação primária de projetos abertos, a ponto de ostris, criador de ferramentas LoRA, dizer que a comunidade de IA/ML “permaneceu quase toda no X (Twitter)”😅 Entre os falantes de japonês, houve basicamente o compartilhamento de um artigo da GIGAZINE sobre Qwen-Image-3.0 https://gigazine.net/news/20260722-qwen-image-3/ .

Lemmy: !«メールアドレス» tem a maior densidade de informações sobre modelos abertos. Itens relacionados ao MiniMax H3 (a Comfy se tornando revendedora comercial https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller , ferramentas que rodam com 16 GB de VRAM etc.) representavam quase metade das postagens. O LLaDA-Image, com receita de treinamento totalmente aberta https://arxiv.org/abs/2609.03796 , também é muito interessante. Do lado fechado, a notícia “Midjourney deixa geração de imagens e migra para scanners médicos de ultrassom” teve scores muito mais altos do que qualquer novo modelo (58–73), tornando-se o principal assunto para os usuários do Lemmy.

Pinterest: visualmente, os modelos fechados dominam de longe: Google Veo2/3, Microsoft VASA-1, Grok4.6 e o marco de um bilhão de usuários do Gemini aparecem em imagens-resumo. Entre nomes específicos do lado aberto, quase só apareceu a ferramenta local da AMD, “Amuse 3.0”. Também há muitos casos de uso de “animar/criar rostos” — lip sync, reprodução de expressões e geração de retratos —, o que parece combinar bem com o público do Pinterest, interessado em beleza e ideias para posts em redes sociais.

O que observar

  1. Novidades do GPT-6 Astra voltadas a imagens/vídeos — X, https://x.com/flowith/status/2095750768204877858 (prévia de um confronto de animação entre GPT-6 Astra e GPT-5.6, em breve)
  2. Fim da API do Sora → próximo modelo “Spud” — pesquisa no YouTube; encerramento da API previsto para 2026-09-24. Ninguém ainda confirmou as imagens ou funções reais.
  3. O rumo da comercialização da licença do MiniMax H3 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (se a rota híbrida — pesos abertos, mas uso comercial pago — vai se consolidar)
  4. Guinada da Midjourney para dispositivos médicos — Lemmy, https://lemmy.zip/post/66397234 (se uma veterana do setor fechado realmente deixará a geração de imagens por IA)
  5. Receita de treinamento totalmente aberta do LLaDA-Image — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (até que ponto um modelo aberto no topo do Qwen-Image-Bench será reproduzido por outros)
  6. Atlas da World Labs — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (como a geração de mundos 3D a partir de vídeo será reaproveitada para dados de treinamento de robôs)

Recomendações

  1. Seria melhor refazer a coleta no X com termos específicos, como “Stable Diffusion”, “ComfyUI”, “Flux”, “Wan”, “Kling” e “Sora”, em vez de depender das tendências.
  2. Como a API searchPosts do Bluesky retornou 403, na próxima vez será mais eficiente ampliar antecipadamente uma lista de contas conhecidas via busca no Google.
  3. Modelos como o MiniMax H3, que têm pesos abertos mas cobram pelo uso comercial, devem receber uma observação explícita no relatório, em vez de serem classificados simplesmente como “abertos”.
  4. Notícias de “saída ou mudança de rumo” de grandes empresas, como a guinada da Midjourney e o fim do Sora da OpenAI, merecem uma categoria de monitoramento contínuo nas próximas edições, pois tendem a atrair mais interesse do que notícias técnicas.
  5. Como o Pinterest tem pouca informação primária, parece mais útil como termômetro de como consumidores comuns recebem o tema do que como fonte para mapear tendências técnicas.
  6. A tendência visível no Reddit e no Lemmy — decisões judiciais e controvérsias éticas geram mais repercussão do que notícias técnicas — também vale ser capturada como um sinal separado no próximo briefing.

Qualidade dos dados

  • X: como as postagens coletadas partiram de tendências geolocalizadas na Croácia, fora quatro itens sobre GPT-6 Astra havia ruído irrelevante — criptomoedas, universo de Elon e esportes. Não houve nenhuma menção a código aberto, e a coleta não alcançou as “20 análises” solicitadas pelo briefing.
  • Bluesky: a API oficial de busca retornou 403, portanto o método foi alterado para verificar feeds individuais de contas conhecidas. Foram encontrados apenas cerca de 12 posts diretamente relacionados ao tema, quase sem informação primária sobre código aberto.
  • Reddit: apenas um termo de busca produziu 12 threads em 9 subreddits, abaixo da meta de 20. Ainda assim, foram registrados até seis comentários principais por thread.
  • YouTube: como os resultados e páginas de vídeo são renderizados via JavaScript, não foi possível confirmar diretamente visualizações, inscritos nem datas exatas de publicação; as datas foram estimadas a partir da indicação relativa nos snippets.
  • Lemmy: por ser federado, a busca em uma única instância deixa escapar posts de outras instâncias. Buscas diretas por serviços fechados de geração de vídeo, como Sora, Kling e Veo, quase não encontraram resultados.
  • Pinterest: de 50 itens, apenas 24 imagens foram abertas e verificadas; as demais foram avaliadas apenas pelo título. Os dados coletados não incluem métricas de engajamento como curtidas ou salvamentos.

Resumo por plataforma

Reddit

Reddit — Notícias de IA para geração de imagens e vídeos

Onde

As 12 threads coletadas vieram de 9 subreddits. Foi usado apenas o termo de busca “Image and Video Generation AI News”.

Subreddit Inscritos Threads coletadas
r/generativeAI 150,575 4
r/GrokAiDiscussion 4,883 1
r/freetoolsAI 7,616 1
r/StableDiffusion 1,000,814 1
r/accelerate 77,800 1
r/news 31,531,475 1
r/antiai 313,317 1
r/allthequestions 127,064 1
r/teenagers 3,673,210 1

r/generativeAI teve o maior número de itens (4) e é o principal espaço para posts casuais de descoberta e comparação de ferramentas. Os demais tiveram uma thread cada; chama atenção que o tema alcançou subreddits não especializados em geração de imagens/vídeos, como r/news e r/teenagers.

O que as pessoas dizem
  • #4 r/StableDiffusion “Notícias locais de IA que você perdeu — agosto de 2026” (201 pt · 22 comentários · 2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — resumo mensal afirmando que muitos modelos abertos, como Qwen3.8, DeepSeek-V4-Pro-0813, a série Ling-3.0 e Gemma-4-31B, foram lançados somente em agosto. Os comentários também trouxeram complementos em sequência: u/Narutobirama(20), “Você provavelmente perdeu o Qwen3.8 Flash Next”, e u/MoJaKF(14), “Anima-3.8B já está na versão 1.1, lançada há 3 horas”, mostrando um ritmo rápido demais até para o próprio resumo acompanhar.
  • #5 r/accelerate “...Eles criaram uma IA que analisa alguns vídeos ou fotos casuais do mundo real e os transforma instantaneamente em um playground 3D completo” (763 pt · 76 comentários · 2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — sobre o Atlas da World Labs, que gera mundos 3D interativos a partir de vídeos/fotos. A reação foi entusiasmada; u/stainless_steelcat(48) comentou “O bullet time de Matrix chega à vida real... agora sei que ele não era ambicioso o bastante.” Também se discutiu a possibilidade de a geração de vídeo criar dados de treinamento para robótica.
  • #6 r/generativeAI “Mesmo prompt. Mesmos 30 segundos. Dois modelos diferentes de vídeo por IA.” (98 pt · 30 comentários · 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — comparação entre Seedance 2.5 e Wan 3.0 com o mesmo prompt. u/SpecialistDragonfly9(5) avaliou que “seedance é, DE LONGE, superior”, enquanto u/Positive-Key6640(4) questionou o próprio método: “Comparações com o mesmo prompt são divertidas, mas em geral medem qual modelo por acaso prefere seu estilo de prompt, não qual é melhor.”
  • #2 r/GrokAiDiscussion “Eles afrouxaram a moderação de geração de imagem para vídeo?” (14 pt · 28 comentários · 2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — usuários têm experiências divergentes com a política de moderação do Grok Imagine. Enquanto u/Miserable_Appeal515(2) diz que “melhorou”, u/joderrelldalejr(2) afirma o contrário: “De jeito nenhum, piora e então começam a limitar quantas imagens você pode fazer por semana.”
  • #1 r/generativeAI “Lista de sites diários de geração de vídeo por IA” (38 pt · 27 comentários · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — troca de informações para usuários que querem aproveitar créditos gratuitos. O Kling AI teria “66 créditos gratuitos a cada 24 horas”; u/Murky-Race-3443(1) observa que “o capcut dá créditos grátis diários”, e u/Julia_Leeds94(1) apresenta o YalleryLabs, onde vídeos de 5 segundos em 720p custariam a partir de US$ 0,18 dentro de um orçamento de US$ 3.
  • #3 r/freetoolsAI “Gerador de imagens por IA gratuito” (31 pt · 31 comentários · 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — comentários se concentraram num post promocional de um site de geração de imagens gratuito e sem cadastro. u/Odd-Lingonberry1516(2) listou alternativas como Deepany, Aifun e Perchance. u/thecragmire(1) perguntou sobre o modelo financeiro: “Como você mantém isso? Deve custar algo, certo?”
  • #11 r/generativeAI “Algum image-to-video BOM??” (1 pt · 13 comentários · 2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI foi descrito como “praticamente o rei da montanha para movimento humano realista”, e Runway como “o padrão-ouro para controle criativo”. Entre as opções locais, u/Ok-Addition1264(2) recomendou ComfyUI + WAN22/LTX2.3.
  • #7 r/generativeAI “Algum bom site de vídeo por IA? Mesmo se for pago?” (0 pt · 15 comentários · 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) avalia que o gen-3 da Runway “lida muito bem com movimento em comparação com muita coisa desajeitada”, mas critica Pika como “divertido para loops rápidos... porém o resultado fica repetitivo depois de um tempo”.
  • #8/#10 r/news “Juiz federal decide que material de abuso sexual infantil gerado por IA é protegido pela Primeira Emenda.” (1,379 pt · 545 comentários · 2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) e r/allthequestions “Por que um juiz federal declarou legal a criação de pornografia infantil gerada por IA?” (31 pt · 277 comentários · 2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — o debate sobre o status jurídico de conteúdos gerados por IA teve engajamento muito acima dos demais. u/Ntroepy(414) alertou que “a manchete parece clickbait... [a decisão está] vinculada a uma sentença da Suprema Corte de 2002”, enquanto u/TheGracefulCrane(31), em r/allthequestions, resumiu a interpretação jurídica: “juízes não fazem leis, e a lei não foi atualizada para tornar isso ilegal; daí a decisão”.
  • #9 r/antiai “Imagens geradas por IA estão ficando mais difíceis de detectar” (113 pt · 30 comentários · 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — ao contrário do título, os comentários se divertiram com falhas em membros, como u/GurInside278(31): “por que os pés dela são as mãos dela”. O resultado é uma lacuna irônica entre a premissa e a reação real.
  • #12 r/teenagers “Para todos os usuários de geradores de imagens/vídeos por IA” (7 pt · 41 comentários · 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — post respondendo à alegação de que “arte por IA” é criada sem trabalho do artista. u/LiterallyGarbage_0(5) escreveu: “pessoas que usam IA para fazer ‘arte’ realmente me deixam muito irritado... peguem um lápis”, expressando forte sentimento anti-IA entre adolescentes.
Sinais
  • Em alta: a frequência de lançamentos de modelos locais abertos — LLMs, imagem e vídeo — é tão alta que nem os comentários da thread #4 conseguem acompanhá-la. O reaproveitamento de geração de vídeo para dados de treinamento em robótica, como no Atlas da World Labs (#5), também desponta como uma nova direção de interesse.
  • Conflito de opiniões: os relatos sobre a moderação do Grok Imagine (#2) se dividem entre “melhorou” e “piorou”. Em Seedance vs Wan (#6), convivem a opinião de que “Seedance vence de lavada” e a crítica de que comparações com o mesmo prompt têm pouco valor. Não há uma conclusão única.
  • Minimizado/questionado: o formato clássico de comparar modelos com o mesmo prompt (#6) é criticado por u/Positive-Key6640 como metodologia.
  • Surpresa: a thread #9, intitulada “Imagens geradas por IA estão ficando mais difíceis de detectar”, acabou sendo uma brincadeira sobre falhas de mãos e pés, criando uma diferença entre título e reação. Além disso, decisões judiciais (#8 e #10, com mais de 800 comentários no total) superaram enormemente notícias de produtos em engajamento. No Reddit, o maior ponto de atrito parece ser o tratamento jurídico e ético de materiais gerados por IA, mais do que o progresso técnico.
Limites
  • Foi usado apenas o termo “Image and Video Generation AI News”, resultando em 12 threads de 9 subreddits. Isso não alcança as cerca de 20 postagens por rede solicitadas em brief.md.
  • Nesta etapa, foi feita somente a leitura de output/reddit.threads.md/.threads.json, previamente coletados pelo worker; não houve nova coleta com termos adicionais nem acesso direto a threads ou comentários individuais, conforme o playbook. As lacunas de coleta provavelmente estão fora do alcance daquele único termo.
  • Foram registrados no máximo seis comentários principais por thread; reações abaixo disso e opiniões minoritárias não aparecem neste relatório.

X

X — Notícias de IA para geração de imagens e vídeos

Contas

Das 34 contas desta coleta, apenas quatro publicaram algo relacionado a IA para geração de imagens/vídeos — todas sobre o mesmo lançamento e dentro das mesmas 24 horas (2026-09-03):

  • @OpenAI (OpenAI) — um post, mas ele resume toda a história: 309,095 curtidas, 55,587 repostagens, cerca de 108,000,000 visualizações. A conta fez o mínimo — um único tweet de anúncio com imagem — e deixou o volume fazer o resto.
  • @MatthewBerman (Matthew Berman) — conta de influenciador de IA, um post (4,054 curtidas, cerca de 1,500,000 visualizações), apresentado como thread de primeiras impressões com “acesso antecipado”, posicionando-o como testador, não como fonte.
  • @Dimillian (Thomas Ricouard) — um post (7,199 curtidas, cerca de 2,300,000 visualizações), demonstrando um pipeline específico (Blender → Unreal Engine 5), em vez de hype geral — a alegação técnica mais concreta do conjunto.
  • @flowith (Flowith) — a menor conta aqui (947 curtidas, cerca de 115,000 visualizações), uma conta de produto aproveitando o lançamento para fazer uma comparação direta com o modelo anterior.

Todas as outras contas da coleta (34 no total, 40 posts) — contas de cripto/memes (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), fãs de Elon/Tesla (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), um influenciador de cibersegurança (@corewarrior, @hackerzspace), contas de notícias e memes da Polônia/África/Bósnia, contas de fãs de Ariana Grande (@vodolove publicou 3 dos 4 itens) e contas de sorteios de marcas de cerveja (@naturallight, @ChinookCi) — não têm relação com IA de geração de imagens ou vídeos. Elas são mencionadas apenas porque foram o que a coleta efetivamente retornou; veja Limites.

Posts
1. Lançamento do GPT-6 “Astra” — @OpenAI

“Este é o GPT-6 Astra. Tudo que você pode fazer em um computador, Astra pode fazer por você. Rápido.”

De longe, o maior post de todo o conjunto coletado. Foi apresentado como agente geral para uso em computador, não como modelo específico de imagem/vídeo — mas as demonstrações posteriores de outras contas são todas visuais ou 3D, sugerindo que os pontos fortes mostrados pelo Astra pendem para esse lado.

2. Astra vs. modelo anterior, com foco em animação — @flowith

“GPT-6 Astra VS GPT-5.6 em animação, em breve no flowith.io”

Uma conta de produto de terceiros preparando explicitamente uma comparação de animação entre Astra e a geração anterior — um sinal concreto de que Astra está sendo testado e promovido especificamente por sua capacidade de gerar animação, não apenas por uso geral em computadores.

3. Thread de primeiras impressões com acesso antecipado — @MatthewBerman

“Astra (GPT-6) chegou!!! Tive acesso antecipado e o testei exaustivamente em jogos, código, escrita, controle de navegador, apresentações e trabalho geral de conhecimento. Este é o melhor modelo que já usei. Ponto.”

O destaque está no que não é mencionado: nenhuma geração de imagens ou vídeos aparece explicitamente na lista de capacidades, apesar de a thread prometer “demos incríveis abaixo”.

4. Demonstração do Blender ao Unreal Engine 5 — @Dimillian

“Astra é muito bom em modelagem 3D, e mal posso esperar para todos vocês experimentarem. Por enquanto, aqui está um pequeno passo a passo de como construí a casa de demonstração para nosso post de lançamento: de uma cena do Blender para uma experiência explorável no Unreal Engine 5.”

A alegação mais concreta e específica sobre ferramentas da coleta: Astra foi usado num pipeline real de conteúdo 3D (Blender → UE5), algo mais próximo de um fluxo de trabalho de geração visual/vídeo do que qualquer outro item que o X mostrou nesta execução.

Sinais
  • Em alta: GPT-6 “Astra” é a única história relacionada a imagem/vídeo que esta coleta encontrou, e domina em engajamento (cerca de 108 milhões de visualizações só no post de lançamento, contra poucas centenas de milhares nos demais). O agrupamento de reações — comparação de produto, primeiras impressões de influenciador e demo de pipeline 3D de desenvolvedor — dentro de 24 horas parece um lançamento coordenado, não uma descoberta orgânica.
  • Ausente/minimizado: nenhum modelo aberto de geração de imagens ou vídeos (Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI etc.) aparece em nenhum lugar da coleta. Se há atividade de IA aberta de vídeo/imagem no X agora, esta busca não a alcançou.
  • Surpresa: muito pouco do discurso sobre o lançamento de “IA” de fato cita geração de imagens ou vídeos como recurso. A lista de acesso antecipado de Matthew Berman sequer menciona isso, e Astra é promovido como agente geral (“tudo que você pode fazer em um computador”). O ângulo de imagem/vídeo é inferido do que os primeiros testadores escolheram demonstrar — modelagem 3D e comparação de animação —, e não do enquadramento da OpenAI.
Limites
  • As buscas coletadas não foram direcionadas ao tema. Os dez termos realmente pesquisados — “Astra”, “$SONG”, “Robinhood”, “Elon”, “#CyberSecurity”, “Poland”, “Africa”, “Bosnia”, “ariana”, “#Sweepstakes” — são a lista de tendências do próprio X nesta sessão (ver a tabela Explore em x.posts.md), não termos escolhidos para IA de geração de imagens/vídeos. Apenas as buscas por “Astra” (posts #1–4) trouxeram algo pertinente; os outros 36 posts — tokens de cripto, fandom de Elon/Tesla, influenciadores de cibersegurança, notícias e memes de Polônia/África/Bósnia, contas de fãs da Ariana Grande e sorteios de cerveja — são ruído de uma lista de pesquisa incompatível.
  • Os critérios de conclusão não foram cumpridos por estes dados. O briefing pede análise de cerca de 20 posts por plataforma sobre o tema; esta coleta tem apenas 4 posts utilizáveis, todos sobre um lançamento fechado (GPT-6 Astra), e zero sobre geração aberta de imagens/vídeos. Seria necessária uma nova rodada com termos como “Stable Diffusion”, “ComfyUI”, “Flux”, “Kling AI”, “Runway”, “Sora”, “Midjourney”, “Wan 2.x” ou “HunyuanVideo” para cobrir o briefing de fato no X.
  • Ressalva de geolocalização: a lista de tendências do Explore do X nesta sessão está geolocalizada para a Croácia (explicitamente marcada como “Trending in Croatia” na maior parte dos itens), o que explica o predomínio de tokens de cripto, futebol bósnio e notícias/memes dos Bálcãs. Trata-se das tendências de uma localização de servidor, não de um retrato global.
  • Nenhuma cobertura de código aberto. Nada nesta coleta trata de notícias, ferramentas ou lançamentos abertos de geração de imagens ou vídeos — a lacuna é total, não parcial.

YouTube

YouTube — Notícias de IA para geração de imagens e vídeos (código fechado / código aberto)

Canais

Canais encontrados via resultados de busca do YouTube e busca por notícias. Em muitos casos, não foi possível verificar diretamente o número de inscritos porque as páginas de vídeo são renderizadas por JavaScript (detalhes em ## Limites).

  • Theoretically Media — canal recorrente que testa IA generativa aberta, como Wan / FLUX / Qwen-Image, no ComfyUI. (“Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...” https://www.youtube.com/watch?v=3BFDcO2Ysu4)
  • Matt Wolfe / The Next Wave — conhecido por comparações de ferramentas fechadas, como Runway, Kling, Veo e Sora.
  • Vários canais individuais de ferramentas de IA, com análises de modelos como LTX-2.5, MiniMax H3 e Nano Banana 2; os resultados de busca exibiram apenas os títulos dos vídeos, sem os nomes dos canais.
Vídeos
Modelos fechados
  1. “Nano Banana 2 É INSANO — Teste completo do novo modelo de imagem do Google!” — por volta de 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — testa o Gemini 3.1 Flash Image do Google, conhecido como Nano Banana 2, alegando que ele resolve a troca entre velocidade e qualidade de imagem.
  2. “Nano Banana 2 vs Nano Banana Pro: testei os dois para você não precisar testar” — fim de fevereiro de 2026 — https://www.youtube.com/watch?v=B1d3SIfoQLk — compara os resultados da versão padrão e Pro para avaliar qual usar.
  3. “Kling 3.0 me surpreendeu! Comparado ao Veo 3.1 e ao Sora 2” — por volta de 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — compara diretamente o Kling 3.0 da Kuaishou com Veo 3.1 e Sora 2 e avalia que ele se sai bem em realismo visual e trabalho de câmera.
  4. “Kling 3.0 é realmente bom? (Gastei US$ 500 testando para você)” — por volta de 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — teste pago do Kling 3.0 em multishot e saída 4K60fps.
  5. “Seedream 5.0 testado e os vazamentos de Seedance 2.5 são irreais!” — por volta de 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — testa o modelo de imagem Seedream 5.0 Pro da ByteDance e o ainda não lançado Seedance 2.5 (menciona que a ByteDance pulou o Seedance 2.1).
  6. “Seedance 2.5 é insano — 30 segundos em UMA tomada?” — por volta de 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — verifica a capacidade do Seedance 2.5 de gerar 30 segundos contínuos de vídeo em uma única tomada.
  7. “Análise do MiniMax H3 | Testando o novo modelo de vídeo por IA 2K da Hailuo” — início de agosto de 2026 — https://www.youtube.com/watch?v=67CCQBAwZiA — teste prático do MiniMax H3 (Hailuo 3.0), lançado em 2026-07-31, verificando 2K, 15 segundos e áudio estéreo nativo.
  8. “O novo modelo MiniMax H3 da Hailuo AI é INCRÍVEL! (Teste completo)” — por volta de agosto de 2026 — https://www.youtube.com/watch?v=la0iBk8g8_g — teste completo da capacidade omnimodal do MiniMax H3, recebendo simultaneamente texto, imagens, vídeo e áudio.
  9. “Prévia do FLUX 3” — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — apresentação antecipada do FLUX 3 da Black Forest Labs, multimodal para imagens, vídeos de 20 segundos, áudio e ações; o vídeo chegou à disponibilidade geral em 2026-08-04.
  10. “Atualizações do Gen-4.5 — Dia de demonstrações de pesquisa 2025 | Runway” — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — explicação técnica da conta oficial da Runway sobre atualizações do Gen-4.5, incluindo controle de câmera e consistência de personagens.
  11. “IA tudo em um | IA de texto para imagem e vídeo | Kling, Veo, Sora, Nano Banana Pro | Créditos grátis diários!” — recente — https://www.youtube.com/watch?v=SnmRpf_VfgU — vídeo que mostra como usar diversos modelos fechados, como Kling, Veo, Sora e Nano Banana Pro, aproveitando planos gratuitos.
Modelos abertos
  1. “LTX 2.5 no ComfyUI — configuração, primeiras gerações e a ressalva” — meados de agosto de 2026 (cerca de três semanas após a publicação dos pesos abertos do LTX-2.5 em 2026-08-11) — https://www.youtube.com/watch?v=RjlbDhs1MPk — integra nativamente o modelo de mundo LTX-2.5 de 22B da Lightricks ao ComfyUI e confirma velocidade de 6,8 segundos para gerar vídeo de 10 segundos em 720p.
  2. “LTX 2.5 no ComfyUI: teste de física vs MiniMax H3 + workflows gratuitos” — há cerca de três semanas — https://www.youtube.com/watch?v=WpKNXZZqQEU — confronto direto entre o LTX-2.5 de pesos abertos e o MiniMax H3 não público em física e multishot.
  3. “O novo modelo de vídeo LTX 2.5 é ABSURDAMENTE rápido (ComfyUI local)” — há cerca de três semanas — https://www.youtube.com/watch?v=pA2BQw9LY8A — teste focado em velocidade de execução local.
  4. “Wan 2.2, FLUX e Qwen Image atualizados: tutorial definitivo para modelos SOTA abertos de geração de imagens e vídeos” — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — explica Wan 2.2, um modelo de vídeo MoE, FLUX, FLUX Krea e Qwen Image no ComfyUI. Avalia que Wan 2.2 se aproxima do Sora em consistência e que FLUX leva vantagem em detalhes.
  5. “HunyuanImage 3.0 — o mais poderoso gerador de imagens de código aberto até agora” — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — apresenta o modelo de imagem MoE de 80B parâmetros da Tencent. Menciona uma pequena vantagem em taxa de vitória contra Seedream 4.0, Nano Banana e GPT-Image.
  6. “Flux.2 Dev: análise completa, prós e contras, configuração no ComfyUI!” — por volta de 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — análise e configuração no ComfyUI do FLUX.2 da Black Forest Labs, incluindo versão de pesos abertos. Destaca a consistência de assunto com até dez imagens de referência.
  7. “FLUX 2 lançado! 🤯 Instalação no ComfyUI, workflow e o segredo do ‘parâmetro ativo’” — por volta de 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — guia de instalação no ComfyUI e explicação dos novos recursos do FLUX.2.
  8. “Primeiro olhar para Qwen Image e testes LOCAIS (o melhor novo modelo de imagem?)” — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — primeiro teste de execução local do Alibaba Qwen-Image, antecessor do posterior Qwen-Image-2512.
  9. “Qwen Image Edit 2511 — edição local de imagens no ComfyUI | transferência de estilo com múltiplas referências e workflow GGUF” — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — testa transferência de estilo usando diversas imagens de referência no Qwen Image Edit, com workflow GGUF no ComfyUI.
  10. “MiniMax H3: o novo campeão aberto de vídeo?” — por volta de agosto de 2026 — https://www.youtube.com/watch?v=3R5GROj8Tcg — apresenta o MiniMax H3 como modelo omnimodal de vídeo lançado com pesos abertos e menciona sua posição de primeiro lugar em rankings de edição de vídeo.
Sinais
  • Pesos abertos se aproximam rapidamente do estado da arte: LTX-2.5 (2026-08-11) e MiniMax H3 (2026-07-31) foram ambos disponibilizados com pesos abertos nos últimos 60 dias. As miniaturas de comparação frequentemente usam o enquadramento “equivale/supera MiniMax H3 de código fechado” para vídeo. Os projetos abertos já não são apenas seguidores: tornam-se referência de comparação logo após o anúncio.
  • Ciclo acelerado de lançamentos da ByteDance: Seedream 5.0 Pro e Seedance 2.5, com o 2.1 pulado, foram atualizados em intervalos de poucos meses. Os vídeos de teste de YouTubers têm tom urgente, com termos como “Tested” e “Leaks”.
  • Reorganização no ecossistema Google: toda a linha Imagen estaria prevista para ser descontinuada em 2026-08-17, com migração para Nano Banana, da linha Gemini 3.x Image. O próprio Nano Banana 2, de 2026-02-26, já tem diversos vídeos comparando-o a sucessores, como a versão Pro.
  • Saída de uma grande empresa fechada: a OpenAI encerraria a API do Sora em 2026-09-24 e redirecionaria capacidade computacional ao modelo seguinte, “Spud” (com base em resultados de busca; o vídeo do YouTube não foi confirmado). Trata-se de uma mudança importante ligada diretamente ao movimento dos modelos fechados no briefing.
  • ComfyUI é a plataforma de teste de fato para código aberto: vídeos de análise de Wan, FLUX, Qwen-Image, LTX-2.5 e outros modelos abertos quase sempre vêm acompanhados de guias de integração ao ComfyUI.
Limites
  • As páginas de resultados do YouTube (youtube.com/results?...) e de vídeos (youtube.com/watch?v=...) são renderizadas em JavaScript. Mesmo com acesso direto, foram obtidos apenas links de navegação do rodapé; não foi possível ler diretamente dados brutos de visualizações, inscritos ou datas de publicação (ytInitialData etc.). Assim, as datas foram estimadas com base em snippets de mecanismos de busca, como indicações relativas de “3 weeks ago” e referências em artigos. A maioria dos vídeos não teve visualizações nem inscritos confirmados.
  • Não foi encontrado um vídeo direto no YouTube sobre o fim do Sora da OpenAI e o sucessor “Spud”; esse item se baseia em menções em notícias, e reações em vídeo no YouTube não foram confirmadas.
  • Foram encontrados vídeos de anúncio no canal oficial para Runway Gen-4.5 e atualizações recentes da Midjourney, mas não análises recentes e independentes, dentro de 60 dias, na busca desta vez.
  • Foi possível confirmar links de vídeos de análise individual do Nano Banana Pro, com títulos como “Nano Banana Pro… wtf”, mas não nomes de canais nem visualizações.

Bluesky

Bluesky — Tendências recentes em IA para geração de imagens e vídeos

Contas
  • Simon Willison @simonwillison.net — desenvolvedor conhecido por avaliar modelos de LLM e geração de imagens. Publica comparações do recorrente “benchmark de imagens de pelicanos” sempre que surge um novo modelo. As respostas de seguidores também são numerosas, tornando-o uma boa fonte primária de notícias sobre modelos fechados.
  • fofr @fofr.ai — especialista em prompts de imagem ativo ao redor da Replicate. Publica frequentemente formas práticas de usar Nano Banana Pro (Gemini 3 Pro Image).
  • Replicate (oficial) @replicate.com — conta oficial de uma empresa de hospedagem de APIs de modelos de IA. Anuncia cada novo modelo hospedado na Replicate e funciona como fonte rápida de lançamentos de modelos de vídeo, abertos ou fechados.
  • Amanda Silberling (repórter da TechCrunch) @amanda.omg.lol — jornalista que cobre aspectos culturais da geração de imagens por IA.
  • AI News Updates @ai-latestnews.bsky.social — conta bot que publica automaticamente notícias do setor de IA.
  • gigowat @gigowat.bsky.social — conta que compartilha no Bluesky artigos da GIGAZINE, site japonês de notícias de gadgets. É uma das poucas fontes de notícias de IA para geração de imagens em japonês.
  • ostris @ostris.com — desenvolvedor da ferramenta aberta de treinamento LoRA “AI-Toolkit”. Publica sobre modelos da linha Flex, mas, segundo ele próprio, a comunidade de IA/ML “permaneceu quase toda no Twitter”, e há poucas atualizações no Bluesky.
Posts
  1. Simon Willison — publicou uma grade comparando imagens de pelicanos do GPT-6 Astra e GPT-5.6 Sol/Terra/Luna (modelos fechados, comparação de modelos de imagem da OpenAI). 2026-09-04, 👍91 · 🔁6 · 💬12.
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    Em seguida, também publicou versões em tamanho completo das imagens geradas, cujo texto alternativo também foi produzido por GPT-5-astra. 👍23.
    https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c

  2. Simon Willison — publicou uma comparação de imagem de pelicano gerada pelo Google Gemini 3.7 Flash. 2026-09-02, 👍6.
    https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r

  3. fofr — compartilhou detalhes de prompt para recriar renderizações no estilo de jogos retrô com Nano Banana Pro (Gemini 3 Pro Image). 2026-01-19, 👍31.
    https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
    No mesmo dia, também publicou um prompt para gerar capturas de tela com aparência de Street View. 👍10.
    https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m

  4. Replicate (oficial) — anunciou que o “GPT Image 2” da OpenAI passou a estar disponível na Replicate. Destacou fotorrealismo, precisão na renderização de texto e pontos fortes em UI/design (código fechado). 2026-04-21.
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  5. Replicate (oficial) — anunciou a liberação para todos os usuários do modelo de geração de vídeo “Seedance 2.0” da ByteDance. Integra texto, imagem, vídeo e áudio numa única cena e gera áudio estéreo sincronizado (código fechado). 2026-04-09.
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  6. Replicate (oficial) — Gen-4.5 da Runway foi adicionado à Replicate. Modelo de geração de vídeo que enfatiza realismo físico (código fechado). 2026-02-18.
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  7. Replicate (oficial) — Kling 3.0 (+o3) da Kuaishou foi adicionado à Replicate. Compatível com 4K multishot e sincronização de áudio (código fechado). 2026-02-17.
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  8. Replicate (oficial) — o modelo de geração de vídeo “Vidu Q3” foi adicionado à Replicate. Compatível com geração a partir de texto, imagem e frames inicial/final, em até 16 segundos e 1080p (código fechado). 2026-03-11.
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

  9. Amanda Silberling (TechCrunch) — publicou um pedido de comentários de especialistas sobre por que imagens de comida geradas por IA tendem a ter uma aparência peculiar. Uma solicitação de entrevista sobre vícios estéticos na geração de imagens por IA. 2026-08-28, 👍17 · 🔁5 · 💬4.
    https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x

  10. AI News Updates (bot) — informou que “a Midjourney Inc. adquiriu o aplicativo de astrologia Co-Star e lançará um novo app de geração de imagens”. 2026-07-25. A informação coincide com reportagens da TechCrunch e Bloomberg (2026-07-24, afirmando que a aquisição foi concluída na primavera), portanto pode ser corroborada.
    https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s

  11. gigowat (compartilhamento em japonês de artigo da GIGAZINE) — compartilhou um artigo da GIGAZINE sobre a chegada do gerador aberto de imagens “Qwen-Image-3.0”, que testa sua capacidade de renderizar ilustrações e texto em japonês. 2026-07-22.
    https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
    (artigo original: https://gigazine.net/news/20260722-qwen-image-3/

  12. ostris — anunciou o lançamento do modelo aberto de geração de imagens “Flex.2-preview”, que integra texto para imagem, controle universal e inpainting. É um post mais antigo, de 2025-04-22, mas é um dos poucos exemplos de um desenvolvedor de modelos abertos comunicando-se diretamente no Bluesky. 👍4.
    https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a

Sinais
  • Vantagem dos modelos fechados: no Bluesky, os posts que efetivamente tiveram engajamento se concentraram em grandes modelos fechados, como GPT, Gemini/Nano Banana Pro e Midjourney. O “benchmark de imagens de pelicanos” de Simon Willison acompanha cada lançamento e se tornou, na prática, um espaço de verificação contínua da qualidade de modelos fechados de imagem.
  • A conta da Replicate é um hub de notícias rápidas sobre geração de vídeo: lançamentos de Kling 3.0, Seedance 2.0, Runway Gen-4.5 e Vidu Q3 em 2026 foram todos divulgados pela conta oficial da Replicate. Embora as curtidas sejam baixas, de uma a duas, ela é útil para acompanhar cronologicamente a ordem de chegada dos modelos.
  • A presença de projetos abertos no Bluesky é fraca: quase não foram encontradas menções primárias no Bluesky a grandes modelos abertos de 2026, como Wan 2.7 (Alibaba), HunyuanVideo 1.5 (Tencent), Chroma e LTX-2.3. O próprio ostris, desenvolvedor de uma ferramenta aberta de treinamento LoRA, escreveu que a comunidade de IA/ML “permaneceu quase toda no Twitter”, sugerindo que o centro da comunidade está concentrado no X.
  • Publicações em japonês se concentram em compartilhamentos da GIGAZINE: posts em japonês vieram sobretudo de republicações de artigos de sites de notícias como gigowat; não foram encontradas análises primárias independentes.
Limites
  • A API oficial de busca de posts do Bluesky (app.bsky.feed.searchPosts) sempre retornou 403 Forbidden à ferramenta WebFetch nesta sessão, impossibilitando coleta abrangente de posts por palavras-chave com contagens de curtidas e repostagens. Como getProfile, getAuthorFeed, getPostThread e oEmbed funcionaram normalmente, a pesquisa foi alterada para verificação individual de feeds de contas conhecidas, encontrados pelo Google.
  • A página de busca do próprio bsky.app é uma SPA renderizada por JavaScript; por isso, a WebFetch, que apenas converte HTML para Markdown, não conseguiu extrair o texto dos posts.
  • Devido a essas restrições, não foi possível fazer um levantamento abrangente de todos os posts correspondentes a modelos específicos. Foram extraídos itens relevantes de publicações recentes de contas conhecidas. Mais de 20 posts/feeds foram verificados no total, mas apenas cerca de 12 tinham relação direta com IA para imagens ou vídeos, listados acima.
  • Para modelos abertos como Wan, HunyuanVideo, Chroma, o próprio Z-Image e LTX-2.3, foram testadas várias contas no Bluesky, mas não foram encontrados posts relevantes de 2026. huggingface.bsky.social tinha o feed vazio, e civitai-bot.bsky.social não era atualizado desde maio de 2024.
  • Foi encontrado um post individual de fevereiro de 2026 sugerindo que a Midjourney teria se tornado parte do Meta.ai, mas a verificação em reportagens externas mostrou que se tratava de um acordo de licenciamento de agosto de 2025 — a Midjourney continuava independente —, portanto a informação imprecisa não foi incluída neste relatório.

Lemmy

Lemmy — Tendências recentes em IA para geração de imagens e vídeos (fechado/aberto)

Comunidades (Communities)
  • !«メールアドレス» — 5,708 pessoas. Discussões técnicas sobre IA aberta para geração de imagens e vídeos em geral. Foi a comunidade com maior densidade de informações nesta pesquisa.
  • !«メールアドレス» — 2,360 pessoas. Espaço para obras criadas com modelos da linha Stable Diffusion. Há poucas notícias propriamente ditas.
  • !«メールアドレス» — 1,593 pessoas. Exclusiva para arte de anime com IA. Baixa relevância jornalística.
  • !«メールアドレス» — 50 pessoas. Comunidade de republicação automática via RSS do Reddit, operada por bot. É importante observar que não se trata de discussão humana.
  • !«メールアドレス» e !«メールアドレス» — notícias de tecnologia em geral. Há poucos resultados dedicados exclusivamente à IA para imagens/vídeos, que acabam diluídos em artigos gerais sobre IA.
  • Não há no Lemmy uma grande comunidade dedicada exclusivamente à IA de geração de imagens/vídeos comparável a r/StableDiffusion do Reddit; o assunto está distribuído entre as comunidades menores acima.
Posts
Projetos abertos
  1. MiniMax H3: Comfy se torna revendedora oficial de licenças comerciais — !«メールアドレス», score 4, 2026-08-28. Artigo original: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3 é um modelo de geração de vídeo com pesos abertos, publicado em agosto de 2026, que roda localmente até em GPUs da classe RTX 3060 e gera vídeos 2K com áudio estéreo nativo. A Comfy tornou-se revendedora de licenças comerciais (Professional/Enterprise), e a Enterprise permite até o uso do modelo não destilado.
  2. LLaDA-Image: Construindo geradores de imagem fortes com receitas de treinamento totalmente abertas — !«メールアドレス», score 2, 2026-09-04. https://arxiv.org/abs/2609.03796 。Modelo de imagem com receita de treinamento totalmente publicada, desempenho de topo no Qwen-Image-Bench e versão Turbo destilada e rápida.
  3. Trellis.2 e Pixal3D recebem integração nativa ao ComfyUI — !«メールアドレス», score 4, 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。O anúncio afirma que “os melhores modelos abertos de geração 3D se tornaram parte do núcleo do ComfyUI”.
  4. ComfyUI-MiniMaxH3-CLSS — !«メールアドレス», score 0, 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。Ferramenta para MiniMax H3 que permitiria gerar vídeos com áudio de duração arbitrária mesmo em máquinas de consumidor com 16 GB de VRAM.
  5. Fizgig LoRA/LoKR Studio — !«メールアドレス», score 4, 2026-08-30. https://github.com/shootthesound/Fizgig 。Ferramenta aberta para treinar e extrair LoRA/LoKR de diversas famílias de modelos, como Krea 2, MiniMax e Klein 9B.
  6. VibeVoice-ComfyUI (integra o TTS aberto da Microsoft ao ComfyUI) — !«メールアドレス», score 1, 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。Um exemplo do movimento de integrar voz aos workflows de geração de vídeo.
  7. Boogu-Image-0.1 — Modelo fundamental eficiente para geração de imagens — !«メールアドレス», score 5, 2026-06-17. Modelo aberto de base para imagens, leve e voltado à eficiência.
Modelos fechados
  1. Midjourney deixa a IA de geração de imagens e faz guinada para scanners médicos de ultrassom — !«メールアドレス», score 58, 2026-06-18. https://lemmy.zip/post/66397234 。Diversas threads relacionadas, incluindo espelhos do Hacker News com score 40 ou mais, geraram amplo debate sobre “Midjourney Medical” e “Ultrasonic CT”. É uma das maiores notícias sobre a mudança de rumo de um serviço fechado veterano de geração de imagens.
  2. Midjourney exige que estúdios de Hollywood divulguem detalhes sobre uso de IA — !«メールアドレス», score 73, 2026-07-05. https://lemmy.today/post/56011946
  3. Lançado o novo modelo de geração de imagens do Google, “Nano Banana 2 Lite” — !«メールアドレス», score 0, 2026-07-02. https://lemmy.world/post/48936394(espelho Hacker News: https://lemmy.bestiver.se/post/1199483 )
  4. MAI-Image-2.5 da Microsoft se aproxima do Nano Banana 2 do Google em benchmarks — !«メールアドレス», score 1, 2026-05-28. https://lemmy.durstig.online/post/35068
  5. Análise comparativa prática do Seedream 5.0 Pro — !«メールアドレス», score 1, 2026-07-10. https://lemmy.durstig.online/post/46063
  6. Runway informa que seu negócio empresarial dobrou e que a retenção líquida de receita ultrapassou 300% — !«メールアドレス», score 0, 2026-08-30. https://lemmy.durstig.online/post/56937
  7. Função Earth AI do Google foi silenciosamente retirada um dia após o lançamento por problemas de geração NSFW — !«メールアドレス», score 1, 2026-08-07. https://lemmy.durstig.online/post/52162
Sinais (Signals)
  • O lado aberto está “todo em MiniMax H3”: quase metade das postagens da comunidade stable_diffusion entre o fim de agosto e o início de setembro de 2026 trata de extensões e ferramentas de aceleração do MiniMax H3 — geração de vídeo, execução local até em RTX 3060 e áudio integrado. Há uma sensação de que ele está se tornando o padrão de fato para vídeo aberto.
  • A fronteira entre aberto e fechado está nebulosa: MiniMax H3 tem “pesos abertos”, mas o uso comercial exige uma licença paga via Comfy. O modelo híbrido — gratuito para uso, pago para uso comercial — parece estar se tornando predominante.
  • A maior notícia do lado fechado é uma “saída”: mais do que a corrida por novos modelos, a história da Midjourney migrando de geração de imagens para dispositivos médicos — ou seja, uma das grandes empresas fechadas trocando de setor — teve scores muito superiores (58–73) e reuniu maior interesse no Lemmy.
  • A integração de geração 3D ao ComfyUI também avança: modelos abertos de texto/imagem para 3D, como Trellis.2 e Pixal3D, tornam-se recursos centrais do ComfyUI. Assim, a geração local passa a incorporar não apenas imagem e vídeo, mas também ativos 3D.
  • No Lemmy como um todo, não há uma grande comunidade exclusiva de IA para geração de imagens/vídeos. O tema se distribui entre comunidades técnicas de Stable Diffusion, com alguns milhares de pessoas, e comunidades pequenas de bots, como ai_reddit, que republicam artigos do Reddit.
Limitações (Limits)
  • Lemmy é federado e a API de busca cobre apenas o índice de uma instância. Assim, buscas pela API de lemmy.world deixam escapar posts de outras instâncias, como lemmy.dbzer0.com e lemmy.today. Nesta pesquisa, APIs e buscas de múltiplas instâncias foram combinadas, mas a cobertura não é completa.
  • A comunidade localllama de lemmy.ml retornou 404 na consulta direta de informações (/api/v3/community), portanto seus detalhes não puderam ser verificados.
  • !«メールアドレス» é uma comunidade bot que republica mecanicamente feeds RSS do Reddit; tem 50 inscritos e quase nenhuma discussão humana. Pode servir como fonte de notícias, mas não como indicador de intensidade de debate no Lemmy.
  • Buscas diretas no Lemmy por serviços fechados de geração de vídeo, como Sora, Kling AI, Veo e Runway Gen, trouxeram quase apenas itens irrelevantes, como nomes de lugares, pessoas ou notícias gerais. Não foram encontradas discussões concretas; para Runway, apareceu somente um item relacionado a resultados financeiros.
  • O volume de posts é muito menor do que em redes como Reddit, com scores geralmente de um dígito ou dezenas. O Lemmy, sozinho, não oferece massa suficiente para analisar 20 posts detalhadamente e falar de tendências. Nesta edição, foram executadas sete consultas relevantes em múltiplas instâncias e selecionados exemplos representativos entre os posts reais encontrados.

Pinterest

Pinterest — Notícias de IA para geração de imagens e vídeos

Temas visuais
  • O estilo de “miniatura do YouTube/capa de blog” é esmagadoramente predominante. Fundos pretos ou azul-marinho escuro, gradientes neon azul, roxo e laranja, e títulos grandes em fonte sem serifa (“AI NEWS”, “THE FUTURE IS AI”, “BREAKING NEWS”, “AI IS CHANGING EVERYTHING!” etc.). Há mais capas de artigos e vídeos sobre IA do que as próprias criações geradas [2, 7, 11, 38, 39, 42, 48]
  • Rostos e retratos humanos são o motivo central. Animação de expressões, lip sync, reprodução facial (Microsoft VASA-1) e ensaios fotográficos de retrato por IA com ChatGPT+Higgsfield aparecem repetidamente, simbolizando o uso de “animar/criar rostos” [13, 14, 18, 23, 50]
  • Visuais de humanoides e robôs são muito usados como símbolos genéricos de “IA”. Há muitas imagens de banco de uma cabeça de robô branca de perfil ou de mulheres com aparência ciborgue, sem relação com ferramentas concretas [2, 39]
  • Grades de “Antes/Depois” ou “uma imagem de entrada → múltiplas saídas de estilo”. Grades comparativas que transformam vídeo realista em madeira, origami, blocos de Lego ou flores, provavelmente usando uma ferramenta da linha Luma, e imagens que inserem personagens de pelúcia em fundos realistas [3, 31]
  • Infográficos de comparação e ranking de ferramentas. Listas com logotipos, tabelas de “melhor qualidade (pago) vs melhor gratuito” e comparações de recursos com marcas de verificação se destacam como imagens para salvar, ajudando a escolher ferramentas [7, 37]
  • Miniaturas com rostos de pessoas famosas reais ou similares. Retratos gerados por IA parecidos com Jeff Bezos, apresentadores com aparência de YouTuber e textos como “AI NEWS”, além de fotos de palestras de Jensen Huang da NVIDIA, são usados para transmitir credibilidade e gerar atenção [11, 36, 40]
  • Efeito de sobreposição de malha/wireframe facial. Grades e rótulos numéricos, sugerindo análise de expressões ou biometria, são sobrepostos a rostos e pescoços em pins publicitários [23, 50]
  • Consistência de paleta. Base escura com acentos neon em ciano, magenta e amarelo é praticamente a linguagem visual comum a todos os pins sobre ferramentas de IA [2, 7, 38, 39, 42]
Pins notáveis
  1. [1] IA de imagem para vídeo: como funciona e por que importa — capa de artigo explicativo que ilustra como uma única imagem estática gera uma “linha do tempo de vídeo” com múltiplos frames.
  2. [3] Google anuncia vídeo de qualidade ultra-alta... (na prática, demonstração de transformação de estilo com preservação de identidade, na linha Luma) — grade 3×5 que transforma um vídeo de origem em materiais como madeira, origami, Lego e flores. É uma demo clara de tecnologia que altera somente a textura, mantendo a consistência da mesma pessoa e do mesmo carro.
  3. [7] Mais de 6 melhores sites de geração de vídeo por IA — infográfico para salvar que lista Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI e Hailuo AI, incluindo recursos, público-alvo e disponibilidade de plano gratuito.
  4. [10] Veo 2 — pin promocional do VideoFX do Google. Reúne numa imagem um corte fotorrealista de microscópio, um nadador submerso e uma mulher animada dançando com constelações, entre diversos estilos de vídeo.
  5. [14] Veo 3 de imagem para vídeo: geração rápida e áudio nativo pela API Gemini — imagem promocional que destaca a geração de imagem para vídeo pela API Gemini e suporte nativo a áudio.
  6. [23] Microsoft apresenta VASA-1 — tecnologia que gera, quase em tempo real, vídeos expressivos de rostos falantes usando apenas uma foto, um clipe de áudio e sinais de controle arbitrários. A miniatura reúne rostos de múltiplas etnias e expressões.
  7. [27] ShengShu Technology apresenta Vidu S1 — pin de anúncio do Vidu S1 da chinesa ShengShu Technology, que promete “geração interativa em tempo real”, com visual de personagem cyberpunk.
  8. [31] Google anuncia a IA de geração de vídeo ‘Veo 3’ — conjunto de quatro exemplos que insere uma imagem de entrada, um bicho de pelúcia roxo, em salas de servidores realistas, ruínas subaquáticas e uma cidade de doces.
  9. [33] ‘Amuse 3.0’, ferramenta de criação de arte por IA — anúncio de nova versão de uma ferramenta de geração de imagens local, baseada em Stable Diffusion, oferecida pela AMD. Em meio à predominância de soluções fechadas, é um dos poucos sinais concretos de ferramentas locais ou abertas.
  10. [42] Últimas notícias: desenvolvimentos recentes em IA — resumo de três notícias: recursos de agente do Grok 4.6, Gemini ultrapassando um bilhão de usuários e gerando 150 milhões de imagens por dia, e o telefone robótico com IA da Honor, datado de 12 de agosto de 2026.
Sinais
  • Os modelos fechados têm presença marcante. Grandes anúncios de Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6 e Gemini, que superou um bilhão de usuários, tornam-se diretamente temas de pins. Já nomes típicos de código aberto, como Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo e LTX, praticamente não aparecem nas imagens amostradas, com exceção do Amuse 3.0 [33], ferramenta local da AMD. É provável que o Pinterest esteja mais voltado a conteúdo de resumo/comparação para consumidores e profissionais de marketing do que a comunidades técnicas.
  • Concentração em usos para animar e criar rostos. Lip sync, reprodução de expressões, substituição de ensaios fotográficos de retrato e vídeos de IA no estilo de apresentador surgem repetidamente. Isso provavelmente resulta do cruzamento entre a demanda de busca do Pinterest — beleza, autoimagem e ideias para redes sociais — e o marketing de vídeo por IA.
  • Resumos secundários predominam sobre informação primária. Há mais miniaturas no formato “rosto de apresentador + texto” e infográficos comparativos do que capturas de tela de resultados reais dos modelos. O Pinterest parece funcionar mais como porta de entrada para blogs, vídeos do YouTube e artigos de afiliados do que como ponto de disseminação de anúncios primários.
  • Sinal de ausência: não foram vistos, dentro da amostra, pins que citassem postagens japonesas ou empresas japonesas, como startups locais de IA ou serviços domésticos de geração de vídeo. Ferramentas e notícias do mundo anglófono ocupam quase todo o material.
Limites
  • Das 50 entradas de output/pinterest.pins.md, 24 imagens foram abertas e examinadas levando em conta representatividade; as 26 restantes foram avaliadas apenas por título, presumindo que seguem padrões visuais semelhantes aos das imagens abertas — infográficos, retratos e comparações de ferramentas.
  • Oito pins não tinham título, marcados como “(untitled)” ([12, 19, 20, 30, 35, 39, 46, 50]). As imagens [39] e [50] foram verificadas, mas as demais não.
  • Os dados coletados pelo worker nesta etapa não têm divisão por gênero; pinterest.pins.md é uma lista plana, portanto não foi feita uma divisão por categoria.
  • O Pinterest não foi navegado diretamente nesta etapa. Conforme o playbook, a análise foi feita somente a partir das imagens e títulos previamente coletados pelo worker. Métricas de engajamento — curtidas, salvamentos e comentários — não estavam disponíveis nos dados.

Ações recomendadas

  • Refazer a busca no X com termos explícitos de modelos/ferramentas, como Stable Diffusion, ComfyUI, Flux, Wan, Kling e Sora, em vez de depender da lista de tendências.
  • Criar uma lista permanente de contas conhecidas do Bluesky para consultar via getAuthorFeed, já que app.bsky.feed.searchPosts retornou 403 nesta execução.
  • Identificar explicitamente modelos híbridos de aberto/comercial, como MiniMax H3, em vez de classificá-los sob um único rótulo de código aberto.
  • Manter um item recorrente de monitoramento para grandes guinadas ou encerramentos de fornecedores, como a mudança médica da Midjourney e o fim de vida da API do Sora, pois atraíram mais atenção no Reddit e no Lemmy do que anúncios puros de produtos.
  • Tratar o Pinterest como medidor de sentimento do consumidor, e não como feed técnico de fonte primária, dada sua quase total falta de cobertura de código aberto.

Imagens coletadas

IA de imagem para vídeo: como funciona e por que importa - The Data Scientist🎨 Criação de imagens e vídeos com IAGoogle anuncia vídeo de qualidade ultra-alta...Preocupações sobre conteúdo de IA e redes sociaisA plataforma definitiva de geração de imagens e vídeos por IA - The Data ScientistConceito de criação de conteúdo por IA com ícones para geração de texto, imagem, música e vídeo — veja 57 fotos, vetores e vídeos de bancoÉ só acertar 🎥️ IA de imagem para vídeo — anime suas fotos com IACriação de conteúdo em vídeo com IA: grandes rendimentos,...Google apresenta Veo 2: ferramenta avançada de geração de vídeo por IA com mais realismo e recursos cinematográficosNotícias de IA: a OpenAI finalmente lançou o que pedimosimagemCrie ensaios fotográficos fotorrealistas de si mesmo com ChatGPT + Higgsfield 📸🤖Veo 3 de imagem para vídeo: geração rápida e áudio nativo pela API GeminiTop 10 ferramentas de lip sync (2026) – melhor software de lip sync por IA para vídeos realistasPrincipais geradores de vídeo por IA de 2025IA para geração de imagens e vídeos‎🚨 A IA está ficando assustadoramente boa.imagemimagemAnálise de imagens e vídeos orientada por IAMais de 20% do YouTube agora é gerado por IAMicrosoft apresenta VASA-1, estabelecendo novos padrões para IA generativa na geração de vídeoVídeos gerados por IA: bons ou ruins? Aqui está a verdade! 🤖🎥ferramentas de IAO que é Imagvio AI e como ajuda criadores...ShengShu Technology apresenta Vidu S1, trazendo geração interativa em tempo real para vídeo por IADominando vídeo e IA: principais tendências de marketing em redes sociais em 2025"Transforme sua visão com vídeos 4K personalizados movidos por IA 🎥✨"imagemGoogle anuncia a IA de geração de vídeo ‘Veo 3’,...história da IA generativa‘Amuse 3.0’, uma ferramenta de criação de arte por IA que inclui...Notícias de IA desta semana - 15 de agosto de 2026imagemVou fazer um explicador de criação de vídeo por IA com synthesia sora ai kling ai runway ai invideo🚀10 melhores ferramentas de imagem e vídeo por IA em 2026 | comparação entre ferramentas gratuitas e pagasNotícias de IA e últimas atualizações | tendências e avanços em inteligência artificialimagemNovas ferramentas de IA da Nvidia 🤯 #news #ai #openai #chatgpt #highlights #shortsCrescimento do mercado de geradores de vídeo por IA 2025–2032: transformando o futuro da criação de vídeo 🎥🤖Últimas notícias: desenvolvimentos em IA - Grok 4.6 Gemini 1B Honor Robot PhoneTransforme suas ideias em visuais impressionantes! 🎥Criação profissional de vídeos por IA | vídeos cinematográficos por IA | edição personalizada de vídeoGeração de imagens por IAimagemGeração de vídeo 📹"Por que chatbots de IA falham em acompanhar notícias de última hora"Como criar um canal de notícias com IA || gerador de vídeo de notícias por IA || lip sync com IAimagem

Nota sobre a qualidade dos dados

X e Bluesky ficaram muito abaixo da meta de cerca de 20 posts por plataforma do briefing (o X mostrou apenas 4 posts pertinentes, todos de código fechado; a API de busca do Bluesky retornou 403, portanto a cobertura dependeu de contas conhecidas). Reddit, Lemmy e YouTube também coletaram menos itens do que o alvo, e o YouTube não conseguiu confirmar visualizações ou inscritos devido às páginas renderizadas por JavaScript.

Galeria