KEN’S CAT LOG

Notícias de IA para Geração de Imagens e Vídeos — 2026-09-23

A IA fechada de imagens/vídeos está recuando com força (a API do Sora 2 será encerrada em 2026-09-24, o Midjourney está migrando para dispositivos médicos, e há reação negativa aos preços do Grok Imagine/Seedance), enquanto ferramentas de código aberto construídas em torno do ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) estão discretamente se tornando a opção padrão para trabalho de produção real.

IA de geração de imagens e vídeos: a linha de frente entre open source e fechado está quente demais — 2026-09-23

Nossa, fui olhar e este momento está realmente muito interessante 🔥 Enquanto o pessoal de código fechado (Sora 2, Midjourney, Grok Imagine etc.) faz lançamentos chamativos, nos bastidores está recuando, aumentando preços e mudando de direção a todo vapor — sinceramente, parece que começou a vacilar 😳 Por outro lado, o pessoal open source (Wan, FLUX.2, Qwen-Image, HunyuanVideo) está se concentrando no hub que é o ComfyUI e, sem muito alarde, está entrando de verdade nos fluxos de produção profissional 💪 Depois de olhar Reddit, X, YouTube, Bluesky, Lemmy e Pinterest, o desenho ficou bem claro: “notícias chamativas = fechado”, “uso prático consistente = aberto”. E, na opinião pública, também está crescendo muito a pressão para que conteúdos gerados por IA sejam identificados como tal 📢

Entre plataformas

  • A desaceleração e mudança de rumo das plataformas fechadas foram confirmadas em várias redes. No YouTube, foi apresentado que o Sora 2 encerrará o aplicativo após apenas meio ano (2026-04-26) e que a API também deve ser encerrada no dia seguinte à pesquisa, 2026-09-24; segundo a reportagem, frente a custos operacionais de cerca de US$ 1 milhão por dia, a receita acumulada de assinaturas foi de apenas US$ 2,1 milhões (https://www.youtube.com/watch?v=bIL7uU4CYnE). No Lemmy, a mesma notícia sobre o fim da API do Sora foi compartilhada via espelho do r/ArtificialInteligence (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/) e contrastada com a captação de US$ 3 bilhões pela chinesa Kuaishou (Kling), reforçando a narrativa de que “o trabalho corporativo discreto é que dá dinheiro”.
  • O open source aparece em toda parte como “infraestrutura de trabalho” centrada no ComfyUI. No Reddit (ComfyUI + FramePack permite gerar vídeo mesmo em PCs modestos), no Lemmy (duas extensões do ComfyUI para MiniMax H3 na última semana) e no YouTube (tutoriais em série de execução local de Wan/HunyuanVideo/LTX), ComfyUI e a família Wan surgiram independentemente como palavras-chave em três plataformas.
  • A insatisfação com o excesso de cobrança está se voltando às plataformas fechadas. No Reddit, surgiram três tópicos procurando “gerador de vídeo por IA gratuito” (em razão da redução das cotas gratuitas de serviços fechados), e no Bluesky um artista de Tóquio lamentou repetidamente que o preço do Seedance 2.5 é “devastating” (https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e).
  • Há fadiga de comparação entre consumidores: “qual ferramenta eu uso?” No YouTube, vídeos comparando Sora 2 vs Seedance 2.0 vs Runway se tornaram padrão; no Pinterest, matrizes de decisão “Melhor qualidade vs melhor gratuito” também tiveram muita repercussão (YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10). Está crescendo um público menos interessado em defender um único modelo e mais em saber qual é o melhor agora.
  • A desconfiança em relação ao conteúdo de IA e o clima favorável à obrigatoriedade de identificação são comuns a várias plataformas. Um tópico do Reddit propondo legislação teve 13.841 comentários, de longe o maior volume de debate entre os itens coletados (https://www.reddit.com/r/CriticalState/comments/1wmktek/). No Pinterest, imagens de carimbos “FAKE” e selos de detecção de IA já se consolidaram como um gênero próprio.

Por plataforma

Reddit — Dos 12 tópicos coletados, apenas 4 vieram de comunidades especializadas em IA de geração de imagens e vídeos; o restante veio de subreddits gerais, no padrão “encontrei conteúdo de IA / isso me irrita”. Enquanto a procura por geração local e gratuita de vídeo reaparece repetidamente, o DeepSeek (pesos abertos) mostrou um caso incomum em que o crescimento rápido de usuários (DAU de 120 milhões para 200 milhões) superou a expansão de computação e reduziu a qualidade — um cenário de “o open source quase se autodestrói por ficar popular demais” (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/).

X — Entre contas predominantemente japonesas, houve uma onda de demos de “geração em uma tentativa” com Claude Opus 5.5 e Grok 4.7. @cherry_mx_reds, @NFT_Chen, @riku720720 e @chetaslua publicaram demos distintas praticamente no mesmo período (21–22/9), com cara de uma rodada coletiva de testes logo após o lançamento. Do lado aberto, chamaram atenção postagens de desenvolvedores independentes como @shinshin86 e @GeekCatX exibindo números de estrelas no GitHub. Porém, mais de 20 dos 40 itens coletados eram ruído sem relação com o tema, oriundo de palavras em alta exclusivas do X.

YouTube — Foi onde a informação esteve mais concentrada. A ascensão e queda do Sora 2 (anúncio triunfal → retirada em seis meses) foi o maior tópico, enquanto a disputa de atualizações entre Nano Banana 2, GPT Image 2.5 e Midjourney V8 continua. No campo aberto, Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) e Lightricks (LTX) são os principais campos de batalha, e o ComfyUI se firmou como o “painel de conexões” que recebe novos nós continuamente.

Bluesky — Não há um hub forte e especializado em IA de geração de imagens ou vídeos; contas oficiais (Stability AI, Midjourney, Runway etc.) estão praticamente inativas. A única pessoa a publicar de forma contínua foi @ethanhe, da xAI. Porém, a API de busca de texto completo retornou 403 durante toda a pesquisa, então a investigação ficou restrita à navegação por contas já conhecidas.

Lemmy — Embora seja pequeno (mesmo a comunidade principal tem apenas 5.713 pessoas), as postagens em torno do ComfyUI em !«メールアドレス» tinham alta densidade de informação. No lado fechado, notícias de “retirada e mudança de rumo” — fim da API do Sora, migração do Midjourney para equipamentos médicos e retirada imediata do Earth AI do Google — chamaram muita atenção; havia mais histórias de correção de rota do que de lançamentos chamativos.

Pinterest — Em vez de notícias, predominam imagens no estilo de miniaturas “AI NEWS”, gráficos comparativos e visuais de alerta sobre deepfakes. O open source quase não apareceu, exceto pelo “Amuse 3.0” da AMD. Em compensação, a insegurança do consumidor sobre “qual escolher?” e a cautela com conteúdos de IA surgiram com força como gêneros visuais.

Pontos de atenção

Ações recomendadas

  • Com o aumento de preços e as retiradas de ferramentas fechadas, continuar acompanhando a pilha OSS Wan, HunyuanVideo, FLUX.2 e ComfyUI + MiniMax H3 como principal alternativa prática.
  • Antecipar o clima favorável à obrigatoriedade de identificação de conteúdo de IA, que se fortalece no Reddit e Pinterest, preparando uma política de indicação de origem do conteúdo.
  • Após o fim da API do Sora 2 (24/9), acompanhar para onde os usuários migram — Kling, Seedance e Runway são destinos prováveis.
  • Tratar a onda de demos de geração em uma tentativa de Opus 5.5/Grok 4.7 no X como hype breve de janela de lançamento, sem superestimar sua ameaça à relevância do OSS.
  • Observar limites de infraestrutura própria quando pesos abertos se tornam rapidamente populares, como no DeepSeek, como indicador antecipado de restrições de oferta.
  • Para atender à fadiga de “comparar e decidir” evidente no YouTube e Pinterest, criar pontos de contato com conteúdo comparativo, e não apenas notícias de produtos isolados.

Qualidade dos dados

Apenas YouTube e Pinterest chegaram aproximadamente ao critério de conclusão de analisar cerca de 20 itens por rede (20 e 50 itens coletados, respectivamente); as demais plataformas tiveram lacunas. O Reddit parou em 12 tópicos, dos quais somente 4 vieram de subreddits especializados. O X coletou 40 posts, mas mais da metade era ruído de palavras em alta sem relação com o tema; cerca de 11 incidiam diretamente no assunto. No Bluesky, a API de busca de texto completo retornou 403 durante todo o período, restando apenas a navegação por contas conhecidas, com 10 itens coletados. O Lemmy é uma plataforma pequena por si só (a comunidade principal tem 5.713 pessoas), tornando inviável atingir 20 itens; além disso, metade era reprodução espelhada do Reddit. No Pinterest, somente 26 das 50 imagens foram verificadas visualmente, e não foi possível obter métricas de engajamento como curtidas.

Resumo por plataforma

Reddit

Reddit — Notícias de IA para geração de imagens e vídeos

Onde (subreddits)

Os 12 tópicos coletados estão distribuídos em 10 subreddits. Comunidades especializadas em IA de geração de imagens e vídeos são minoria; os demais eram tópicos gerais que mencionavam ou reclamavam de conteúdo criado por IA.

Subreddit Número de membros Tópicos coletados
r/generativeAI 156,181 3
r/mildlyinfuriating 12,586,808 1
r/aivideomaking 7,498 1
r/CriticalState 39,096 1
r/Instagramreality 1,155,566 1
r/Purdue 100,731 1
r/DeepSeek 140,681 1
r/ImagineAiArt 19,446 1
r/youngpeopletiktoks 8,226 1
r/youtube 3,459,719 1

Apenas r/generativeAI, r/aivideomaking, r/DeepSeek e r/ImagineAiArt são especializadas em IA generativa (4 tópicos). Os outros 8 tópicos vieram de subreddits gerais, no contexto de “encontrei conteúdo de IA / isso me irritou”.

Reação das pessoas
  • A busca por geradores de vídeo por IA gratuitos se repetiu em três tópicos diferentes (tópico #2 “Which AI video generator can still be used for free?” r/generativeAI · 20pt · 73 comentários · 2026-09-16 / tópico #3 “Looking for a free AI video generator” r/aivideomaking · 7pt · 28 comentários · 2026-09-20 / tópico #10, mesmo título, r/generativeAI · 4pt · 28 comentários · 2026-09-20). Como os serviços fechados avançam em direção à cobrança, u/RioMetal (+4) recomendou soluções open source: “se puder rodar localmente, há Wan ou Minimax à vontade”.
    https://www.reddit.com/r/generativeAI/comments/1whtesl/
  • Insatisfação com “tudo que a IA recomenda agora ser pago” (tópico #2, texto do post). É uma reação típica à redução das cotas gratuitas nas soluções fechadas.
    https://www.reddit.com/r/generativeAI/comments/1whtesl/
  • Medidas práticas para uso local e open source: u/AztecWheels (+2, tópico #3) respondeu que, instalando FramePack pelo Pinokio, é possível fazer conversão imagem → vídeo mesmo em PCs modestos (sem áudio, de 1 a 120 segundos). A combinação ComfyUI + FramePack é citada como padrão para geração open source de vídeo em ambientes com pouca capacidade.
    https://www.reddit.com/r/aivideomaking/comments/1wled0f/
  • Reação contra “pedir tudo de graça”: u/activematrix99 (+2, tópico #3): “É como exigir uma refeição grátis num restaurante. As empresas investiram bilhões nessa tecnologia.” Também há forte resistência aos pedidos por gratuidade, e a comunidade está dividida.
    https://www.reddit.com/r/aivideomaking/comments/1wled0f/
  • Crescimento acelerado do DeepSeek (pesos abertos) e falta de computação: segundo o texto do tópico #7 “some deepseek news, if you care” (r/DeepSeek · 292pt · 45 comentários · 2026-09-21), os DAUs do DeepSeek passaram de 120 milhões para 200 milhões (+66,7%), enquanto sua capacidade de computação subiu apenas 8,3%, levando a piora de qualidade e falhas de regeneração. Como resposta, teria encomendado 160 mil Ascend 960DT da Huawei. u/Equivalent-Grass-527 (+13): “o descompasso entre demanda e recursos computacionais é a explicação mais convincente para a degradação recente”.
    https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
  • Debate GPT Image 2.5 Flare (fechado) vs KREA 2 (aberto): tópico #9 “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (r/ImagineAiArt · 93pt · 62 comentários · 2026-09-16). u/Dependent_Quit_3730 (+3, em português): “um modelo perfeito para quem quer facilidade, mas eu ainda uso KREA 2”; u/SeaworthinessFresh16 (+2): “os resultados de ComfyUI + Krea2 parecem os mesmos”. Apesar da visibilidade do novo modelo fechado, há quem perceba pouca diferença prática em relação aos modelos abertos.
    https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/
  • Forte reação contra fotos de imóveis geradas por IA: tópico #1 “It should be illegal to post AI-generated "inspirational" images in house listing photos.” (r/mildlyinfuriating · 25,962pt · 706 comentários · 2026-09-21, maior pontuação entre os tópicos coletados). u/BojackWorseman13 (+1.128): “se eu fosse corretor, mandaria reclamações sem parar nas redes sociais; mesmo que não seja ilegal, deveria haver uma identificação grande informando que foi gerado por IA”.
    https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/
  • Proposta legislativa pedindo identificação obrigatória de conteúdo de IA: tópico #4 “[Law Proposal] Every ai generated image and text must need to have watermark.” (r/CriticalState · 1,246pt · 13,841 comentários · 2026-09-21, o maior número de comentários da coleta). Os comentários mais votados apoiam a proposta, como u/Timedforfun +16: “não é algo que deva ser escondido; vote a favor”.
    https://www.reddit.com/r/CriticalState/comments/1wmktek/
  • Imagens de IA impossíveis de distinguir para o público geral viralizam: tópico #5 “AI generated images on Reddit with thousands of upvotes and comments” (r/Instagramreality · 2,148pt · 343 comentários · 2026-09-18). u/Habibti-Mimi81 (+146): “eu não teria percebido; o canto do azulejo cinza foi a única pista. É uma época triste e perigosa”.
    https://www.reddit.com/r/Instagramreality/comments/1wk0euk/
  • Imagens de IA usadas até em materiais oficiais de universidade e criticadas como ‘slop’: tópico #6 “AI generated image on MSEE wall” (r/Purdue · 139pt · 19 comentários · 2026-09-21). Texto do post: “não conseguiram contratar um designer gráfico? Não há como escapar de AI slop em lugar nenhum”.
    https://www.reddit.com/r/Purdue/comments/1wmq43f/
  • Conteúdo de IA em vídeo, como o gerado por Sora, chega a subreddits de reposts do TikTok: tópico #11 “another ai generated grounded video” (r/youngpeopletiktoks · 81pt · 35 comentários · 2026-09-19). u/Pretend-Goat-8065 (+5) identifica diretamente o produto fechado: “Another Sora ai🫩”.
    https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/
  • Reação contra capítulos gerados automaticamente por IA no YouTube: tópico #12 (r/youtube · 3pt · 22 comentários · 2026-09-17). u/avatar0027 (+2): “capítulos gerados automaticamente a partir da transcrição passaram a aparecer de forma mais agressiva. Não há uma maneira de o espectador desativá-los em massa; apenas o criador pode desativá-los individualmente”. Não é geração de vídeo em si, mas é evidência adicional da fadiga com a expansão de recursos de IA.
    https://www.reddit.com/r/youtube/comments/1wiqamq/
Sinais
  • Em alta: a demanda por geração de vídeo gratuita e local (Wan 2.2, Minimax H3, ComfyUI + FramePack) aparece repetidamente em três tópicos independentes. A elevação de preços e a cobrança nos serviços fechados estão impulsionando o interesse em open source.
  • Em alta: opinião pública exigindo “identificação obrigatória” de conteúdo gerado por IA (o tópico #4 tem 13.841 comentários, o maior volume de debate da coleta). Em todo o Reddit, regulações e transparência geram muito mais engajamento que a corrida por desempenho dos modelos.
  • Subestimado: resistência à própria exigência de “me dê de graça” (u/activematrix99 e outros). Há uma visão fria de que não é natural esperar uso sem custo, portanto não há consenso.
  • Surpresa: o relato de que o DeepSeek (pesos abertos), enquanto ganha usuários rapidamente, sofre perda de qualidade por falta de computação (tópico #7). Em vez do eixo aberto/fechado, discutiu-se um novo tipo de restrição de oferta: “o modelo aberto ficou popular demais e sua própria infraestrutura não acompanha”.
  • Divergência de opinião: no tópico #9, os comentários se dividem entre o novo modelo fechado GPT Image 2.5 Flare e o KREA 2 aberto; várias pessoas disseram que “o fechado tem mais assunto, mas não há diferença perceptível”.
Limitações
  • O critério de conclusão do briefing era analisar cerca de 20 posts em cada rede, mas reddit.threads.md/.json continham apenas 12 tópicos (com apenas uma expressão de busca: “Image and Video Generation AI News”). Como a política do worker era ler dados já coletados, não foram feitas buscas adicionais.
  • Dos 12 itens, somente 4 vieram de comunidades especializadas em IA de geração de imagens/vídeos (r/generativeAI, r/aivideomaking, r/DeepSeek, r/ImagineAiArt). Os 8 restantes eram tópicos derivados de subreddits gerais sobre “encontrei conteúdo de IA”; quase não havia tópicos de “notícias” centrados em novos produtos ou atualizações de código fechado/aberto.
  • Principais subreddits especializados, como r/StableDiffusion, r/midjourney, r/runwayml e r/aivideo, não apareceram nenhuma vez no conjunto coletado.
  • O texto do post do tópico #9 (GPT Image 2.5 Flare) termina no meio do prompt completo; não foi possível verificar o restante nem a imagem anexada.
  • Por restrição, não foi possível navegar livremente pelo Reddit; a investigação não cobriu além desses 12 itens, outras consultas ou aprofundamento em outros tópicos.

X

X — Notícias de IA para geração de imagens e vídeos

No X (Twitter), demos de geração de vídeo e animação com “Claude Opus 5.5” e “Grok 4.7” estão em alta, sobretudo entre contas japonesas, enquanto mais da metade dos 40 posts coletados não tinha relação com o tema (detalhes em Limits abaixo).

Contas
  • @cherry_mx_reds(Tak) — Foi a conta mais presente na coleta. Publicou uma animação “Oktoberfest” gerada em uma tentativa pelo Opus 5.5 (373 curtidas) e uma cena 3D feita pelo Grok 4.7 no Blender (1.636 curtidas · ~410.000 visualizações). Testou demos de dois modelos diferentes, posicionando-se como conta que narra comparações.
  • @NFT_Chen(SuSu_酥酥) — Publicou uma demo em que o Opus 5.5 usou código para gerar uma animação quadro a quadro com aparência desenhada à mão (151 curtidas · ~40.000 visualizações). Foi um post único, mas com explicação detalhada e boa circulação.
  • @chetaslua — Publicou um caso de geração de vídeo interativo com Opus 5.5 usando apenas JS, sem assets, MCP ou skills (435 curtidas). Uma demo técnica, mais orientada à implementação.
  • @riku720720(Rikuo) — Publicou uma geração de animação em pixel art com Opus 5.5 (173 curtidas), compartilhando o prompt nas respostas: abordagem de compartilhamento prático.
  • @old_pgmrs_will(operador do NeuralWire.org) — Publicou duas postagens sobre Grok 4.7. Uma mostra geração automática de aplicativo de retoque fotográfico e recurso de demo (8 curtidas); a outra rebate críticas ao Grok-4.7 e relata melhorias de UI em um app de edição de vídeo (8 curtidas). Apesar da escala pequena, é uma conta de notícias de IA com publicação contínua.
  • @shinshin86(desenvolvedor do AITuber OnAir) — Autor do relatório de mais de 60 estrelas no GitHub para a ferramenta open source “Still2Rig PSD” (imagem estática → separação automática de camadas em PSD), com 586 curtidas e ~28.000 visualizações.
  • @ishitaku39(いしたく) — Apresentou “ARDY Mini”, uma versão derivada que um desenvolvedor independente reduziu para rodar no navegador a partir do modelo de pesquisa NVIDIA “ARDY” (226 curtidas).
  • @GeekCatX(知识猫AI实验室) — Relatou mais de 2.000 estrelas no GitHub para a ferramenta open source “Hand-drawn Video Skill” (story-to-handdrawn-video), com 103 curtidas, e compartilhou mudanças da atualização após um mês.
  • @so_ainsight — Postagem semanal com repositórios de IA em alta no GitHub (573 curtidas · ~49.000 visualizações). É uma compilação transversal, não limitada à geração de imagens e vídeos, relevante apenas como contexto.
Posts
Código fechado (Opus 5.5 / Grok 4.7)
  1. #1 @riku720720 — 173 curtidas · 19 reposts · 1 resposta · cerca de 19.000 visualizações · 2026-09-22. https://x.com/riku720720/status/2102515055116063144

    opus 5.5, isto é realmente absurdo... ele gerou esta animação em pixel art em menos de 5 minutos.
    O núcleo da postagem é a surpresa com a velocidade: uma animação em pixel art gerada em uma tentativa em menos de cinco minutos.

  2. #2 @NFT_Chen — 151 curtidas · 20 reposts · 13 respostas · cerca de 40.000 visualizações · 2026-09-22. https://x.com/NFT_Chen/status/2102455102896509431

    Isto não foi desenhado por uma pessoa! Claude Opus 5.5 usou código para desenhar esta animação à mão, quadro a quadro. ... 32 segundos, tudo gerado por IA.
    O ponto de surpresa é o próprio método de geração: stop motion com aparência desenhada à mão por código.

  3. #3 @cherry_mx_reds — 373 curtidas · 17 reposts · 10 respostas · cerca de 36.000 visualizações · 2026-09-21. https://x.com/cherry_mx_reds/status/2102493303388475855

    Opus 5.5 gerou esta animação “Oktoberfest” em uma tentativa, em 14m e 48s
    Enfatiza “one-shot” (geração em uma tentativa), registrando o tempo concreto de 14 minutos e 48 segundos.

  4. #4 @chetaslua — 435 curtidas · 23 reposts · 10 respostas · cerca de 20.000 visualizações · 2026-09-22. https://x.com/chetaslua/status/2102501773705670994

    Geração interativa de vídeo no estilo artístico que você quiser, com @claudeai Opus 5.5 codificado sem assets, mcp, skill, apenas js
    Uma demo técnica que destaca a leveza da implementação: vídeo interativo apenas com JS, sem assets, MCP ou skills.

  5. #17 @AbhinavXJ — 57 curtidas · 2 reposts · 2 respostas · cerca de 3.200 visualizações · 2026-09-22. https://x.com/AbhinavXJ/status/2102473742723260606

    disseram para acompanhar a fronteira e agora temos Grok 4.7, Claude Opus 5.5, GPT-6 sol e luna no espaço de 2 dias
    Não trata de um modelo isolado, mas da reação à velocidade do setor: vários modelos importantes lançados em dois dias.

  6. #19 @cherry_mx_reds — 1.636 curtidas · 215 reposts · 127 respostas · cerca de 410.000 visualizações · 2026-09-21.
    https://x.com/cherry_mx_reds/status/2102098340699668865

    Grok 4.7 fez isto no blender. Não disse a ele o que fazer, apenas que deveria ser algo que pudesse realizar em cerca de 10 minutos.
    A demo de IA generativa com maior engajamento da coleta. O caráter novo está em avançar para geração 3D dentro do Blender.

  7. #18 @old_pgmrs_will — 8 curtidas · 0 reposts · 0 respostas · cerca de 611 visualizações · 2026-09-21. https://x.com/old_pgmrs_will/status/2102182047989338264

    Gere com o Grok 4.7 um aplicativo de retoque fotográfico para meu próprio uso. Também fiz ele implementar uma função de demo automática para mostrar a operação real.
    Relato de uso prático: criação de aplicativo pessoal e função de demonstração.

  8. #20 @old_pgmrs_will — 8 curtidas · 0 reposts · 0 respostas · cerca de 599 visualizações · 2026-09-22. https://x.com/old_pgmrs_will/status/2102376309020299517

    Vejo posts, sobretudo de gente de fora, dizendo algo como “Grok-4.7 não presta”, mas ou são haters ou não sabem usar.
    Há vozes negativas sobre o Grok 4.7, mas o autor rebate dizendo que vem avançando na UI/UX de seu aplicativo de edição de vídeo por IA. A avaliação está dividida.

Open source
  1. #33 @shinshin86 — 586 curtidas · 59 reposts · 2 respostas · cerca de 28.000 visualizações · 2026-09-21. https://x.com/shinshin86/status/2102163713679577301

    A ferramenta de IA “Still2Rig PSD”, que cria PSD a partir de imagens estáticas, ultrapassou 60 estrelas no GitHub... Ao entregar uma imagem e pedir a agentes de IA como Codex, eles executam See-through no Google Colab, separam as camadas e montam o PSD.
    Ferramenta OSS de um desenvolvedor independente ultrapassou 60 estrelas no GitHub. Sua característica é a integração com agentes de IA.

  2. #34 @ishitaku39 — 226 curtidas · 22 reposts · 3 respostas · cerca de 9.800 visualizações · 2026-09-21. https://x.com/ishitaku39/status/2102038146489946532

    Consegui gerar movimentos do personagem em tempo real de acordo com os comentários... Integrei “ARDY Mini” ao meu AITuber. É uma versão derivada do modelo de pesquisa NVIDIA “ARDY”, otimizada por um desenvolvedor independente para rodar no navegador.
    Exemplo de aplicação prática pela comunidade OSS: uma versão leve de modelo de pesquisa da NVIDIA capaz de rodar no navegador.

  3. #35 @GeekCatX — 103 curtidas · 18 reposts · 4 respostas · cerca de 7.800 visualizações · 2026-09-22. https://x.com/GeekCatX/status/2102336276230025224

    Hand-drawn Video Skill foi atualizado novamente! ... as estrelas do GitHub para story-to-handdrawn-video agora ultrapassaram 2.000. Desta vez, o foco é adicionar mais estilos artísticos.
    A ferramenta OSS “story-to-handdrawn-video” ultrapassou 2.000 estrelas. O destaque da atualização é a adição de estilos artísticos.

  4. #36 @so_ainsight — 573 curtidas · 75 reposts · 6 respostas · cerca de 49.000 visualizações · 2026-09-21.
    https://x.com/so_ainsight/status/2101871551255830529

    Os 10 repositórios de IA que mais cresceram no GitHub esta semana: 1. OpenCodeReview...
    Compilação semanal de repositórios de IA em alta no GitHub, não limitada à geração de imagens e vídeos. É relevante como contexto da força do ecossistema OSS.

Sinais
  • Em crescimento: postagens individuais demonstrando que Claude Opus 5.5 e Grok 4.7 conseguem gerar vídeos/animações em uma tentativa, rapidamente e a baixo custo, vêm acumulando engajamento. Em especial, várias contas independentes (@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua) publicaram demos diferentes de Opus 5.5 quase simultaneamente (2026-09-21–22), indicando uma onda de verificação logo após o lançamento.
  • Subestimado / com divisão de opiniões: Grok 4.7 reúne elogios (geração 3D no Blender, ~410.000 visualizações) e críticas (“não presta”). @old_pgmrs_will respondeu diretamente às críticas; não se trata de uma recepção uniformemente elogiosa.
  • Surpresa: no lado open source, destacaram-se postagens de desenvolvedores independentes da esfera japonesa (@shinshin86, @ishitaku39, @GeekCatX) exibindo números concretos de estrelas no GitHub. Em vez de anúncios corporativos, prevaleceram relatos de pessoas combinando modelos de pesquisa existentes e agentes de IA para criar ferramentas práticas.
  • Segunda surpresa: das palavras de busca no X, apenas “Opus 5.5”, “Grok 4.7” e “GitHub” se conectavam diretamente à IA de geração de imagens/vídeos. As outras sete (#chance, England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus) eram tendências do Explore do X sem relação com o tema.
Limitações
  • Das 10 palavras de busca, #chance (reality show romântico da ABEMA), England (conversas sobre clima e futebol), #sweepstakes (campanhas de sorteios, como no app Fanatics), #giveaways (posts de sorteios ligados a festivais indianos), Lauren (escândalo de cantora de R&B e a novela brasileira “Estrelas da Casa”), $SONG (token de criptomoeda na Cardano) e Jesus (contextos religiosos, críticas à indústria de games e narração de futebol) não tinham relação com IA de geração de imagens/vídeos. Mais de 20 dos 40 itens eram esse ruído. Provavelmente foram resultados de buscas mecânicas a partir das tendências do Explore do próprio X, sem sinal significativo para o tema.
  • A lista de tendências do Explore do X, baseada na localização do servidor conectado nesta sessão, incluía “Trending in Croatia”, portanto era centrada na Croácia. Não pode ser apresentada como tendência global, e as palavras de ruído acima provavelmente derivam dessa lista local.
  • Tanto no campo fechado quanto no aberto, os posts diretamente relacionados ao tema ficaram limitados a quatro sobre Opus 5.5, quatro sobre Grok 4.7 e três sobre ferramentas OSS do GitHub: 11 no total. Isso não basta, por si só, para cumprir o mínimo de 10 descobertas de cada lado solicitado pelo briefing; é necessário complementar com outras plataformas.
  • Nomes de outros atores importantes — OpenAI (GPT-6/Sora), Midjourney, Stable Diffusion e Runway — não estavam entre as palavras de busca usadas no X e não surgiram nos dados coletados. As reações no X a esses participantes não foram verificadas nesta execução.

YouTube

YouTube — Notícias recentes de IA para geração de imagens e vídeos (código fechado / open source)

Canais
  • OpenAI (canal oficial) — Publica anúncios oficiais de Sora 2 e ChatGPT Images 2.5.
  • Google / Google DeepMind (oficial) — Publica anúncios da série Gemini “Nano Banana”.
  • Adobe (oficial) — Publica anúncios do posicionamento multimodelo do Firefly.
  • Runway (oficial) — Publica anúncios de Gen-4.5 e do servidor MCP.
  • Lev Selector — Canal independente que reúne notícias semanais de IA (série “Exciting AI Updates Weekly”).
  • Criadores de tutoriais de ComfyUI / Stable Diffusion (por exemplo, canais ligados ao programa “AI on the Lot” e autores de explicações de fluxos no ComfyUI) — Produzem muitos tutoriais de execução local de modelos abertos como Wan, LTX, Flux e HunyuanVideo.
  • Canais de comparação e análise (com vários títulos do tipo “Best AI Video Generator”) — Publicam muitas comparações lado a lado entre Sora 2, Seedance 2.0, Runway e Kling.
  • Não foi possível confirmar números de inscritos: o HTML das páginas exigia renderização em JavaScript e os snippets de busca não mostravam esses números (ver ## Limitações).
Vídeos
Código fechado
  1. Introducing Sora 2 — OpenAI oficial / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Bill Peebles, Rohan Sahai e Thomas Dimson apresentam o Sora 2, modelo de geração de vídeo de nova geração com fidelidade a física e sincronização de diálogos, além do novo app Sora.
  2. OpenAI Abandons Sora to Refocus on Enterprise Solutions — canal de análise / por volta de março de 2026 / https://www.youtube.com/watch?v=bIL7uU4CYnE — Explica que a OpenAI encerrará o app Sora em 26/04/2026 e a API em 24/09/2026 (no dia seguinte à pesquisa). Apresenta a informação de que, frente a custos de cerca de US$ 1 milhão por dia, a receita acumulada foi de apenas US$ 2,1 milhões.
  3. OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — canal de análise / por volta de março–abril de 2026 / https://www.youtube.com/watch?v=9rhmczPT6Jk — Explica como pano de fundo para o encerramento do Sora que uma parceria de IA com a Disney, estimada em US$ 1 bilhão, desmoronou pouco antes do anúncio.
  4. Introducing ChatGPT Images 2.5 — OpenAI oficial / por volta de 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — Anúncio do GPT Image 2.5 (ChatGPT Images 2.5), com geração 50% mais rápida e o novo recurso “Sketch”, que converte esboços desenhados à mão em imagens.
  5. Sketch with ChatGPT Images 2.5 — OpenAI oficial / setembro de 2026 / https://www.youtube.com/watch?v=imPtIEAEHSU — Demonstração de digitar “@Sketch”, desenhar diretamente no ChatGPT e converter o esboço em imagem por IA.
  6. The New Gemini Image Generator is Insane (Nano Banana 2) — canal de análise / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — Análise da atualização do modelo padrão de geração de imagens no app Gemini para “Nano Banana 2”.
  7. Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — canal de análise do Midjourney / por volta de março de 2026 / https://www.youtube.com/watch?v=TZ1zWvbXFug — Episódio sobre o anúncio do V8 Alpha. Marca o início da sequência de atualizações V8.1 (2026-04-14) → V8.2 (melhoria de qualidade e personalização; modelo de edição liberado para todos os usuários em 2026-08-27).
  8. Kling 3.0: the biggest advancement in AI video generation? — canal de análise / primeira metade de 2026 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Testa o “Kling 3.0” da Kuaishou. Apresentado como o primeiro modelo a gerar vídeo nativo em 4K e 60 fps, alcançando o primeiro lugar na categoria de vídeo do Artificial Analysis.
  9. Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — canal de análise / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — Teste do preview Grok Imagine 1.5 da xAI.
  10. Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — canal de comparação / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Compara Sora 2, Seedance 2.0 da ByteDance e Runway.
  11. Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — Runway oficial / por volta de 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Anuncia o servidor MCP da Runway, que permite gerar vídeos diretamente de Claude, ChatGPT, Cursor e Replit.
Open source
  1. Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — canal de análise / primeira metade de 2026 / https://www.youtube.com/watch?v=kzXNJO6caGw — Apresenta o Wan 2.5, modelo open source da Alibaba, com suporte a geração de diálogos e sincronização labial.
  2. Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — canal de tutorial / fim de 2025–início de 2026 / https://www.youtube.com/watch?v=VHJ925WoWgw — Explica o recurso “multi-shot storytelling” do Wan 2.6, capaz de gerar vídeo cinematográfico de até 15 segundos e múltiplos planos a partir de um prompt.
  3. Black Forest Labs: FLUX 2 – The King of AI Image Generation — canal de análise / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Teste do FLUX.2 da Black Forest Labs.
  4. FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — canal de análise / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — Afirma que o FLUX.2 superou modelos existentes em qualidade, controle e consistência de geração de imagens.
  5. Qwen Image-2512 First Test – The BEST Open Source Image Model! — canal de análise / 2026 / https://www.youtube.com/watch?v=SBaK616nP6Q — Testa a versão mais recente da família Qwen-Image-2.1 da Alibaba, que integra renderização de texto, edição de imagem e geração com transparência; a parte generativa tem 7 bilhões de parâmetros.
  6. HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — canal de comparação / 2026 / https://www.youtube.com/watch?v=4GNT4-QYekg — Compara localmente o HunyuanVideo 1.5 da Tencent (8,3 bilhões de parâmetros, capaz de rodar em GPUs de consumo) e o Wan 2.7 da Alibaba.
  7. LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — canal de tutorial / 2026 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — Explica como rodar LTX-2 da Lightricks em ambientes de pouca VRAM. O modelo tornou-se totalmente open source em janeiro de 2026 e, em março, ganhou um editor de vídeo para desktop como LTX-2.3.
  8. Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — canal de comparação / 2026 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — Compara as duas principais forças da geração open source de vídeo, Wan 2.2 e LTX 2.3.
  9. Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — canal de explicação do ComfyUI / início de setembro de 2026 (publicado há duas semanas) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — Apresenta o nó customizado open source “Inpaint Canvas” para ComfyUI, lançado em 5 de setembro de 2026. Inclui camadas, seleções, seleção assistida por SAM e exportação PSD, transformando o ComfyUI em uma ferramenta de pintura completa.
Sinais
  • A maior notícia de código fechado é o fim do Sora 2: anunciado com destaque no fim de setembro de 2025, o Sora 2 teve o app encerrado apenas seis meses depois (2026-04-26), e a API estava prevista para encerrar no dia seguinte à pesquisa, 2026-09-24. Vários vídeos de análise no YouTube mencionam custos de aproximadamente US$ 1 milhão por dia contra apenas US$ 2,1 milhões de receita acumulada. A parceria com a Disney, estimada em US$ 1 bilhão, também teria desmoronado pouco antes do anúncio do fim do Sora.
  • A geração de imagens recebe atualizações em sequência de Google, OpenAI e Midjourney: Nano Banana 2 (Gemini, 2026-02), GPT Image 2.5 / ChatGPT Images 2.5 (2026-09-08, com recurso de esboço) e Midjourney V8 → V8.1 → V8.2 (2026-03–08, abertura do modelo de edição a todos) mostram lançamentos contínuos em intervalos de poucos meses.
  • Conteúdo de comparação sobre uma “era de guerra” de geração de vídeo virou padrão: há grande volume de vídeos e Shorts comparando Sora 2, Seedance 2.0, Runway Gen-4.5, Kling 3.0 e Grok Imagine. Isso sugere que o público se interessa menos por fidelidade a uma ferramenta específica e mais por identificar qual está mais forte no momento.
  • Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) e Lightricks (LTX) são os principais campos do open source: todos publicam modelos no Hugging Face/GitHub, e há muitos tutoriais de execução via ComfyUI ou GPU local. Wan vem ampliando rapidamente recursos de diálogo, lip sync e produção multishot (2.5 → 2.6).
  • O ecossistema ComfyUI se firmou como o “painel de conexões” da IA generativa: só em setembro de 2026 surgiram em sequência Core Sparse Attention Node, Comfy Compiler, Inpaint Canvas, MiniMax H3 RefMods e Krea2T Enhancer, fortalecendo seu papel de camada intermediária que transforma modelos OSS em operações práticas.
  • Adobe Firefly está se tornando um hub de agregação para os dois campos: além de modelos próprios, integra mais de 30 modelos externos, como Runway Gen-4.5, Google Nano Banana Pro, geração de imagens da OpenAI e Black Forest Labs FLUX.2 [pro], num único espaço de trabalho. A prática de combinar ferramentas, em vez de escolher uma só, também está se expandindo no ambiente corporativo.
  • Vídeos de análise e comparação com títulos exagerados representam grande parte do conjunto: títulos como “BEST AI Image Generator in 2026 (Don't Choose Wrong!)” se multiplicam, e a escolha do modelo em si virou conteúdo, às vezes mais do que a informação técnica real.
Limitações
  • As páginas de resultados e de vídeos do YouTube exigem renderização JavaScript; o WebFetch não conseguiu obter contagens reais de visualizações, inscritos ou datas de publicação pelo HTML. Portanto, o relatório se baseia apenas em datas e resumos disponíveis nos snippets de busca, sem informar visualizações exatas.
  • Alguns vídeos — sobre Wan 2.6 e comparações de HunyuanVideo, por exemplo — apareciam apenas como “2026” nos resultados, sem mês definido. Assim, não foi possível confirmar com rigor o critério de “últimos 60 dias”. Foram priorizados os itens cuja recência era mais clara, como a notícia do fim da API do Sora, ChatGPT Images 2.5 e Inpaint Canvas.
  • Não foi encontrado vídeo oficial do YouTube noticiando diretamente o fim da API do Sora em 2026-09-24; apenas vídeos posteriores de canais de análise.
  • Canais e vídeos japoneses não apareceram no topo das consultas realizadas; o conjunto se concentra em informações do idioma inglês.

Bluesky

Bluesky — Tendências recentes de IA para geração de imagens e vídeos

Contas
  • @stabilityai.bsky.social — Stability AI oficial. Porém, no fim de 2025, suas postagens se concentraram em Stable Audio e parcerias corporativas, não em modelos de imagem; as curtidas foram quase sempre 0.
  • @midjourneyofficial.bsky.social — Midjourney oficial. Anunciou entrada no Bluesky em agosto de 2025, mas a postagem mais recente é de 8 de outubro de 2025; não há notícias recentes.
  • @promptheroofficial.bsky.social — PromptHero, serviço de compartilhamento de prompts. É uma conta que anuncia disponibilidade de modelos fechados, como Sora 2.
  • @ethanhe.bsky.social — Engenheiro da equipe Grok Imagine da xAI, ex-NVIDIA/Meta. É uma das poucas contas internas que publica diretamente sobre novos recursos e vagas do Grok Imagine.
  • @chorizemabang.bsky.social — Usuário japonês que gera vídeos com Grok Imagine. Apresenta reclamações e relatos de falhas pela perspectiva de usuário real.
  • @metalmickey.bsky.social(澤村徹) — Artista de Tóquio que produz clipes e obras de exposição usando Seedance 2.5, GPT-6 e Suno V6. Há relatos concretos de custo de produção.
  • @you32081.bsky.social — Criador que produz em massa ilustrações de IA R-18 com modelos open source como Qwen-Image e Z-Image-Turbo.
  • @lijack1001.bsky.social — Conta de spam SEO/afiliados que publica muitos sites-clone para Nano Banana Pro, Seedance, Sora 2, Veo 3, Wan e GPT-5 Image. Não é fonte de notícia, mas ajuda a indicar quais nomes de modelos são tratados como palavras-chave rentáveis.
  • @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — Os identificadores oficiais de Runway, Black Forest Labs e ComfyUI existem, mas as contas estão praticamente vazias ou têm apenas uma postagem recente de 2024, estando efetivamente inativas.
Posts
  1. PromptHero: “Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models” — 2025-10-13, 0 curtidas/0 reposts. Postagem
    Fechado. Indica que um serviço terceirizado de prompts revendia Sora 2 como “sem marcas-d’água, disponível na Europa e combinável com outros modelos”.
  2. xAI · Ethan He: “Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...” — 2026-04-05, 0 curtidas/0 reposts. Postagem
    Fechado. Um engenheiro oficial anunciou o modo Quality do Grok Imagine, com melhorias de detalhes e renderização de texto.
  3. xAI · Ethan He: anúncio de contratação de treinadores de vídeo, “familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)” — 2026-03-29. Postagem
    Fechado. Evidência de investimento da xAI em pessoas para criar dados de treinamento de vídeo, citando Runway, Kling, Sora e Veo como comparáveis.
  4. @chorizemabang: “Grok Imagine realmente deixou de gerar quase qualquer coisa, mas também tem seu charme fazer uma obra por dia com calma.” — 2026-06-05, 13 curtidas/1 repost. Postagem
    Fechado. Usuário relata falhas de geração no Grok Imagine.
  5. @chorizemabang: “Como o Grok Imagine acabou de vez, aqui vão obras antigas como pedido de desculpas...” — 2026-05-31, 11 curtidas/1 repost. Postagem
    Fechado. Junto com o post anterior, reforça que houve problemas de estabilidade no Grok Imagine em maio–junho.
  6. @metalmickey: “road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.” — 2026-08-27. Postagem
    Fechado. Produção real de um road movie de IA de aproximadamente cinco minutos com clipes do Seedance 2.5, acompanhada de reclamação sobre os preços elevados.
  7. @metalmickey: “Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.” — 2026-09-07. Postagem
    Fechado. Exemplo de um novo fluxo de criação de videoclipe por instruções de voz, sem escrever um único prompt, usando GPT-6 Astra.
  8. Stability AI: “We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...” — 2025-09-18, 0 curtidas/0 reposts. Postagem
    Voltado a API fechada. Comercializa edição de imagens — inpainting e transferência de estilo — no AWS Bedrock.
  9. Midjourney oficial: “#Midjourney is now on BlueSky! Who are the best creators to follow here?” — 2025-08-15, 41 curtidas/4 reposts. Postagem
    Embora o Midjourney seja fechado, esta foi praticamente sua última comunicação no Bluesky, registrando um caso de entrada na rede que não se consolidou.
  10. @you32081: ilustração de IA R-18 com Qwen-Image / Z-Image-Turbo — 2026-08-01, 6 curtidas/0 reposts. Postagem
    Open source. Exemplo de Qwen-Image e Z-Image-Turbo, modelos chineses de pesos abertos, já estabelecidos como ferramentas reais de produção na esfera doujin/R18.
Sinais
  • Não há no Bluesky um hub forte especializado em notícias de IA para geração de imagens e vídeos. Midjourney, Stability AI, Runway, Black Forest Labs e ComfyUI têm poucas ou nenhuma postagem recente e engajamento entre zero e poucos itens, estando na prática inativas. A rede não funciona como espaço de debate ágil, ao contrário de X e Reddit.
  • Assuntos de modelos fechados só aparecem através de contas pessoais de pessoas internas às empresas. A única conta a publicar de forma contínua foi @ethanhe.bsky.social, engenheiro do Grok Imagine na xAI, com posts operacionais sobre modo Quality e contratação de treinadores de vídeo em março–abril de 2026.
  • Há indícios de instabilidade do Grok Imagine em maio–junho de 2026. O usuário japonês @chorizemabang publicou mais de uma vez que o serviço “parou de gerar” e “acabou” (2026-05-31, 2026-06-05). Como a xAI havia anunciado melhorias em abril, é possível que a operação não tenha acompanhado a expansão rápida.
  • Seedance 2.5 se destaca em registros de produção real. Um artista de Tóquio, @metalmickey, criou em agosto de 2026 um road movie de IA de cerca de cinco minutos a partir de clipes do Seedance 2.5 e lamentou repetidamente o custo, evidenciando um problema de ferramentas fechadas/ APIs pagas.
  • Menções a ferramentas open source — Flux, Wan, Qwen-Image, Z-Image-Turbo, HunyuanImage e ComfyUI — aparecem de forma fragmentada como hashtags em postagens de arte IA R-18/doujin, não como notícias. Não foram encontrados no Bluesky divulgadores especializados comparáveis aos de r/StableDiffusion.
  • Há muito spam de afiliados/SEO usando nomes de modelos. Contas como @lijack1001 despejam links para sites-clone com “Nano Banana Pro”, “Seedance 2.0”, “Sora 2”, “Veo 3”, “Wan 2.2” e “GPT-5 Image”. Isso é um indício de demanda por busca, mas não tem valor como fonte de notícias.
  • Nano Banana Pro, do Google, é mencionado frequentemente na esfera de arte IA/R-18. Surge em hashtags e biografias ao lado de Ideogram 4 e Krea 2, parecendo estabelecido como uma das ferramentas comerciais em uso.
Limitações
  • A API oficial de busca de texto completo do Bluesky (app.bsky.feed.searchPosts) retornou HTTP 403 para todas as consultas testadas (Stable Diffusion, Midjourney, Flux, test etc.) e nunca funcionou. Como app.bsky.actor.getProfile, app.bsky.actor.searchActors e app.bsky.feed.getAuthorFeed funcionaram normalmente, a pesquisa ficou limitada ao caminho indireto conta → lista de posts da conta.
  • A versão web de bsky.app é uma SPA renderizada no cliente e retornava página vazia quando buscada; foi necessário usar diretamente a API JSON pública.
  • Sem busca de texto completo, há grande risco de não terem sido encontrados posts relevantes de contas desconhecidas, especialmente contas especializadas em notícias de modelos open source. Não foi possível separar se elas não existem ou se não foram localizadas por limitação da busca.
  • As contas oficiais de Stability AI, Midjourney, Runway, Black Forest Labs e ComfyUI foram investigadas, mas não tinham novas notícias sobre modelos recentes de imagem/vídeo. Isso descreve a característica do Bluesky, não a existência ou inexistência de assunto em outras plataformas.

Lemmy

Lemmy — Notícias de IA para geração de imagens e vídeos (open source / fechado)

O Lemmy é um fórum distribuído de pequena escala. As discussões de IA de imagem ficam concentradas sobretudo em !«メールアドレス» e comunidades próximas, além de !«メールアドレス», que espelha r/ArtificialInteligence por meio de bots. A pesquisa transversal utilizou a API de busca do lemmy.world (/api/v3/search) e busca web, com palavras como “image generation”, “video generation”, “Stable Diffusion”, “Flux”, “Qwen Image”, “Sora”, “Midjourney”, “Nano Banana”, “Grok Imagine” e “ComfyUI”.

Comunidades
  • !«メールアドレス» — 5.713 assinantes. Foco em postagens técnicas sobre modelos abertos de geração de imagem/vídeo e ComfyUI.
  • !«メールアドレス» — 2.361 assinantes. Principalmente compartilhamento de obras geradas, com pouca relevância de notícias.
  • !«メールアドレス» — Publica diariamente muitas imagens estilo anime geradas via civitai; são obras, não notícias.
  • !«メールアドレス» (Free Open-Source AI) — 4,84 mil assinantes, dos quais 1,81 mil locais. Voltada a IA open source em geral; poucas postagens são especializadas em geração de imagem/vídeo.
  • !«メールアドレス» — Comunidade que espelha automaticamente r/ArtificialInteligence. É importante notar que não se trata de debate originado no Lemmy.
  • !stable_diffusion_abstraction (50 pessoas) / !stable_diffusion_furry (52 pessoas) / !stable_diffusion_mycology (97 pessoas) — Comunidades pequenas e nichadas de compartilhamento de obras.
Posts
Voltados a open source
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
    !«メールアドレス», 2026-09-22, score 9
    https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
    Modelo de geração e edição de imagens com pesos abertos, de 7 bilhões de parâmetros, da equipe Qwen da Alibaba. Oferece saída RGBA com transparência — para logos e recortes —, resolução nativa de 2048×2048 e até 10 imagens de referência, com integração nativa ao ComfyUI.

  2. Qwen-Image-2.1: Compact, efficient, and unified image creation
    !«メールアドレス», 2026-09-20, score 1
    https://qwen.ai/blog?id=qwen-image-2.1
    Anúncio no blog oficial da Qwen; fonte primária do artigo de ComfyUI acima.

  3. supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
    !«メールアドレス», 2026-09-16, score 1
    https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
    Extensão do ComfyUI para MiniMax H3. Divide automaticamente o vídeo em segmentos e os conecta por ancoragem latente, evitando a limitação de VRAM na geração de vídeos longos. Apache-2.0, 31 estrelas, 153 commits.

  4. Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
    !«メールアドレス», 2026-09-16, score 3
    https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
    Ferramenta de construção de prompts no ComfyUI para MiniMax H3. Exemplo de ecossistema periférico ativo em torno de fluxos locais de geração de vídeo.

  5. Boogu-Image-0.1 — Efficient Image Generation Foundation Model
    !«メールアドレス», 2026-06-17, score 5
    https://boogu.org/
    Lançamento de um novo modelo-base open source de geração de imagens, focado em leveza e eficiência.

  6. AI video generation is becoming less about the model and more about the workflow
    !«メールアドレス» (reprodução do Reddit), 2026-09-19, score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
    Postagem defendendo que modelos de pesos abertos e a construção de fluxos ao estilo ComfyUI passam a determinar a qualidade da geração de vídeo mais do que o modelo isolado.

Voltados a código fechado
  1. OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
    !«メールアドレス» (reprodução do Reddit), 2026-09-20, score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
    Debate sobre o fim previsto da API do Sora 2 em 24/9 — após o app ter parado em abril — em contraste com a captação de US$ 3 bilhões pela concorrente chinesa Kuaishou (Kling). A narrativa: produtos de consumo chamativos falharam, enquanto usos empresariais discretos dão retorno.

  2. Midjourney pivots from AI image generation to body scanning medical spa (artigo de contexto, mudança importante de junho com efeitos persistentes)
    !«メールアドレス», 2026-06-18, score 58
    https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
    Reportagem de que o Midjourney mudou fortemente da geração de imagens por IA para negócios de dispositivos médicos, como scanners de TC por ultrassom. Há posts relacionados em !«メールアドレス», “Midjourney Medical” e “Midjourney Ultrasonic CT Scanner”, ambos de 2026-06-18.

  3. Midjourney wants Hollywood studios to reveal the details of their AI usage
    !«メールアドレス», 2026-07-05, score 73
    https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
    Continuação indicando que, mesmo após a mudança para a área médica, o Midjourney segue em conflito com Hollywood sobre direitos autorais e uso de IA para imagens/vídeos.

  4. Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
    !«メールアドレス», 2026-07-02, score 0
    https://www.itmagazine.ch/artikel/87529/
    Notícia suíça de tecnologia sobre o lançamento do modelo de geração de imagens “Nano Banana 2 Lite”, da família Gemini do Google. !«メールアドレス» também tinha uma postagem ligando à fonte primária em deepmind.google, de 2026-06-30.

  5. Seedream 5.0 Pro is here: an honest comparison and technical breakdown
    !«メールアドレス» (reprodução do Reddit), 2026-07-10, score 1
    https://www.reddit.com/gallery/1usc03q
    Postagem de análise e comparação do modelo fechado Seedream 5.0 Pro, da ByteDance.

  6. Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
    !«メールアドレス» (reprodução do Reddit), 2026-08-07, score 1
    https://fortune.com/2026/08/07/
    Reportagem de que o Google retirou o recurso “Earth AI” logo após o lançamento em razão de imagens problemáticas criadas por usuários. Exemplo de problemas de guardrails em fornecedores fechados.

  7. Elon Musk maakt complete AI-film met zijn versie van The Odyssey
    !«メールアドレス», 2026-07-22, score 1
    https://lemy.nl/post/4342454
    Artigo em holandês dizendo que Elon Musk está produzindo uma interpretação própria de A Odisseia com recursos de geração de vídeo do Grok, da xAI. Tema com forte tom de marketing do campo fechado.

  8. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
    !«メールアドレス» (reprodução do Reddit), 2026-09-14, score 1
    https://www.reddit.com/gallery/1wfyqdy
    Postagem comparando a colorização da mesma página de mangá por quatro IAs, incluindo um modelo GPT; a impressão do autor é que o GPT foi superior.

Sinais
  • No Lemmy, a discussão ativa sobre geração de imagens/vídeos por IA fica quase limitada a postagens de ferramentas em torno do ComfyUI em !«メールアドレス» e a espelhos do Reddit em !ai_reddit. Há poucas notícias originais do Lemmy.
  • No campo aberto, posts sobre “fluxo de trabalho / nós e extensões do ComfyUI” são mais frequentes do que aqueles sobre “modelos isolados”. Duas extensões de MiniMax H3 foram postadas em sequência na última semana, indicando atividade na camada de ferramentas para produção de vídeo.
  • No campo fechado, destacam-se notícias de retirada e mudança de rumo: fim da API do Sora, migração do Midjourney para dispositivos médicos e retirada imediata do Earth AI do Google. Há mais histórias de falhas de monetização e correções de rota do que grandes lançamentos.
  • Comunidades de compartilhamento de obras, como !«メールアドレス», têm grande volume de posts, mas são listas de imagens do civitai e não têm caráter noticioso.
Limitações
  • A escala do Lemmy é muito menor que Reddit ou X; mesmo !«メールアドレス» tem apenas 5.713 assinantes. Não há volume de notícias originais suficiente para cumprir a meta de cerca de 20 posts analisados (a escala esperada pelo playbook é de “5 a 12”).
  • !ai_reddit não contém debate nativo do Lemmy, e sim reposts automáticos de posts do Reddit, com quase nenhum comentário. A reação da própria comunidade Lemmy é, na prática, impossível de observar.
  • O endpoint /api/v3/community da API do Lemmy frequentemente exige community_id; algumas comunidades — aiwars, buscas diretas por imageai etc. — retornaram 400/404 e foram cobertas apenas com resultados de busca web.
  • Buscas específicas por modelos de vídeo como “Wan”, “HunyuanVideo” e “Kling” geraram muito ruído por colisão com palavras comuns ou abreviações, e não foram encontradas postagens claramente originárias do Lemmy para esses termos.

Pinterest

Pinterest — Notícias de IA para geração de imagens e vídeos

Temas visuais
  • Formato de miniatura de YouTuber “AI NEWS”: criadores barbados com expressão de choque/empolgação diante de logos neon arredondados de OpenAI, Google, Microsoft, Meta e Notion, organizados em grade — o estilo de pin mais repetido do conjunto. [1, 8, 30]
  • Imagens hero de SaaS para ferramentas de geração de vídeo por IA: mockups de interface em azul-marinho/roxo escuro com caixa brilhante “text prompt → generate”, ou mascote de robô branco com claquete, acompanhados por ícones de recursos (Text to Video / AI Editing / Auto Soundtrack / Captions). [6, 11, 16]
  • Gráficos comparativos de “melhor ferramenta” e listicles ranqueados: matrizes de decisão com bordas neon e cartões “My Top Picks” comparando ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma e Pika por faixa de preço e caso de uso. [10, 20]
  • Imagens de alerta sobre deepfakes e desinformação: carimbos vermelhos “FAKE”, lupas sobre “?”, um olho meio humano/meio wireframe, selo de detector de voz “97% likely AI generated” e a legenda “AI GENERATED NEWS CLIP” sobre uma âncora fabricada. [4, 27, 38, 49]
  • Anúncios de apps de troca de rosto e mistura de identidades: dois rostos se dissolvendo numa malha triangular (“Professional Face Swap”) e um tríptico mãe + pai → filho previsto (“AI Baby in Seconds”). [43, 44]
  • Fantasia gerada por IA como demonstração de estilo ou isca de engajamento: uma lontra hiper-realista de colete salva-vidas numa prancha de surfe, retrato de pescador idoso e colagem de fantasia (castelo, urso polar, casal samurai, bolo) exibem qualidade de geração, não notícias. [13, 34, 45]
  • Infográficos explicativos em linguagem simples: diagrama em oito etapas sobre “como a IA gera vídeo” (prompt → compreensão de linguagem → espaço latente → difusão de quadros → verificação de consistência → saída), voltado a leigos e não a desenvolvedores. [12]
  • Imagens sobre disrupção em redações e economia de avatares: colagem de sala de controle com âncoras geradas por IA preenchendo telões, grade de avatares de influenciadores estilizados atrás de um rosto fotorrealista e gráfico de estrada dividida “Human Journalism vs Machine-Generated Media”. [38, 40, 23]
Pins notáveis
  • #1 — “AI News: Anthropic Leak Shows Us The Future of AI...”: miniatura arquetípica de criador chocado com logos OpenAI/Google/Microsoft/ChatGPT; define o modelo visual copiado pela maior parte dos pins de “AI NEWS”.
  • #3 — “Google announces ultra-high quality video...”: grade 3×5 que transforma um vídeo de origem nos estilos “blocos de madeira / origami / Lego / flores” — demonstração concreta de reestilização de vídeo ao estilo Lumiere, não apenas um cartão de manchete.
  • #10 — “AI Image Video: Best Quality vs Best Free”: matriz completa de decisão (10 ferramentas pagas vs 10 gratuitas vs caso de uso), o artefato mais claro da ansiedade “qual ferramenta de IA eu realmente uso?” neste conjunto.
  • #12 — “AI & Machine Learning: How AI Generates Video Infographic”: explicação de pipeline de difusão/predição de quadros em oito etapas, da LivePhysics.com, voltada a iniciantes — referência útil para explicar o tema de forma simples.
  • #27 — “AI is getting scary good”: reúne geradores de vídeo por IA, detectores de voz por IA (“97% likely AI generated”) e ética de IA em um só infográfico — a síntese mais concentrada da ansiedade com deepfakes.
  • #38 — “AI News Anchors & Creator-Led Coverage Take Over U.S. Media”: colagem de redação com âncoras geradas por IA preenchendo monitores, visualizando diretamente a substituição de talentos tradicionais de transmissão.
  • #40 — “Het perfecte avatar-tijdperk” em holandês (a era perfeita dos avatares): um rosto fotorrealista diante de uma grade de avatares de IA estilizados, capturando a tendência de influenciadores de IA em um resultado europeu do Pinterest e mostrando a difusão multilíngue do tema.
  • #43 — Akool “Professional Face Swap” (anúncio em espanhol): rostos de duas mulheres se mesclando por uma sobreposição de malha facial — produto comercial de troca de rosto anunciado diretamente no Pinterest, não apenas discutido.
  • #44 — “AI Baby in Seconds”: tríptico mãe/filho previsto/pai — subgênero próprio em crescimento rápido, aparecendo como agrupamento de pins e não como caso isolado.
  • #49 — “You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos”: âncora falsa gerada por IA com “AI GENERATED NEWS CLIP” escrito diretamente na imagem, o pin de alerta mais explícito do conjunto.
Sinais
  • A fadiga para decidir ferramentas é o principal ângulo do consumidor. Grande parte dos pins são gráficos comparativos, matrizes “melhor gratuito vs pago” e cartões “minhas escolhas”, em vez de notícias sobre lançamentos específicos. Usuários do Pinterest buscam mais orientação de compra/adoção do que anúncios. [10, 20, 29]
  • A ansiedade com deepfakes e desinformação é um gênero visual próprio, não uma nota lateral: carimbos FAKE, selos de detector de voz e etiquetas de divulgação de conteúdo gerado por IA aparecem quase tão frequentemente quanto conteúdo promocional de ferramentas. [4, 27, 38, 41, 49]
  • A tendência de âncoras de notícias por IA tem tração visual real: múltiplos pins independentes — colagens de salas de controle, conteúdo de âncora da Channel1 e etiquetas “AI generated news clip” — tratam âncoras de IA como fenômeno em curso, não hipótese. [38, 49, 50]
  • Ausência: o open source é quase invisível. Em toda a amostra, a única ferramenta claramente local/aberta é “Amuse 3.0” da AMD [34]; não há telas de Stable Diffusion, ComfyUI ou UIs de modelos locais, em contraste com forte presença ligada a serviços fechados (logos e mockups de ChatGPT, Gemini, Midjourney, Kling, Runway e Luma).
  • Ausência: capturas diretas de produtos dos modelos fechados mais novos. Não surgiram interfaces nativas de Sora 2, Nano Banana ou Veo 3 nesta amostra; a maioria dos pins de “código fechado” são miniaturas de afiliados/criadores falando das notícias, e não capturas do produto.
  • Sinal de cautela: o pin #47, intitulado “Elon Musk's New AI Already Being Used to Generate...”, na verdade mostra uma imagem composta de Donald Trump e uma mulher fazendo sinal de positivo numa cabine de avião, com o World Trade Center em chamas ao fundo. O título não descreve a imagem. É um exemplo concreto de imagem realista de desastre/política composta por IA circulando com título incompatível e caça-cliques, lembrando que títulos de pins deste conjunto não podem ser considerados descrições confiáveis.
Limitações
  • Não foram definidos gêneros para esta coleta: houve uma única busca sem filtro por “Image and Video Generation AI News”. Assim, os 50 pins misturam miniaturas de criadores, anúncios de produtos, fotos de banco de imagens e visuais em estilo de notícia, sem categorização prévia.
  • Das 50 imagens coletadas, 26 foram abertas e inspecionadas visualmente — uma amostra representativa, priorizando variedade de título e tópico —, e não todas as 50. As conclusões acima se baseiam nessa amostra.
  • Vários títulos não correspondiam às imagens, principalmente o #47. Por isso, qualquer tema construído apenas a partir da tabela de títulos seria pouco confiável; este relatório se baseia no que as imagens realmente mostram.
  • Os pins do Pinterest não trazem contagens de repins ou curtidas nos dados coletados. Portanto, o que está “em alta” é inferido pela repetição de estilos visuais, não por popularidade medida.
  • O Pinterest tende a conteúdo secundário/derivado — miniaturas, cabeçalhos de blog e peças publicitárias —, e não a anúncios primários de produtos. Para confirmar alegações sobre versões específicas de produtos, como Veo ou Kling, seria necessário recorrer às plataformas de fontes primárias cobertas em outras partes desta pesquisa.

Ações recomendadas

  • Acompanhar a pilha local OSS de vídeo (Wan, HunyuanVideo, FLUX.2, ComfyUI + MiniMax H3) como alternativa prática à medida que ferramentas fechadas aumentam preços e encerram produtos.
  • Antecipar o sentimento por divulgação de conteúdo de IA, crescente no Reddit e Pinterest, preparando agora mensagens de procedência e identificação.
  • Observar para onde os usuários migram depois do fim da API do Sora 2 em 2026-09-24; Kling, Seedance e Runway são os beneficiários prováveis.
  • Tratar a onda de demos de geração em uma tentativa de Opus 5.5 / Grok 4.7 no X como um ciclo curto de hype no lançamento, não como ameaça persistente à relevância do OSS.
  • Monitorar a tensão de escala computacional do DeepSeek como sinal antecipado do que acontece quando a adoção de pesos abertos supera a infraestrutura do próprio operador.
  • Atender à fadiga de comparação “qual ferramenta eu uso?” visível no YouTube e Pinterest com conteúdo comparativo, em vez de notícias sobre um único produto.

Imagens coletadas

Notícias de IA: vazamento da Anthropic mostra o futuro da IA...🎨 Criação de imagens e vídeos por IAGoogle anuncia vídeo de qualidade ultra-alta...Preocupações com conteúdo de IA e redes sociaisAcerte em cheio 🎥Como a geração de vídeo por IA apoia a criação moderna...Conceito de criação de conteúdo por IA com ícones para geração de texto, imagem, música e vídeo — navegue por 66 fotos, vetores e vídeosGPT 5.2, editor de vídeo em tempo real, vídeos estereoscópicos por IA, agentes de IA móveis, controle corporal completo: AI NEWSimagemIA para geração de imagens e vídeosMelhores geradores de vídeo por IA em 2026: Veo, Kling,...IA e aprendizado de máquina: infográfico sobre como a IA gera vídeo | LivePhysics™Plataforma gratuita de geração de conteúdo visual com IA – Viva AIFerramenta de IA para transformar texto em imagensimagemVeo 3 imagem para vídeo: geração rápida e áudio nativo via API GeminiSegredos do estúdio e automação de conteúdo com IA 🚀📱Geração de imagens por IACriativo de vídeo lifestyle com IA | Produção de vídeo com IA para marcas lifestyleKling.ai: geração de texto para vídeo com IAimagemimagemA aposta ousada de Nova York: por dentro da legislação...imagemOs modelos de IA Nova da Amazon chegaram. Estes novos modelos multimodais foram projetados para processar texto, imagens,IA‎🚨 A IA está ficando assustadoramente boa.Gemini Omni do Google transforma qualquer coisa em vídeoPrincipais geradores de vídeo por IA de 2025Notícias de IA: a OpenAI finalmente lançou o que pedimosimagemGeração de imagens por IA e a indústria do entretenimentoA arma secreta dos criadores de conteúdo: geração de vídeo com IA‘Amuse 3.0’, uma ferramenta de criação de arte por IA que inclui...Vídeos gerados por IA: bons ou ruins? Eis a verdade! 🤖🎥Apresentando Luma Dream Machine — vídeo de IA de próxima geraçãoVídeos de notícias com IA confundem a linha entre reportagens reais e falsasÂncoras de notícias de IA e cobertura por criadores tomam a mídia dos EUA!4 grandes atualizações de IA que você precisa conhecer em 2026A era perfeita dos avatares: a ascensão dos influenciadores de IA“Por que chatbots de IA falham em acompanhar notícias de última hora”Notícias de IATransforme suas fotos e vídeos! Akool é a ferramenta com IA que você estava esperando! 🚀7 melhores geradores de bebês por IA: preveja o rosto do seu filho (2026)O criador Stable Diffusions da Stability AI agora pode criar vídeo generativo por IAimagemA nova IA de Elon Musk já está sendo usada para gerar...Como a IA generativa vai transformar todos os setoresVocê não está preparado para esta nova e aterrorizante onda de vídeos gerados por IAÂncora de IA da Channel1

Nota sobre qualidade dos dados

Apenas YouTube e Pinterest alcançaram aproximadamente a meta do briefing de cerca de 20 itens; o Reddit trouxe apenas 12 tópicos, em sua maioria de subreddits gerais fora do foco, mais da metade dos 40 posts do X era ruído de palavras em alta sem relação, a API de busca de texto completo do Bluesky retornou 403 durante toda a execução e a cobertura se limitou a contas conhecidas, e o Lemmy simplesmente é pequeno demais (a comunidade principal tem cerca de 5.713 assinantes, e metade dos posts são espelhos do Reddit) para alcançar 20 posts nativos.

Galeria