KEN’S CAT LOG

Notícias de IA para geração de imagens e vídeos — 2026-09-22

O encerramento da API do Sora em 2026-09-24 é a principal história do momento no universo fechado, enquanto o MiniMax H3 e laboratórios chineses de pesos abertos (Alibaba/Qwen, ByteDance, Baidu e Tencent) impulsionam o ecossistema de código aberto que mais cresce, centrado no ComfyUI.

Notícias de IA para geração de imagens e vídeos — 2026-09-22

O maior assunto no universo de código fechado é o encerramento completo, em 2026-09-24 (dois dias após este relatório), da API de geração de vídeo Sora da OpenAI — o aplicativo já havia sido encerrado em abril, tendo como pano de fundo a piora da rentabilidade: cerca de US$ 1 milhão em custos operacionais diários para aproximadamente US$ 2,1 milhões em receita acumulada. Ao mesmo tempo, o GPT Image 2.5 e o Nano Banana Pro/2 do Google DeepMind disputam velocidade e fotorrealismo, e a corrida de desenvolvimento entre as empresas fechadas se intensifica com atualizações a cada poucas semanas. No lado do código aberto, o ecossistema ComfyUI segue crescendo em torno do MiniMax H3, com destaque para novos modelos de laboratórios chineses como Alibaba (Qwen), ByteDance, Baidu e Tencent. Em várias plataformas, há também relatos de que a diferença de qualidade percebida entre soluções fechadas e abertas está diminuindo.

Entre plataformas

  • O fim da API do Sora (2026-09-24) é o principal tema compartilhado no código fechado. A publicação de Ed Zitron no Bluesky (3.572 curtidas, o maior engajamento de toda esta coleta) deu a notícia em primeira mão; vídeos de balanço sobre o estado da IA de vídeo no YouTube e publicações no !ai_reddit do Lemmy também abordaram o assunto. Três plataformas destacaram esse caso de forma independente, tratando a deterioração da relação entre receita e custos como um exemplo de que o código fechado não é necessariamente um mercado em que o vencedor leva tudo.
  • MiniMax H3 é a palavra-chave comum da geração de vídeo aberta. No Reddit, foram discutidas formas concretas de usar Wan e MiniMax H3 gratuitamente; no Bluesky, Adina Yakup apresentou o “HyperFlow”, versão de destilação rápida do MiniMax H3 em oito etapas; e, no Lemmy, foram publicadas mais de cinco extensões relacionadas ao MiniMax H3 para ComfyUI entre agosto e setembro de 2026. O mesmo nome de modelo surgiu de modo independente nas três plataformas, o que o torna provavelmente o modelo de vídeo com pesos abertos mais promissor do momento.
  • GPT Image 2.5 é mencionado em três plataformas como referência de geração de imagem fechada. No Reddit (r/ImagineAiArt, tópico com 92 pontos), há tanto elogios quanto a opinião de que “não há diferença perceptível em relação ao KREA2”; o YouTube explica redução de 50% na latência de geração e o recurso Sketch; Simon Willison, no Bluesky, também gerou imagens conceituais com esse modelo.
  • Os laboratórios chineses se destacam do lado aberto. Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) e Tencent (HunyuanVideo 1.5), entre outras empresas chinesas, aparecem repetidamente no Bluesky, YouTube e Lemmy com modelos de pesos abertos sob licenças do tipo Apache-2.0. Várias plataformas confirmam o quadro em que as empresas chinesas lideram amplamente as novidades de código aberto.
  • ComfyUI é a infraestrutura comum de fato. Quase todos os vídeos de análise do YouTube e a maior parte das publicações em !«メールアドレス» mencionam implementações e fluxos de trabalho no ComfyUI; o uso prático de ferramentas abertas está se concentrando nele.
  • Há a percepção de que a diferença de qualidade entre fechado e aberto está encolhendo. No Reddit, um comentário diz que “GPT Image 2.5 e KREA2 parecem produzir o mesmo resultado”; no Pinterest, por outro lado, o marketing de código fechado domina, enquanto referências a código aberto são quase inexistentes — provavelmente não porque o código aberto seja fraco, mas porque tem menos visibilidade para o público geral.

Plataforma por plataforma

Reddit: foram coletados 12 tópicos de sete subreddits. A demanda por geração gratuita de vídeo por IA e a reação de “entendam que isso não é mais viável” formam o principal eixo de conflito, com comentários recomendando naturalmente modelos de pesos abertos como Wan e MiniMax H3. O aumento acelerado de usuários do DeepSeek (+66,7%) e a insuficiência de capacidade computacional também aparecem como sinais claros. Comentários promocionais com o mesmo código de indicação surgem em vários tópicos, portanto é necessário cautela com publicidade infiltrada em discussões orgânicas.

X: das 32 publicações de 31 contas coletadas, nenhuma mencionava IA de geração de imagens ou vídeos. Os termos usados na busca (Bitcoin, Zelensky, Zagreb etc.) reutilizaram diretamente os assuntos em alta do Explore do X — aparentemente tendências regionais da Croácia — e não tinham relação com o tema. Não foi possível obter conhecimento substancial sobre o assunto no X.

YouTube: mais de 30 títulos foram encontrados via WebSearch, dos quais 13 representativos foram selecionados. No lado fechado, comparações entre GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 e Kling 3.0 são um formato recorrente. No lado aberto, continua a tendência de “reduzir o peso sem perder desempenho”, com Z-Image Turbo, Qwen-Image-2.1, LTX-2 e HunyuanVideo 1.5. Como as páginas são renderizadas em JavaScript, não foi possível obter contagens de visualizações nem datas exatas, que devem ser tratadas como aproximadas.

Bluesky: como a API de busca (searchPosts) retornou 403 durante toda a coleta, a pesquisa foi substituída pela leitura direta dos feeds de contas relevantes. A publicação de Ed Zitron sobre o fim do Sora teve o maior engajamento. As novidades de código aberto dependem quase inteiramente de Adina Yakup, da Hugging Face; contas oficiais de Civitai, ComfyUI e Stability AI estavam silenciosas ou inativas.

Lemmy: foram analisadas 16 publicações em oito comunidades. As notícias sobre código fechado são quase todas menções de segunda mão, encaminhadas por espelhos do Reddit (!ai_reddit) ou Hacker News (!hackernews), com pontuações baixas. O único assunto viral foi a notícia de que a Midjourney teria mudado de imagem gerada para scanners médicos de tomografia por ultrassom (pontuação 40). Do lado aberto, publicações de extensões ComfyUI para MiniMax H3 continuaram aparecendo entre agosto e setembro.

Pinterest: foram analisados 50 pins. A maior parte consiste em imagens de listas do tipo “Best AI Video Generator” e artes genéricas de robôs de IA; Kling AI e Hailuo AI passaram a figurar entre as opções de topo ao lado de Runway, Pika e Luma. Referências ao código aberto foram praticamente zero em 50 pins: aparece apenas uma manchete, “Open Models. Open weights.” Isso, por si só, é uma descoberta relevante: em plataformas voltadas ao consumidor, o código aberto é quase invisível.

Dentre as seis plataformas previstas no briefing, X (efetivamente zero resultados devido à escolha inadequada dos termos) e Reddit (12 tópicos, em vez da meta de 20) não atenderam ao critério de conclusão de “analisar cerca de 20 publicações”. Essas lacunas estão explicitadas; a ausência de outras plataformas não especificadas no briefing está fora do escopo.

O que acompanhar

Recomendações

  • Acompanhar, na próxima pesquisa, para qual solução migra o tráfego após o encerramento da API do Sora: Seedance 2.5, MiniMax H3 ou Kling v3.
  • Continuar monitorando anúncios oficiais da Hugging Face e da Alibaba para verificar se a política de licença do Qwen-Image-2.1 muda.
  • Monitorar continuamente a frequência de publicações de extensões ComfyUI relacionadas ao MiniMax H3 como indicador antecedente do impulso da geração de vídeo de código aberto.
  • Na próxima coleta no X, deixar de depender de tendências regionais e usar buscas específicas, como "AI image generation", "Sora" e "Midjourney".
  • Também mudar a coleta do Reddit de uma única consulta para várias buscas pelos nomes de modelos individuais, a fim de atingir o critério de conclusão de 20 itens.
  • Verificar a suposta mudança da Midjourney para tomografia por ultrassom médico na fonte primária (midjourney.com/medical), separando-a de informações secundárias viralizadas.

Qualidade dos dados

No X, a escolha incorreta dos termos de busca resultou em 32 itens coletados e zero relacionados ao tema; portanto, não foi possível oferecer conhecimento substantivo sobre este assunto. No Reddit, uma única consulta resultou em apenas 12 tópicos, abaixo da meta de aproximadamente 20. No Bluesky, como a API oficial de busca retornou 403 durante toda a coleta, a amostragem passou a ser feita por leitura direta de contas, e não por uma busca abrangente por palavras-chave. No YouTube, páginas renderizadas em JavaScript impediram a obtenção de visualizações e datas exatas; as datas são aproximadas. O Lemmy não permite busca em todas as instâncias distribuídas, e a verificação ficou limitada às seis instâncias principais. Foi possível analisar 50 pins no Pinterest, mas, como quase não houve menções a código aberto, os dados ficaram enviesados para uma única perspectiva: a de soluções fechadas.

Resumo por plataforma

Reddit

Reddit — Notícias de IA para geração de imagens e vídeos

Onde

Os 12 tópicos coletados vieram de sete subreddits.

Subreddit Número de membros Tópicos coletados
r/generativeAI 155.851 5
r/ImagineAiArt 19.415 1
r/aivideomaking 7.414 2
r/DeepSeek 140.403 1
r/Purdue 100.714 1
r/aivideos 123.539 1
r/Instagramreality 1.155.229 1

r/generativeAI teve o maior número de tópicos, e o centro da discussão foi a própria demanda por “querer criar vídeos de IA gratuitamente”. Os subreddits especializados (r/aivideomaking, r/aivideos, r/ImagineAiArt) concentram discussões sobre ferramentas e técnicas concretas; r/DeepSeek reúne notícias de um único modelo; r/Purdue e r/Instagramreality, uma comunidade gigante com mais de 1,15 milhão de membros, tratam de casos em que conteúdo gerado por IA se infiltrou no mundo real e provocou repercussão negativa.

O que as pessoas dizem
  • A demanda por geração gratuita de vídeo por IA continua forte, mas o clima da comunidade se inclina para “entendam que isso não é viável”. No tópico nº 2, “Why do so many people expect to find a free AI video generator?” (39 pontos, 79 comentários, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/), o próprio autor observa que “Sora 2 foi lançado gratuitamente e conquistou muitos usuários, mas a OpenAI acabou encerrando-o”, concluindo que “a geração de vídeo por IA é simplesmente cara, e o gratuito não é um modelo sustentável”.
  • Em um comentário no mesmo tópico, u/buttchuckjones (4 pontos) afirma que passou de 10 GB de VRAM para uma 5080 de 16 GB para gerar localmente e diz que gostaria muito que mais pessoas no subreddit optassem pela geração local, reforçando a posição local/código aberto.
  • No tópico nº 1, “Which AI video generator can still be used for free?” (20 pontos, 68 comentários, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/), u/RioMetal (4 pontos) recomenda modelos de pesos abertos como Wan ou Minimax: “If you can go local you have plenty of them, like Wan or Minimax”. u/tuckken2 (3 pontos) compartilha uma forma concreta de uso: “Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours”.
  • No lado fechado, GPT Image 2.5 Flare é o principal assunto. No tópico nº 3, “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (92 pontos, 62 comentários, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/), u/oldboi777 (4 pontos) elogia muito o modelo, chamando-o de uma atualização incrível. Já u/Dependent_Quit_3730 (3 pontos) diz em português: “É um modelo perfeito... mas eu ainda fico com o KREA 2”; u/SeaworthinessFresh16 (2 pontos) afirma que o resultado no ComfyUI com Krea2 parece o mesmo.
  • DeepSeek, com pesos abertos, combina crescimento acelerado e escassez de oferta. O tópico nº 6, “some deepseek news, if you care” (206 pontos, 36 comentários, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/), informa que os usuários ativos diários saltaram de 120 milhões para 200 milhões (+66,7%), enquanto a capacidade computacional cresceu apenas 8,3%, causando queda de qualidade e problemas de regeneração. Como resposta, a empresa teria encomendado 160 mil unidades Ascend 960DT da Huawei. u/Equivalent-Grass-527 (6 pontos) comenta que o descompasso entre demanda e computação é provavelmente a parte mais importante.
  • A avaliação de técnicas artesanais para remover a “aparência de IA” é dividida. O tópico nº 8, “I stopped prompting for clean shots and my AI video finally stopped looking like AI” (63 pontos, 56 comentários, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/; usa Seedance 2.5), compartilhou técnicas detalhadas de prompt, mas os comentários foram céticos. u/TCristatus (9 pontos) diz que o vídeo ainda é obviamente IA; u/Biscuits4u2 (6 pontos) comenta que as pessoas precisam ser 5% mais feias para parecerem realistas, pois os rostos são perfeitos demais.
  • Casos de imagens geradas por IA aparecendo em ambientes reais estão provocando controvérsia. No tópico nº 7, “AI generated image on MSEE wall” (61 pontos, 13 comentários, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/), o layout absurdo de uma placa de circuito numa imagem gerada por IA exposta no campus universitário virou alvo de críticas. u/j909m (11 pontos) afirma: “Whoever did the PCBA layout for that IC gets an F.”
  • Mesmo em um subreddit gigante com mais de 1,15 milhão de membros, a identificação de imagens de IA gera discussão intensa. O tópico nº 12, “AI generated images on Reddit with thousands of upvotes and comments” (2.109 pontos, 341 comentários, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/), teve de longe o maior engajamento da coleta do Reddit. u/Smart-Membership-117 (405 pontos) aponta inconsistências em detalhes, como o rodapé junto ao joelho e a vegetação do lado de fora da janela; u/Negative-Raise-8286 (275 pontos) reclama que não conseguiu publicar a observação no tópico original.
  • Também há várias opiniões de que os créditos gratuitos são generosos, portanto a situação não é apenas pessimista. No tópico nº 9 (r/aivideomaking, 3 pontos, 26 comentários, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/), u/Chance-Business (2 pontos) avalia positivamente os 50 créditos gratuitos diários do Google Flow (Veo), observando que cada vídeo usa de 6 a 12 créditos. No tópico nº 4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/), u/MrBoondoggles (1 ponto) faz comentário semelhante sobre a franquia diária generosa do Google Flow para Nanobanana e Veo.
  • A mesma publicidade com código de indicação aparece em vários tópicos. u/MeatStickMcFapperton publicou comentários quase idênticos no tópico nº 2 (4 pontos) e no nº 5 (1 ponto), promovendo um código de indicação da Meta “Muse”, 42JB8K, com a promessa de “1 bilhão de tokens gratuitos”.
Sinais
  • Tendência de alta: referências à geração local/de vídeo com pesos abertos — Wan, MiniMax H3, FramePack e ComfyUI — aparecem espontaneamente na maioria dos tópicos sobre querer opções gratuitas. O forte crescimento de usuários do DeepSeek (+66,7%) também é um sinal claro de alta.
  • Ceticismo e rejeição: há forte resistência ao próprio pedido por “vídeo de IA gratuito”. u/activematrix99 (2 pontos) no tópico nº 4 faz uma comparação dura: exigir comida grátis em um restaurante e perguntar o que torna alguém importante o suficiente para recebê-la de graça. Comentários repreendendo a expectativa de vídeo gratuito recebem avaliações altas em vários tópicos, sinalizando uma mudança no humor da comunidade.
  • Fato inesperado: o mesmo código de indicação (42JB8K) e argumentos promocionais muito semelhantes aparecem repetidamente em tópicos diferentes, indicando alta possibilidade de comentários publicitários ou autopromoção infiltrados em discussões orgânicas. É preciso cautela ao interpretar os números.
  • Conflito: o grupo que considera a geração gratuita de vídeo uma ilusão (vários comentários bem avaliados nos tópicos nº 2, nº 9 e nº 10) se opõe diretamente ao grupo que considera generosas as franquias gratuitas de Google Flow, Veo, Muse e Nanobanana (tópicos nº 4, nº 5 e nº 9). Ambos se baseiam em experiências reais, portanto não há uma resposta simples sobre qual lado está certo.
  • Há também a percepção de que a diferença prática entre fechado e aberto é pequena: no tópico nº 3, GPT Image 2.5 Flare, fechado, e KREA 2 com ferramentas abertas são descritos como resultados que parecem iguais, sugerindo que a diferença de qualidade na geração de imagens praticamente desapareceu para o usuário.
Limites
  • O termo de busca usado pela ferramenta de coleta foi apenas “Image and Video Generation AI News”. Em vez da meta do briefing de analisar cerca de 20 publicações por rede social, foram obtidos somente 12 tópicos de sete subreddits. Buscas adicionais por termos específicos como “Sora”, “Veo”, “Kling”, “Stable Diffusion”, “Flux” e “open source” / “closed source” provavelmente encontrariam tópicos mais numerosos e mais focados.
  • O tópico nº 9 não inclui o corpo da publicação nos dados coletados; seu conteúdo foi inferido apenas pelos comentários.
  • Conforme as instruções do playbook desta etapa, o Reddit não foi pesquisado nem navegado diretamente; a verificação ficou restrita a output/reddit.threads.md / .json já coletados. Discussões ausentes desses arquivos — como tópicos específicos de determinados modelos — não fazem parte deste relatório.

X

X — Notícias de IA para geração de imagens e vídeos

Contas

Foram verificadas as 32 publicações de 31 contas em output/x.posts.md, mas nenhuma conta tratava de IA de geração de imagens ou vídeos. A distribuição se concentrou em áreas sem relação com o tema:

Categoria Contas correspondentes
Criptomoedas/ações ($SDOG, $AMD, Bitcoin) @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows
Situação entre Ucrânia e Rússia @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite
Fofocas de entretenimento/política relacionadas a Lauren @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui
Esportes/lutas relacionados a Muhammad @CylinderAnalyst, @bullyb170 (2 publicações)
Religião @TaymiFawaid
Contas pessoais relacionadas à tendência de Zagreb @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy

Há contas que obtêm grande alcance com uma única publicação — por exemplo, @AlaskanTzar, com 34.704 curtidas — e outras que acumulam postagens menores. Ainda assim, nenhuma divulgava notícias ou ferramentas de IA para geração de imagem e vídeo.

Publicações

Como não há publicações relacionadas ao tema nos dados coletados, não é possível relatar os habituais “5 a 12 insights” sobre IA de geração de imagens e vídeos. Como referência, seguem alguns conteúdos que foram coletados:

  1. #8 @TedPillows (2.829 curtidas, 293 repostagens, cerca de 486.000 visualizações, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562) — análise do preço do Bitcoin: “If Bitcoin breaks $83,000, the cycle bottom will be confirmed...”; sem relação com IA.
  2. #30 @AlaskanTzar (34.704 curtidas, 1.083 repostagens, cerca de 1.500.000 visualizações, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636) — meme sobre Ucrânia e Rússia: “Back in 2017 Russia and Ukraine were ratioing each other on twitter”. Foi a publicação de maior engajamento da coleta, mas não tem relação com o tema.
  3. #22 @Katauroraaa (2.840 curtidas, cerca de 309.000 visualizações, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180) — publicação humorística sobre Rússia e países bálticos.

Nenhuma delas faz qualquer referência a IA de geração de imagens ou vídeos, seja aberta ou fechada.

Sinais
  • O único “sinal” possível nos dados é que os termos de busca desta etapa não tinham relação com o tema. A lista do Explore do X foi usada diretamente como busca, levando a resultados sobre criptomoedas, geopolítica, fofocas e esportes.
  • Não foi observada sequer uma discussão substantiva sobre crescimento, ceticismo ou qualquer outro aspecto de IA de geração de imagens e vídeos.
Limites
  • Os termos de busca não tinham relação com o tema: como consta no início de output/x.posts.md, foram usados "$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR". Eles foram copiados da “lista Explore do próprio X”, sem qualquer busca por “geração de imagens por IA”, “geração de vídeos por IA”, “Sora”, “Midjourney” ou “Stable Diffusion”.

    # Tendência Localização indicada pelo X
    1 $SDOG Em alta na Croácia
    2 Bitcoin Negócios e finanças · Em alta
    3 Zelensky Política · Em alta
    4 Lauren Em alta na Croácia
    5 Muhammad Política · Em alta
    6 Russians Política · Em alta
    7 Zagreb Em alta na Croácia
    8 Ukraine Política · Em alta
    9 Weeknd Em alta na Croácia
    10 USSR Em alta na Croácia

    Essa lista do Explore parece estar ligada geograficamente à região da Croácia, onde o servidor desta sessão aparenta estar localizado, e não representa tendências globais.

  • O critério de conclusão não foi atendido: embora tenham sido coletadas 32 publicações, nenhuma era relevante para a IA de geração de imagens e vídeos; portanto, o relatório não fornece conhecimento substancial sobre esse tema no X.

  • A sessão estava válida — a coleta ocorreu com login e não houve mensagem de ausência de posts —, e não houve falha da busca ou navegação no X. O problema foi exclusivamente a seleção de termos na fase de coleta.

  • Em uma próxima execução, será necessário coletar novamente com consultas apropriadas, como “AI image generation”, “AI video generation”, “Sora 2”, “Midjourney”, “Stable Diffusion”, “Nano Banana” e “Veo”.

YouTube

YouTube — Notícias de IA para geração de imagens e vídeos (código fechado/código aberto)

Canais
  • Matt Wolfe (@mreflow) — canal de notícias de IA com mais de 925.000 inscritos. Publica análises frequentes de novidades fechadas, como Nano Banana Pro e Nano Banana 2. (https://www.youtube.com/@mreflow)
  • Theoretically Media — especializado em análises e testes práticos de ferramentas abertas de vídeo por IA, como LTX-2 / LTX-2.3 e modelos HunyuanVideo. (https://theoreticallymedia.com/videos/)
  • Aitrepreneur — destaca-se por explicações de fluxos de trabalho no ComfyUI e aborda a instalação local de modelos recentes de vídeo aberto, como LTX-2.3. (Integração com Patreon: https://www.patreon.com/aitrepreneur)
  • Outros canais médios de análise de ferramentas de IA que abordam Z-Image Turbo, Flux.2 e HunyuanVideo 1.5, entre outros. Os nomes dos canais foram confirmados apenas pelos títulos dos vídeos, e seus números de inscritos não foram verificados — ver Limites.
Vídeos
  1. Google venceu a geração de imagens (nem é disputa) — ANÁLISE DO NANO BANANA PRO
    data: 2025-11-26 | visualizações: não confirmado | https://www.youtube.com/watch?v=UV9GqinedQ8
    O Nano Banana Pro (Gemini 3 Pro Image), do Google DeepMind, é apresentado como muito superior aos sistemas existentes de geração de imagem, com ênfase na precisão de renderização de texto e no fotorrealismo.

  2. O Nano Banana Pro do Google está levantando preocupações sobre imagens de IA realistas
    data: fim de novembro de 2025 | visualizações: não confirmado | https://www.youtube.com/watch?v=RmmrVCUGYp8
    Vídeo de notícias sobre riscos de deepfakes e desinformação decorrentes do aumento do realismo.

  3. GPT Image 2.5 É INCRÍVEL: análise completa do novo modelo de imagens da OpenAI
    data: aproximadamente 2026-09-08 (publicado há duas semanas) | visualizações: não confirmado | https://www.youtube.com/watch?v=DY6TkI8XtkQ
    Explicação completa do GPT Image 2.5 da OpenAI, incluindo redução de 50% na latência de geração e o recurso Sketch, que transforma desenhos à mão em imagens de IA.

  4. Desenhe com ChatGPT Images 2.5
    data: início de setembro de 2026 | visualizações: não confirmado | https://www.youtube.com/watch?v=imPtIEAEHSU
    Demonstração do novo recurso que permite digitar “@Sketch” no ChatGPT e transformar diretamente um desenho à mão em imagem de IA.

  5. O estado do vídeo por IA em 2026: Sora 2, Veo 3.1, Kling 3.0 e fluxos de prompting cinematográfico
    data: 2026-03-20 | visualizações: não confirmado | https://www.youtube.com/watch?v=vtJzDgmWVWc
    Vídeo de panorama que compara o trio Sora 2, Veo 3.1 e Kling 3.0, além de técnicas de prompt cinematográfico.

  6. ANÁLISE Seedance 2.5: explicação do novo modelo de vídeo por IA da ByteDance
    data: 2026-08-01 | visualizações: não confirmado | https://www.youtube.com/watch?v=LTAOvsH6cjM
    O Seedance 2.5 da ByteDance gera tomadas únicas de 30 segundos e aceita até 50 imagens de referência, chamando atenção por uma duração superior à de Sora 2 e Veo 3.1. É uma solução fechada.

  7. Kling 2.6 Pro DESTRÓI a concorrência — Veo 3.1 e Sora 2 Pro
    data: 2025-12-19 | visualizações: não confirmado | https://www.youtube.com/watch?v=-vRsjX9seUU
    Vídeo de benchmark que afirma que o Kling 2.6 Pro já superava Veo 3.1 e Sora 2 Pro antes da chegada do Kling 3.0. O impulso continuou com o Kling 3.0, lançado em 2026-02-05 e líder com ELO de 1.243.

  8. Z Image Turbo (GRÁTIS): este modelo de IA aberto mudou a geração de imagens para sempre! (como o nano banana pro)
    data: 2025-11-27 | visualizações: não confirmado | https://www.youtube.com/watch?v=sPQQPpQ9X4E
    Modelo de 6 bilhões de parâmetros sob licença Apache-2.0, lançado pela equipe Tongyi-MAI da Alibaba. Oferece inferência rápida em oito etapas em GPUs de consumo com 16 GB e é apresentado como comparável ao Nano Banana Pro.

  9. Novo modelo aberto DESTRÓI o Flux 2 — tutorial Z-Image + Promptus
    data: 2025-12-11 | visualizações: não confirmado | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
    Tutorial comparativo que afirma que o Z-Image supera o Flux.2.

  10. FLUX.2, O MELHOR MODELO OPEN SOURCE, LOCAL E GGUF
    data: aproximadamente novembro a dezembro de 2025 | visualizações: não confirmado | https://www.youtube.com/watch?v=t4eVxZPP0b0
    Guia para executar localmente no ComfyUI a série FLUX.2 da Black Forest Labs, incluindo Pro, Flex, Dev e Klein, este sob Apache-2.0. Seus pontos fortes são saída de até 4 MP e consistência com até dez referências.

  11. O “Santo Graal” do vídeo por IA aberto chegou (LTX-2)
    data: início de janeiro de 2026 | visualizações: não confirmado | https://www.youtube.com/watch?v=27UAb_Tlv4E
    O LTX-2, lançado pela Lightricks em 2026-01-06, é elogiado como o primeiro modelo aberto de vídeo em “qualidade de produção”, com 4K nativo, sincronização de áudio e divulgação completa dos pesos e do código de treinamento.

  12. Tencent HunyuanVideo 1.5 foi oficialmente aberto!
    data: primeira metade de 2026 | visualizações: não confirmado | https://www.youtube.com/watch?v=MJShdc8tkkA
    A Tencent divulgou o HunyuanVideo 1.5, reduzindo os parâmetros de 13B para 8,3B sem perder desempenho. A capacidade de rodar em GPUs de consumo é valorizada.

  13. Qwen-Image 2.1 | demonstração de acesso antecipado
    data: aproximadamente 2026-09-20 (publicado há dois dias) | visualizações: não confirmado | https://www.youtube.com/watch?v=tP_gGGJzEqg
    Demonstração de acesso antecipado ao Qwen-Image-2.1, divulgado pela Alibaba Qwen em 2026-09-20. Ele comprime o gerador visual para 7B, unifica geração e edição e oferece saída RGBA transparente; porém, sua licença é de pesquisa não comercial.

Sinais
  • A competição em código fechado por velocidade e fotorrealismo está se intensificando: GPT Image 2.5 (2026-09-08, 50% menos latência) e Nano Banana Pro → Nano Banana 2 (2026, duas vezes mais rápido) mostram OpenAI e Google lançando atualizações em intervalos de poucas semanas. Em vídeo, comparações entre Sora 2, Veo 3.1 e Kling 3.0 se tornaram formato recorrente.
  • Sora será encerrado junto com sua API: Sora Web/aplicativo já foi encerrado em 2026-04-26, e a API deve terminar em 2026-09-24, dois dias após a elaboração deste relatório. A causa apontada é uma rentabilidade desfavorável, com cerca de US$ 1 milhão de custo diário frente a aproximadamente US$ 2,1 milhões de receita acumulada; é citado como exemplo de que vídeo por IA fechado não é um mercado de vencedor absoluto.
  • O ecossistema aberto avança para modelos leves e rápidos: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (gerador visual comprimido para 7B) e HunyuanVideo 1.5 (13B → 8,3B) apontam todos na direção de reduzir parâmetros sem sacrificar qualidade e rodar em GPUs de consumo.
  • A fronteira entre pesos abertos e licença comercial é um ponto de debate: uma parte do Flux.2, Klein, é completamente aberta sob Apache 2.0; já Qwen-Image-2.1 divulga os pesos, mas declara licença exclusiva para pesquisa não comercial, alimentando a discussão sobre se deve ser chamado de código aberto.
  • LTX-2 se consolida como benchmark de vídeo aberto: a combinação de 4K nativo, sincronização de áudio e código de treinamento divulgado é inédita, e vários canais o comparam a Wan 2.2 e HunyuanVideo 1.5 para geração local de vídeo.
  • ComfyUI é a infraestrutura comum de fato: Flux.2, Z-Image, LTX-2, Wan e HunyuanVideo receberam suporte no primeiro dia e muitos vídeos de fluxos de trabalho no ComfyUI; quase todas as análises de código aberto incluem testes práticos nele.
Limites
  • As páginas de resultados do YouTube (/results?search_query=...) e de vídeos (/watch?v=...) são renderizadas em JavaScript. O WebFetch conseguiu obter apenas links de navegação do rodapé, portanto não foi possível acessar diretamente visualizações, nomes de canais, datas de publicação ou texto de legendas/comentários. As datas deste relatório são estimativas baseadas em snippets de busca e artigos relacionados; todas as visualizações permanecem como “não confirmado”.
  • Devido a essas limitações, não foi possível realizar o procedimento ideal do playbook de abrir e analisar individualmente cerca de 20 publicações. Em vez disso, foram coletados títulos, pistas de canais e períodos de publicação pelo WebSearch. Foram encontrados mais de 30 títulos no total, dos quais os 13 acima foram selecionados como exemplos representativos.
  • Vídeos sobre Qwen-Image-2.1 tinham apenas dois dias desde o lançamento, portanto ainda havia poucas análises. É provável que o número cresça nas próximas semanas.

Bluesky

Bluesky — Notícias de IA para geração de imagens e vídeos

Contas
  • Ed Zitron (edzitron.com) — crítico da indústria de tecnologia/IA (Where's Your Ed At); divulgou no Bluesky a história do fim do Sora, com grande pico de engajamento.
  • Simon Willison (simonwillison.net) — pesquisador independente de IA; testa regularmente novos modelos, incluindo geradores de imagem, com seus testes de “pelicano”, e publica as artes conceituais geradas no processo.
  • Adina Yakup (adinayakup.bsky.social) — defensora de ML aberto na Hugging Face; é, de longe, a cronista mais ativa de novos lançamentos de modelos de imagem/vídeo com pesos abertos no Bluesky, com publicações quase semanais.
  • useapi.net (useapi.bsky.social) — revendedora de API REST para geração de vídeo, imagem e música por IA (Veo, Kling, Seedance, Runway, MiniMax etc.); publica comparações frequentes entre modelos.
  • GPT Image Prompt (gptimageprompt.bsky.social) — conta de compartilhamento de prompts voltada à ferramenta ChatGPT/GPT Image da OpenAI.
  • Stable Diffusion online AI (stablediffusion.bsky.social) — conta comunitária de longa data para compartilhamento de prompts Stable Diffusion e desafios de arte por IA.
  • Stability AI (oficial) — está silenciosa sobre imagem/vídeo desde aproximadamente novembro de 2025; suas publicações recentes tratam quase exclusivamente de Stable Audio e parcerias com gravadoras, como Warner e Universal.
Publicações
  1. Ed Zitron — OpenAI encerrando o Sora (2026-03-24, 👍 3.572 · 🔁 984)
    “Tanto o Wall Street Journal quanto o The Information confirmam que a OpenAI está encerrando o Sora — tanto o aplicativo quanto o acesso ao seu modelo de geração de vídeo para desenvolvedores. É uma grande mudança que sugere certo desespero.”
    https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
    (Isso está alinhado a reportagens de que o aplicativo Sora foi encerrado em 26 de abril de 2026 e a API deve ser desativada em 24 de setembro de 2026 — dois dias após esta pesquisa.)

  2. Simon Willison — criando com ChatGPT Images 2.5 (2026-09-10, 👍 56 · 🔁 5)
    “Aqui está um modelo Blender de um ovo Fabergé com tema Pluribus que pedi ao GPT-6 Astra para criar — gerei a imagem conceitual usando ChatGPT Images 2.5.”
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  3. Adina Yakup — HyperFlow (destilação aberta de vídeo) (2026-09-19, 👍 6 · 🔁 1)
    “HyperFlow⚡ Nova variante MiniMax-H3 da Video Rebirth — LoRA de pesos abertos em 8 etapas — 3× mais rápida com autodestilação livre de dados — vídeo e áudio estéreo preservados.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b

  4. Adina Yakup — Lance da ByteDance (2026-05-19, 👍 48 · 🔁 5)
    “A ByteDance lançou Lance👀 — este modelo de 3B consegue gerar e editar imagens, gerar e editar vídeos, e entender imagens e vídeos.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b

  5. Adina Yakup — ERNIE-Image da Baidu (2026-04-14, 👍 1)
    “A Baidu acabou de lançar ERNIE-Image na Hugging Face🔥 — DiT 8B — Image/Image Turbo — Apache 2.0.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i

  6. Adina Yakup — Matrix-Game 3.0 da Skywork (2026-03-27, 👍 13 · 🔁 2)
    “Matrix-Game 3.0🔥 modelos interativos de mundo em tempo real da Skywork — ✨ 720p a 40 FPS com um modelo de 5B.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x

  7. Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
    “LongCat-Video-Avatar 1.5🐱 um modelo de geração de vídeo de avatar guiado por áudio.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i

  8. Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
    “HiDream-O1-Image está recebendo muita atenção🔥.”
    https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26

  9. useapi.net — alternativas de API ao Sora 2 (2026-09-21, 👍 0)
    “Alternativas de API ao Sora 2 comparadas, com código: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo”
    https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27

  10. useapi.net — MiniMax H3 vs Seedance 2.0 (2026-07-31, 👍 0)
    “MiniMax H3 frente a frente com Seedance 2.0 usando referências omni idênticas #minimax #seedance #ai #api”
    https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x

  11. GPT Image Prompt — compartilhamento de prompt de meme (2026-05-07, 👍 0)
    “Tema: Text to Meme — prompt no comentário — bem-vindo ao nosso site: gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts”
    https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226

Sinais
  • O encerramento do Sora é a história de código fechado sobre a qual o Bluesky realmente fala. A publicação de Ed Zitron é o item de maior engajamento encontrado em toda a busca, com 3,5 mil curtidas, superando amplamente qualquer lançamento de modelo. O público de IA do Bluesky tende mais a relatos e críticas da indústria do que ao marketing dos próprios laboratórios.
  • As notícias de código aberto no Bluesky são praticamente a pauta de uma só pessoa. Quase todos os lançamentos concretos de pesos abertos encontrados — ERNIE-Image da Baidu, Lance da ByteDance, Matrix-Game 3.0 da Skywork, LongCat-Video-Avatar, HyperFlow e HiDream-O1-Image — vieram de Adina Yakup, da Hugging Face. O padrão é fortemente impulsionado por laboratórios chineses, como Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork e Tencent, sob licenças do tipo Apache-2.0.
  • Nenhum grande laboratório fechado mantém presença ativa no Bluesky para lançamentos de imagem/vídeo. Não surgiram contas oficiais de OpenAI, Google DeepMind, Adobe ou Midjourney; a cobertura de ferramentas fechadas vem de testadores independentes, como Simon Willison, ou revendedores de API, como useapi.net.
  • Publicações técnicas sobre ferramentas têm engajamento quase nulo — 0 a 13 curtidas para comparações da useapi.net e a maioria dos lançamentos de Adina Yakup — em comparação a narrativas amplas sobre o destino de empresas, como milhares de curtidas para a história do Sora. Nessa plataforma, o engajamento acompanha a narrativa da indústria, não a novidade técnica.
  • Vários polos óbvios de arte por IA estão mortos ou inativos no Bluesky: contas oficiais e bots de Civitai, a conta do ComfyUI e a própria conta da Stability AI, que migrou para conteúdo de Stable Audio e gravadoras e não publica sobre modelos de imagem Stable Diffusion desde meados de 2025.
Limites
  • A API pública de busca por palavra-chave está bloqueada. app.bsky.feed.searchPosts retornou HTTP 403 Forbidden em todas as tentativas — consultas com várias palavras, uma palavra e formulações diferentes — via WebFetch. A interface bsky.app/search também é JavaScript renderizado no cliente e não retornou conteúdo de publicações. Assim, não foi possível fazer uma busca real por palavras-chave; os dados foram montados encontrando contas relevantes via busca web site:bsky.app e lendo diretamente seus históricos com a API pública AT Protocol getAuthorFeed, que funcionou.
  • Diversas contas promissoras estavam vazias ou inativas: civitai.bsky.social tinha feed vazio, civitai-bot.bsky.social tinha última publicação em maio de 2024, real-comfyui.bsky.social tinha feed vazio, runwayml.bsky.social resolvia para uma conta pessoal sem relação, midjourney-api.bsky.social era um revendedor não oficial com uma postagem de novembro de 2024, e qwen1.bsky.social era uma conta de fã com uma postagem de fevereiro de 2025.
  • O Qwen-Image-2.1 da Alibaba — modelo unificado de geração/edição de imagens com pesos abertos e 7B, supostamente lançado em 2026-09-20 — não apareceu em nenhuma publicação do Bluesky encontrada durante esta pesquisa. Ele pode ainda não ter sido coberto pelas contas acompanhadas ou estar fora do alcance da API de busca bloqueada.
  • Ethan Mollick (emollick.bsky.social) e Tanishq Abraham (iscienceluvr.bsky.social) foram verificados e descartados como fontes para esta análise: o primeiro se concentra em notícias gerais de LLMs e o segundo em artigos acadêmicos antigos, não em novidades atuais de geração de imagens e vídeos.
  • Dado o bloqueio de busca, a meta de amostragem de aproximadamente 20 posts foi atingida em conjunto pela leitura dos históricos completos de autores — cerca de 30 posts de Adina Yakup, 15 da useapi.net, 20 de Stable Diffusion, além dos feeds recentes de Simon Willison e Ed Zitron —, e não por uma única busca classificada. Trata-se de uma amostra direcionada por contas, não de uma varredura exaustiva por palavras-chave.

Lemmy

Lemmy — Tendências recentes em IA para geração de imagens e vídeos

Comunidades
  • !«メールアドレス» (5.713 membros) — principal comunidade de discussão de tecnologia aberta para geração de imagens e vídeos por IA. Novidades de ferramentas no GitHub e Hugging Face aparecem quase diariamente.
  • !«メールアドレス» (2.361 membros) — espaço para publicar criações feitas com Stable Diffusion e outros modelos de pesos abertos.
  • !«メールアドレス» (1.599 membros) — dedicado a arte de IA no estilo anime e limitado a conteúdo seguro para o trabalho.
  • !«メールアドレス» (52 membros, 157 ativos mensais) — espelha diretamente tópicos do Reddit relacionados a IA. Notícias de código fechado, como Sora e Midjourney, frequentemente chegam por esse canal.
  • !«メールアドレス» (204 membros, com mistura de posts da instância lemmy.bestiver.se) — espelho do Hacker News, onde aparecem notícias de lançamentos como Qwen-Image e Nano Banana.
  • !«メールアドレス» — comunidade de tom sarcástico sobre a indústria de IA. Notícias sobre as dificuldades da Midjourney tiveram origem aqui.
  • !«メールアドレス» (8.265 membros) — grande comunidade crítica da IA generativa. Não é voltada a notícias em si, mas ajuda a medir o clima geral do Lemmy.
  • !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — grupos de arte com Stable Diffusion voltados a nichos específicos. Há publicações, porém suas pontuações são geralmente de um dígito ou negativas.
Publicações

Relacionadas a código fechado

  1. A OpenAI encerrará a API do Sora na próxima semana enquanto um concorrente chinês acaba de levantar US$ 3 bilhões — !«メールアドレス», 2026-09-20, pontuação 1. Contrasta o fim da API do Sora com uma grande captação de recursos por empresas chinesas.
  2. A Midjourney pivota para Theranos: CT por ultrassom — !«メールアドレス», 2026-06-19, pontuação 40. A notícia de que a Midjourney teria mudado bruscamente da geração de imagens para equipamentos médicos de CT por ultrassom foi a publicação relacionada à Midjourney com maior alcance no Lemmy.
  3. Scanner de CT por ultrassom da Midjourney — !hackernews, 2026-06-18, pontuação 2. Espelho de HN da fonte primária acima, em midjourney.com/medical.
  4. Publicação via Midjourney quer que estúdios de Hollywood revelem detalhes do uso de IA — !«メールアドレス», 2026-07-05, pontuação 73. Apresentação de um artigo da TechCrunch que teve pontuação relativamente alta em uma comunidade de tecnologia.
  5. Google descontinua discretamente seu recurso Earth AI um dia após o lançamento, depois que usuários criaram imagens impróprias — !ai_reddit, 2026-08-07, pontuação 1.
  6. Seedream 5.0 Pro chegou: comparação honesta e análise técnica — !ai_reddit, 2026-07-10, pontuação 1. Análise do modelo fechado de imagens da ByteDance.
  7. Nano Banana 2 Lite — !hackernews, 2026-06-30, pontuação 1. Anúncio do modelo leve de geração de imagens do Google DeepMind.
  8. MAI-Image-2.5 da Microsoft alcança o Nano Banana 2 do Google em benchmarks — !ai_reddit, 2026-05-28, pontuação 1.

Relacionadas a código aberto

  1. Qwen-Image-2.1: criação de imagens compacta, eficiente e unificada — !hackernews, 2026-09-20, pontuação 1. Versão mais recente do modelo de geração de imagens com pesos abertos da Alibaba Qwen.
  2. supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, pontuação 1. Extensão para geração de vídeos longos com MiniMax H3, superando limites de memória.
  3. Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — mesma comunidade, 2026-09-16, pontuação 3. Criador de prompts para MiniMax H3.
  4. nazgut/ComfyUI-MiniMaxH3-CLSS — mesma comunidade, 2026-09-01, pontuação 0. Geração de vídeo com áudio, de duração arbitrária, em 16 GB de VRAM.
  5. filliptm/ComfyUI-FL-MiniMaxH3 — mesma comunidade, 2026-08-30, pontuação 5.
  6. Luisacaotica/ComfyUI-MiniMaxH3Mod — mesma comunidade, 2026-08-20, pontuação 7. Adaptador para compactação de imagens/vídeos de referência sem treinamento.
  7. Testei Wan para geração de vídeo por IA — !«メールアドレス», 2026-09-10, pontuação -9 (mal recebido/controverso). Análise de geração de vídeo com o modelo Wan de pesos abertos.
  8. Boogu-Image-0.1 — modelo fundamental eficiente de geração de imagens — !«メールアドレス», 2026-06-17, pontuação 5. Novo modelo-base aberto de imagens.
Sinais
  • O ecossistema ComfyUI em torno do MiniMax H3 continua crescendo entre agosto e setembro. Pelo menos cinco extensões/ferramentas relacionadas foram publicadas em !«メールアドレス» entre 2026-08-07 e 2026-09-16, sem interrupção no ritmo. Nessa comunidade, “MiniMax H3” é a principal palavra-chave do impulso da geração de vídeo aberta.
  • As notícias de código fechado têm pouca discussão nativa no Lemmy e são quase todas menções de segunda mão por espelhos do Reddit (!ai_reddit) ou Hacker News (!hackernews), com pontuações normalmente entre 1 e 3. Praticamente não há debate primário originado no Lemmy.
  • O único tema de código fechado com grande alcance foi a mudança da Midjourney de “geração de imagens para scanner médico de CT por ultrassom” em !techtakes, com pontuação 40, que viralizou em uma comunidade de forte tom satírico.
  • Comunidades de compartilhamento de trabalhos, como stable_diffusion_art e share_anime_art, têm alto volume de publicações — em geral várias por dia —, mas pontuações de um dígito ou poucas dezenas. O foco é compartilhar criações, e não notícias.
  • A comunidade crítica !«メールアドレス» (8.265 membros) é maior que a comunidade favorável à geração de IA !stable_diffusion (5.713 membros), sugerindo que a composição geral do Lemmy é bastante crítica à tecnologia de IA generativa.
Limites
  • A API de busca do Lemmy faz apenas busca textual por palavras-chave e tem baixa relevância de classificação. Consultas genéricas como “Sora” e “Veo” trazem muitas notícias políticas irrelevantes. Para filtrar a relevância, foram examinados de 15 a 20 resultados por termo, mais de 100 no total, mas apenas pouco mais de uma dezena se encaixou no tema.
  • O Lemmy é distribuído entre instâncias e não há busca em todas elas. Foram pesquisadas principalmente lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se e lemmy.today; discussões em instâncias pequenas e isoladas podem não estar visíveis.
  • Não foram encontradas publicações relevantes no Lemmy para Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2 ou HunyuanImage, embora sejam modelos comentados em outras plataformas; as buscas retornaram zero resultados ou conteúdos sem relação.
  • Em geral, o Lemmy é pequeno como espaço de notícias rápidas sobre geração de imagens e vídeos por IA. Sua atualidade depende de espelhos de Reddit/Hacker News, e seu conteúdo próprio se concentra no compartilhamento de ferramentas de implementação para rodar modelos de pesos abertos no ComfyUI.

Pinterest

Pinterest — Notícias de IA para geração de imagens e vídeos

Temas visuais
  • A palavra “AI” com brilho neon e imagens de robôs/placas de circuito são a abreviação visual padrão do Pinterest para “IA” — chips brilhantes, cabeças e mãos robóticas holográficas e circuitos de partículas usados como arte de capa genérica, não para ilustrar uma ferramenta ou notícia específica [1, 2, 8, 22, 25, 28, 29, 31, 39, 49].
  • Miniaturas de listas numeradas “Best AI Video/Image Generator” — manchetes em destaque e grades de logos de aplicativos como Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo e Adobe Firefly — são o formato mais comum de toda a coleção [7, 13, 20, 30, 32, 33, 41, 43].
  • Miniaturas de reações de youtubers sem rosto — homem barbudo surpreso ou chocado, fones de ouvido, fundo desfocado de explosão — acompanhadas por logos de grandes empresas, usadas para vender vídeos de resumo de “AI NEWS” [6, 19, 40].
  • Cards datados de resumos “Notícias de IA de hoje/da semana”, estilizados como mini capas de jornais ou carrosséis de Instagram, que resumem várias manchetes reais por card [17, 35, 44, 47].
  • Demonstrações de “identifique a IA” e realismo — tenista fotorrealista com a legenda “This is AI”, foto de gato marcada como “FAKE” — vendem o realismo da mídia gerada, não um produto específico [5, 23].
  • Demonstração de transferência de estilo com personagem consistente — um pin do Lumalabs que transforma um vídeo-fonte em quatro estilos (blocos de madeira, origami, blocos de brinquedo e flores), seguindo o formato viral “transforme isto em material X” [10].
  • Anúncios de serviços freelance e renda extra oferecendo “vídeo de IA para sua marca”, com número de WhatsApp e endereço de Gmail incorporados à imagem [24].
  • Infográficos introdutórios que explicam o pipeline em etapas — prompt → espaço latente → remoção de ruído → quadros → resultado — destinados a pessoas que ainda não sabem como a geração funciona [3, 36].
Pins de destaque
  • #9 — página oficial do produto Veo 2 (“Nosso modelo de geração de vídeo de última geração”, com chamada para cadastro no VideoFX). Marketing real de produto fechado, não uma lista. https://www.pinterest.com/pin/716705728243313502/
  • #10 — Lumalabs: “Feito de blocos de madeira / arte em papel dobrado de origami / blocos de brinquedo coloridos / flores”: um vídeo-fonte re-renderizado em quatro estilos consistentes. https://www.pinterest.com/pin/308144799526598925/
  • #17 — “4 grandes atualizações de IA: notícias reais, impacto real.” Reúne GPT-6 Astra da OpenAI, Gemini mais agêntico em Gmail/Drive/Docs/Slides/Chat, vídeo e som generativos integrados à linha do tempo do Adobe Premiere e a Série E de US$ 2 bilhões da Cognition, avaliada em US$ 48 bilhões. https://www.pinterest.com/pin/982558843745608433/
  • #20 — gráfico de decisão “AI Image Video: Best Quality vs Best Free”, o mapa de imagem única mais claro das ferramentas pagas atuais — ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber e Synthesia — comparadas às gratuitas — Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free e Runway Free. https://www.pinterest.com/pin/37295503160959330/
  • #26 — card de notícia: “ByteDance e Hollywood chegam a acordo global sobre direitos autorais em IA” — ByteDance e a Motion Picture Association concordam em reforçar a proteção de propriedade intelectual nas ferramentas de geração de imagem e vídeo da ByteDance. https://www.pinterest.com/pin/1074530792376376121/
  • #27 — infográfico de ética de IA/detector de voz que sinaliza resultado de análise de voz “97% provavelmente gerado por IA”, ao lado de painéis sobre “geradores de vídeo por IA” e “ética de IA e engenharia de prompts” — ansiedade popular sobre confiar em mídia gerada. https://www.pinterest.com/pin/951104015101996491/
  • #32 — “22 melhores e gratuitos geradores de vídeo por IA”, a maior seleção de ferramentas do conjunto; suas “5 melhores escolhas” colocam Kling AI e Hailuo AI acima de Runway e Pika em realismo. https://www.pinterest.com/pin/128493395623874987/
  • #35 — “Notícias de IA de hoje, 20 de maio de 2026”: resumo do Google I/O 2026 — Gemini 3.5 Flash, Gemini Omni, agente Gemini Spark e óculos inteligentes Android XR. https://www.pinterest.com/pin/652670171044638578/
  • #44 — jornal simulado “Esta semana em notícias de IA” (15 de agosto de 2026), com manchetes sobre “Open Models / Open weights”, “Sovereign AI” e “Agent Harness” — o único pin de toda a coleção que ao menos menciona modelos de pesos abertos, e apenas como chamada de manchete, não como demonstração. https://www.pinterest.com/pin/644577765463965693/
  • #48 — “Amuse 3.0”, lançamento de uma ferramenta de criação de arte por IA local apoiada pela AMD — um dos poucos pins que cita um lançamento específico de produto em vez de uma lista genérica ou card de notícias com logos. https://www.pinterest.com/pin/4601060441986715264/
Sinais
  • Kling AI e Hailuo AI chegaram ao grupo principal ao lado de Runway, Pika e Luma em quase todas as listas coletadas ([7, 13, 30, 32, 41, 43]) — um conjunto de principais opções mais amplo do que o duopólio Runway/Pika de um ano antes.
  • A ofensiva Veo/Gemini do Google é a história fechada mais visível na plataforma, reaparecendo em pins independentes de notícias de IA — lançamento do Veo 2, Gemini 3.5/Omni/Spark e óculos Android XR no I/O 2026 —, em vez de depender de uma única publicação viral.
  • A OpenAI aparece principalmente como “sopa de logos”, com uma única menção concreta ao Sora-2 (#4, uma gravação de tela borrada de uma ferramenta de terceiros, “zeely.ai”, rodando no modo “sora-2-video-ad”), algo pouco expressivo em comparação à sua presença habitual em outras plataformas.
  • A ansiedade sobre deepfakes e autenticidade é recorrente, não isolada: há um pin de conteúdo marcado como “FAKE”, uma leitura de detector de voz com 97% de probabilidade de IA e um gráfico “Jornalismo humano vs. mídia gerada por máquina” surgindo independentemente ([5, 16, 27]).
  • O enquadramento de monetização/renda extra é explícito: anúncios de serviços de vídeo por IA com contatos incorporados ao pin (#24), propostas de “canal sem rosto” e marketing de conteúdo (#23, #25). O público de vídeo por IA no Pinterest parece inclinado a criadores que querem vender ou escalar conteúdo, não a pesquisadores.
  • O código aberto está essencialmente ausente. Em todos os 50 pins, não há menção a Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi ou links do GitHub/HuggingFace. O único vestígio é a expressão “Open Models. Open weights.” como uma manchete dentro de uma capa simulada de jornal de IA (#44), nunca como pin próprio, logo de ferramenta ou demonstração. Para este tema, o Pinterest é quase inteiramente marketing SaaS fechado e listas SEO de “melhores”; quem dependesse apenas dessa plataforma não saberia que existe uma cena de geração aberta de imagens e vídeos.
Limites
  • A tabela pinterest.pins.md produzida pelo trabalhador não tinha seções por gênero — havia uma lista plana de 50 pins sob um único gênero implícito. Por isso, todos foram analisados em conjunto, e não por gênero como o playbook descreve para execuções com múltiplos gêneros.
  • Os títulos de vários pins não correspondiam ao que as imagens realmente mostravam e, conforme o playbook, esta etapa não navega diretamente no Pinterest para verificar. Assim, foram marcados como não confirmados, e não relatados como descobertas: #42 (“Nvidia #NEW AI Tools”) mostra apenas uma foto genérica de Jensen Huang falando, sem texto visível sobre ferramentas; #45 (“Grok 5: Elon Musk's AI Revolution”) e #50 (“Discover how Grok is revolutionizing video”) mostram imagens genéricas de banco/notícias de IA, sem elementos específicos do Grok; #40 (“GPT 5.2, realtime video editor...”) mostra apenas uma miniatura genérica de reação sobre “huge AI news”.
  • Vários pins são gráficos de banco genéricos quase duplicados, sem conteúdo informativo distinto ([2, 8, 22, 29, 39, 45, 49]); eles foram contabilizados entre os 50, mas não tratados como sinais separados.
  • Não foi encontrado conteúdo de geração aberta de imagens ou vídeos no Pinterest para este tema. Essa ausência é a principal descoberta da plataforma, não uma lacuna de pesquisa.

Ações recomendadas

  • Acompanhar para onde migra o tráfego da API do Sora após 2026-09-24 — Seedance 2.5, MiniMax H3 ou Kling v3.
  • Observar mudanças na licença de pesquisa não comercial do Qwen-Image-2.1, diante do debate ativo sobre se ele é realmente código aberto.
  • Usar a frequência de publicações de extensões ComfyUI para MiniMax H3 no Lemmy como indicador antecedente da adoção de vídeo com pesos abertos.
  • Reexecutar a etapa de coleta no X com termos de busca específicos do tema, em vez de tendências regionais.
  • Reexecutar a coleta no Reddit com termos por modelo para atingir a meta de aproximadamente 20 publicações.
  • Verificar a suposta mudança da Midjourney para tomografia por ultrassom médico em sua fonte primária antes de tratá-la como confirmada.

Imagens coletadas

Como a geração de vídeo por IA apoia a criação moderna...🎨 Criação de imagens e vídeos com IAIA e aprendizado de máquina: infográfico sobre como a IA gera vídeo | LivePhysics™Processo de geração de vídeo por IAPreocupações com conteúdo de IA e redes sociaisNotícias de IA: vazamento da Anthropic mostra o futuro da IA...Acerte em cheio 🎥Conceito de criação de conteúdo por IA com ícones para geração de texto, imagem, música e vídeo — veja 66 fotos, vetores e vídeosGoogle apresenta o Veo 2: ferramenta avançada de geração de vídeo por IA com mais realismo e recursos cinematográficosGoogle anuncia vídeo de qualidade ultrarrápida...Adobe desenvolve modelo de IA para ampliar vídeos e transformar gravações borradas em qualidade HDSegredos do estúdio e automação de conteúdo com IA 🚀📱Melhores geradores de vídeo por IA em 2026: Veo, Kling,...imagemVeo 3 de imagem para vídeo: geração rápida e áudio nativo via API GeminiA aposta ousada de Nova York: por dentro da legislação...4 grandes atualizações de IA que você precisa conhecer em 2026Principais geradores de vídeo por IA de 2025Notícias de IA: a OpenAI finalmente lançou o que pedimosIA para geração de imagens e vídeosO que é Imagvio AI e como ajuda criadores...Conceito de criação de conteúdo por IA com ícones para geração de texto, imagem, música e vídeo — veja 57 fotos, vetores e vídeosVídeo criativo de estilo de vida com IA | produção de vídeo por IA para marcas de estilo de vidaVídeos gerados por IA para marketing de conteúdoA arma secreta para criadores de conteúdo: geração de vídeo com IAimagem‎🚨 A IA está ficando assustadoramente boa.Criação profissional de vídeo com IA | vídeos cinematográficos de IA | edição de vídeo personalizadaMão segurando ícones de geração por inteligência artificial, incluindo símbolos de texto, imagem e áudio — veja 2 fotos, vetores e vídeos8 geradores de vídeo de desenhos animados por IA que você deve experimentar em 2026Geração de imagens por IA22 melhores e gratuitos geradores de vídeo por IA em 2026 🎬🤖 | crie vídeos incríveis com IAimagemVídeos gerados por IA: bons ou ruins? Aqui está a verdade! 🤖🎥imagemInfográfico sobre como funciona a geração de imagens por IA | LivePhysics™Dominando vídeo e IA: principais tendências de marketing em redes sociais em 2025Notícias e atualizações de IA | tendências e avanços em inteligência artificialIAGPT 5.2, editor de vídeo em tempo real, vídeos estéreo de IA, agentes de IA móveis, controle corporal completo: NOTÍCIAS DE IAGeração de vídeo 📹Novas ferramentas de IA da Nvidia 🤯 #news #ai #openai #chatgpt #highlights #shortsKling.ai: geração de texto para vídeo com IANotícias de IA desta semana — 15 de agosto de 2026Grok 5: a revolução de IA de Elon Musk: uma surpreendente...O futuro da criatividade: MrBeast sobre o impacto da IA no YouTubeNotícias de IA de hoje e a mudança na ética‘Amuse 3.0’, ferramenta de criação de arte por IA que inclui...imagemDescubra como o Grok está revolucionando o vídeo...

Nota sobre a qualidade dos dados

O X produziu zero publicações relevantes ao tema entre 32 devido a uma incompatibilidade dos termos de busca, e o Reddit coletou apenas 12 dos cerca de 20 tópicos pretendidos com uma única consulta; a API de busca do Bluesky foi bloqueada (403) e exigiu uma solução alternativa por amostragem de feeds de contas, enquanto as visualizações e datas exatas do YouTube não puderam ser confirmadas devido às páginas renderizadas em JavaScript.

Galeria