KEN’S CAT LOG

Notícias sobre IA de geração de imagens e vídeo — 2026-09-17

O código fechado gira em torno da saída de facto do Sora 2 e do duelo entre GPT Image 2.5 e Nano Banana Pro; no código aberto, os modelos chineses (Wan, MiniMax H3, HunyuanVideo e Z-Image Turbo) assumem a liderança, enquanto a suspeita de que o Wan 3.0 se tornou fechado é o maior fator de instabilidade.

Notícias sobre IA de geração de imagens e vídeo — 2026-09-17

Nossa, o setor de IA de imagens/vídeo se mexeu demais desta vez 🔥 No lado fechado, o Sora 2 praticamente saiu de cena e passou o protagonismo para Veo 3.1, Kling 2.5 Turbo e Seedance; além disso, o GPT Image 2.5 da OpenAI e o Nano Banana Pro do Google estão em um confronto direto 👊 No código aberto, os chineses como Wan, MiniMax H3, HunyuanVideo e Z-Image Turbo tomaram completamente a dianteira, e o ecossistema do ComfyUI vive uma festa em que novos nós e LoRAs aparecem todos os dias 🎉 Mas os modelos do Google (Nano Banana Pro/Flow) também acumulam problemas: filtros de segurança bloqueiam até imagens geradas pelos próprios modelos, e o Google Earth retirou um recurso após a produção em massa de imagens falsas de desastres. A questão da confiabilidade está meio preocupante 😬

Entre plataformas

  • Saída do Sora 2 e troca de protagonismo para Google/ByteDance/Kling: o YouTube informou que a “paralisação final da API do Sora 2 está prevista para 24/09/2026”, enquanto Reddit e YouTube avaliam de forma independente o Seedance (2.0→2.5) como excelente em realismo humano. Quando a mesma conclusão surge naturalmente em plataformas diferentes, é um sinal forte 💪
  • Debate GPT Image 2.5 vs Nano Banana Pro: YouTube (vários vídeos de análise logo após o anúncio), Bluesky (@testingcatalog.com publicou a notícia em 09/09/2026) e Lemmy (comparação de colorização de Berserk, em que ChatGPT Images 2.5 se saiu melhor na preservação do traço, enquanto Nano Banana Pro perdeu pontos por ignorar instruções) comparam esses dois modelos de forma independente.
  • Muitos problemas com Nano Banana Pro/Google Flow: no Reddit, circula o caso de o próprio Flow bloquear imagens produzidas pelo próprio Nano Banana Pro, numa espécie de “filtro fora de controle”; no Lemmy, há o incidente em que o recurso Nano Banana 2 integrado ao Google Earth foi retirado no dia seguinte ao lançamento, após gerar em massa imagens falsas de desastres e instalações militares. As plataformas são diferentes, mas desenham o mesmo quadro: a IA generativa do Google é forte, porém seu controle não acompanha.
  • Código aberto: chineses + MiniMax H3 são o principal campo de disputa: Reddit cita repetidamente Wan, MiniMax H3 e LTX Video como as “melhores opções gratuitas”; YouTube mostra Wan, Z-Image Turbo e HunyuanVideo/Image como modelos chineses; Lemmy viu ferramentas ComfyUI para MiniMax H3 serem produzidas em massa nos últimos dias em !«メールアドレス»; e Bluesky registrou Lightricks LTX-2.5 entre os destaques do Hugging Face por três dias seguidos. Quatro plataformas apontam na mesma direção.

Plataforma por plataforma

Reddit: foram reunidos 11 tópicos (abaixo da meta de 20). No fechado, predominam a contradição entre a generosa faixa gratuita do Google Flow e seus filtros de segurança excessivos, além da boa avaliação do realismo humano do Seedance. No aberto, Wan/MiniMax H3/LTX Video são constantemente citados como opções padrão para geração local. Também apareceu o tom realista do debate: conflito sobre o sentido de “AI slop” e ironia em torno de ferramentas que prometem gerar vídeos de YouTube de modo totalmente automático 🗿

X: desta vez, foi um fracasso completo 😅 O método de coleta passou por tendências e, como a sessão estava geolocalizada na Croácia, os 40 posts coletados tratavam de política sul-africana, Sérvia/Kosovo, Israel/Hamas, governança do Zcash e spam de sorteios. Nenhum mencionava IA de geração de imagem ou vídeo. Entre as plataformas citadas no briefing, esta é a única lacuna clara — é preciso coletar novamente.

YouTube: 13 vídeos foram identificados pelos títulos/snippets. No fechado, destacam-se GPT Image 2.5 (lançado em 08/09/2026, com as variantes Flare/Sunburst) e o fim do Sora 2; também é relevante a entrada da Meta com Muse Image/Video (Meta Superintelligence Labs, geração agentiva que usa busca e execução de código). No aberto, Alibaba (Wan, Z-Image Turbo), Tencent (HunyuanVideo 1.5, HunyuanImage 3.0) e Black Forest Labs (Flux.2) estão no centro. Porém, visualizações e nomes de canais quase não puderam ser confirmados devido à renderização por JavaScript, deixando a validação de autoridade mais fraca.

Bluesky: contas oficiais de marcas (Midjourney, Stability AI, ComfyUI, Runway, Kling e Black Forest Labs) estão quase todas inativas desde o segundo semestre de 2025. A principal fonte é a conta individual de notícias @testingcatalog.com (860 seguidores). Foi possível encontrar ChatGPT Images 2.5, Meta Muse Video, “Orbis” da startup Visko (vídeo em tempo real) e a expansão de imagem/vídeo da ElevenLabs. Sobre código aberto, só foi possível confirmar atenção contínua ao LTX-2.5 pelo bot de tendências do Hugging Face. Como a API de busca retornou 403, a investigação precisou seguir cadeias de contas, o que limitou o levantamento.

Lemmy: houve pouco mais de 10 posts relevantes (abaixo da meta de 20, sem inflar artificialmente). No fechado, o assunto tende a aparecer como acidente ou polêmica — retirada da IA do Google Earth e ironias comparando a entrada da Midjourney em dispositivos médicos à Theranos. No aberto, !«メールアドレス» funciona como polo de atividade, com o típico movimento OSS: nós ComfyUI, LoRAs e implementações de baixo uso de memória para MiniMax H3 surgindo em massa em poucos dias.

Pinterest: 30 dos 50 pins foram revisados visualmente. Quase não há conteúdo relacionado a código aberto: nenhum pin menciona Stable Diffusion, Flux, Wan ou ComfyUI. Só aparecem marcas fechadas voltadas ao consumidor, como ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney e Canva. Os poucos pins com valor noticioso são a polêmica da “atriz de IA” Tilly Norwood, o Vidu S1 da ShengShu Technology (vídeo interativo em tempo real) e o diagrama técnico do Microsoft VASA-1. O conjunto é dominado por imagens de arquivo que exploram ansiedade sobre robôs e deepfakes; ele retrata mais uma “cultura visual de receio difuso da IA” do que notícias.

O que acompanhar

Recomendações

  • Refazer a coleta no X (antigo Twitter) usando palavras diretamente ligadas ao tema, como “Sora 2”, “Nano Banana Pro”, “Wan” e “Flux”, em vez de tendências.
  • Confirmar a suspeita de fechamento do Wan 3.0 em fontes primárias (anúncio oficial da Alibaba) e acompanhar seu impacto no mapa de forças da geração de vídeo aberta.
  • Monitorar continuamente !«メールアドレス» para acompanhar com maior rapidez os movimentos em torno do MiniMax H3.
  • Como a comparação entre GPT Image 2.5 e Nano Banana Pro aparece de forma consistente em várias plataformas, explorar na próxima rodada a comparação com uma terceira força, como Seedream 5.0 Pro.
  • Recomenda-se continuar monitorando reações excessivas dos filtros de segurança e problemas de geração incorreta nos modelos do Google como notícias de confiabilidade, pois são recorrentes.

Qualidade dos dados

No X, o método de coleta (via tendências geolocalizadas) se desviou completamente do tema e nenhum dos 40 posts era relevante; na prática, a plataforma não funcionou nesta rodada. Reddit (11 itens) e Lemmy (pouco mais de 10) não atingiram o critério de conclusão do briefing, de aproximadamente 20 itens, sem que se recorresse a inflação artificial. No YouTube, a barreira de renderização JavaScript impediu confirmar visualizações e nomes de canais, enfraquecendo a avaliação de autoridade. No Bluesky, a API oficial de busca retornou 403 e exigiu um método alternativo de navegação pelos feeds de contas conhecidas, o que limita a abrangência. No Pinterest, só foi possível verificar imagens e títulos, não os artigos de destino ou métricas de salvamento.

Resumo por plataforma

Reddit

Reddit — Notícias sobre IA de geração de imagens e vídeo

Onde

Os 11 tópicos coletados vieram de sete subreddits. Todos foram encontrados com a busca “Image and Video Generation AI News”.

Subreddit Número de membros Tópicos coletados
r/generativeAI 154,126 5
r/aitubers 28,633 1
r/AIDangers 53,410 1
r/aifilmmaking 7,951 1
r/aivideomaking 7,085 1
r/AIToolTalks 6,307 1
r/NoStupidQuestions 7,494,416 1

Subreddits especializados em IA de imagem e vídeo (r/generativeAI, r/aifilmmaking, r/aivideomaking e r/aitubers) representam 8 dos 11 itens. Os três restantes (r/AIDangers, r/AIToolTalks e r/NoStupidQuestions) discutem méritos e riscos da IA em geral, sem conteúdo restrito à geração de imagem/vídeo.

O que as pessoas dizem
  • Código fechado (Google Flow/Veo) distribui uma faixa gratuita generosa, mas também amplia restrições. No tópico 4, “Google Flow is giving creators a surprisingly generous amount of free AI video generation right now” (r/aifilmmaking · 8 pontos · 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/, os créditos gratuitos para Veo são descritos como algo que está se tornando “um espaço de produção completo, com construção de cenas, controle de câmera e imagens de referência, e não apenas text-to-video”. Nos comentários, u/MechanicForward2274 (1 ponto): “50 credits a day is actually enough to experiment with a lot if you're not wasting them”.
  • Já o tópico 7 (r/generativeAI · 2 pontos · 2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ traz a reclamação de que o filtro de segurança do Google Flow bloqueia até imagens geradas pelo próprio modelo da empresa (Nano Banana Pro). O autor tentou novamente 60 vezes com a mesma imagem, sem sucesso. Esse atrito está levando donos de RTX 5090 à geração local.
  • Modelos locais/de pesos abertos são repetidamente citados como as melhores opções gratuitas: Wan, Minimax H3 e LTX Video. No tópico 1 (r/generativeAI · 8 pontos · 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/, u/tuckken2 (2 pontos): “Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours”. No tópico 7, u/f5alcon (3 pontos) afirma que “Minimax H3 is the best local generator”, e u/Liberation2020 (1 ponto) também cita “Wan, mini max H3 and LTX Video”.
  • Seedance (fechado, ligado à ByteDance) ganha avaliação positiva pelo realismo de pessoas. O próprio autor do tópico 7 escreve que “Seedance 2.0 is the top video generator regarding human realism”. No tópico 8, “HOW IS THIS MADE?!” (r/generativeAI · 0 pontos · 2026-09-10) https://www.reddit.com/r/generativeAI/comments/1wced4g/, u/lagbit_original (3 pontos) explica que é possível chegar a qualidade de vídeo viral apenas com Seedance 2.5, um único prompt, boas imagens de referência e acréscimos de música/cortes em software de edição. No tópico 11, u/pb404 (2 pontos) também elogia a consistência do modelo de referência Seedance 2.5.
  • A demanda por ferramentas que “fazem automaticamente qualquer vídeo para YouTube” é alvo de zombaria. No tópico 5 (r/aitubers · 0 pontos · 35 comentários · 2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/, alguém pediu geração totalmente automática a partir de um roteiro por menos de €50 por mês. u/RangeWilson (7 pontos) respondeu com ironia: “I'm looking for a unicorn who will slide down a rainbow and give me a pot of gold every day. But I'm not willing to pay more than €50 per month.” u/RobJames007 (12 pontos, a maior pontuação do tópico) também advertiu: “YouTube is trying to reduce AI slop, not allow more of it onto the platform”.
  • Há divisão sobre o que significa o rótulo “AI slop” (detalhes em Sinais). O tópico 11, “Is there a way to make AI video that does not look like AI slop?” (r/generativeAI · 0 pontos · 30 comentários · 2026-09-14) https://www.reddit.com/r/generativeAI/comments/1wgjjzu/, é o centro da discussão. O autor relata que, em seus testes, bastou usar “o mesmo personagem + voz + piadas em continuidade” para multiplicar o tempo de visualização por nove sem alterar a parte técnica, e ninguém mais chamou o conteúdo de slop.
  • Há forte desejo por opções gratuitas e de baixo custo. No tópico 2, “Please help me generate free ai video without subscription” (r/aivideomaking · 0 pontos · 14 comentários · 2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/, u/Fluffybabyyoda (1 ponto) diz: “google flow gives you 50 credits daily sometimes 2 times a day. Google gemini i think gives you 3 videos a day”. u/Bastisheen92 (2 pontos) apresenta o princípio básico: “Local Generation is free if you already own the Hardware”.
  • Também existe uma parcela em busca de ferramentas gratuitas para conteúdo NSFW/mais explícito. No tópico 3, “Any free video platform?” (r/generativeAI · 2 pontos · 5 comentários · 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whvzu3/, o autor afirma: “I was able to find ways to get Grok for free and spicy minimax”. No mesmo tópico, u/Critical_Emu_6565 (2 pontos) promove sua própria ferramenta, “RexCut AI”; vale notar a presença de comentários promocionais que parecem autopublicidade.
  • Embora não seja específico de IA de imagem/vídeo, existe ansiedade e desconfiança mais ampla em torno da IA. No tópico 9, “Are all of you also anxious about recent news about AI?” (r/AIToolTalks · 12 pontos · 35 comentários · 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/, surgem preocupações sobre consumo de água e perda de empregos, além da menção a Andrew Garfield, que teria deixado de usar IA após interpretar Sam Altman em “Artificial”. u/Big-Pops78 (3 pontos) rebate que o consumo de água não é excepcionalmente alto em comparação com outras tecnologias.
  • Também há ceticismo sobre a relação custo-benefício da adoção de IA. O tópico 6, “Biggest AI news of 2026: AI is not a necessary tool...” (r/AIDangers · 26 pontos · 31 comentários · 2026-09-14) https://www.reddit.com/r/AIDangers/comments/1wg5y17/, sustenta que a adoção de IA reduziu o desempenho em muitas empresas. u/presentofai (1 ponto) rebate: “most of these "AI made it worse" numbers are measuring clumsy rollouts, not the models”, mostrando que há argumentos dos dois lados.
Sinais
  • Em alta: modelos locais/de pesos abertos para vídeo (Wan, Minimax H3 e LTX Video) recebem apoio claro como alternativa às faixas gratuitas de serviços fechados. Há relatos concretos de usuários com GPUs potentes, como RTX 5090, migrando para o local devido às restrições severas da nuvem (tópico 7).
  • Em alta: Seedance (2.0/2.5) vem melhorando sua reputação em realismo humano e consistência, com menções independentes em vários tópicos e comentários.
  • Ignorado/rejeitado: a expectativa de ferramentas totalmente automáticas que produzam um vídeo pronto apenas a partir de um roteiro é recebida com forte sarcasmo pela comunidade (tópico 5, cujo comentário mais votado é irônico). O próprio termo “AI slop” também vem sendo rejeitado por alguns como insulto que perdeu o sentido.
  • Divergência: no tópico 11, a discussão sobre o que é “AI slop” se divide ao meio. u/Tenth_10 (9 pontos, o maior do tópico) e u/pb404 (2 pontos) analisam que o conteúdo é criticado por não ter tensão narrativa, não por uma questão técnica; já u/RioNReedus (3 pontos) entende que o termo virou uma palavra sem sentido usada para qualquer coisa por pessoas que não gostam de IA. É interessante que o mesmo post leve a conclusões opostas.
  • Surpresa: o “excesso de reação” do filtro do Google, que bloqueia no Flow até imagens feitas pelo Nano Banana Pro (tópico 7). A generosidade dos créditos gratuitos (tópico 4, 50 créditos/dia) e a severidade da censura das imagens avançam simultaneamente, enviando uma mensagem contraditória para a experiência do usuário.
  • Surpresa: quase metade dos tópicos encontrados pela busca “Image and Video Generation AI News” — três itens vindos de r/AIDangers, r/AIToolTalks e r/NoStupidQuestions — tratava de ansiedade e ceticismo sobre IA em geral, e não de geração de imagem/vídeo. Isso sugere que o tema é discutido dentro do contexto maior de “a IA é confiável?”.
Limites
  • Foram coletados apenas 11 tópicos, abaixo dos “cerca de 20” solicitados pelo brief.md. Foi usada apenas uma busca (“Image and Video Generation AI News” — o próprio título desta pesquisa, e não uma consulta natural). Não foram feitas novas buscas com termos como “Sora 2”, “Midjourney update” ou “open source video model release”.
  • O lado fechado ficou concentrado em Google Flow/Veo e Seedance; não foram coletados tópicos dedicados a Sora, Midjourney, Runway, Kling, Grok Imagine ou outros serviços fechados importantes (apenas menções em comentários).
  • No aberto, Wan, Minimax H3 e LTX Video são repetidamente citados, mas não foram encontrados tópicos dedicados às tendências recentes de Flux, Stable Diffusion ou do ecossistema ComfyUI.
  • Os três tópicos de r/AIDangers, r/AIToolTalks e r/NoStupidQuestions não são específicos de IA de imagem/vídeo; sua relação com o tema é indireta.
  • O acesso ao Reddit foi limitado aos dados coletados previamente pelo worker; este agente não realizou novas buscas ou leituras de páginas, conforme o playbook.

X

X — Notícias sobre IA de geração de imagens e vídeo

Contas

Nenhuma das contas do conjunto coletado fala de IA de geração de imagem ou vídeo, seja fechada ou aberta. As 38 contas em output/x.posts.json misturam:

  • Contas políticas/de comentário discutindo África do Sul, Sérvia/Kosovo, Brexit, elegibilidade no futebol e Israel/Hamas (por exemplo, @TheSirRobotto, 2 posts somando 12.537 curtidas sobre regras de futebol Sérvia/UE; @marklevinshow, 1 post, 3.250 curtidas, sobre Erdogan/Hamas).
  • Contas de entretenimento/fãs (@eva_kirby21, @PossiblyApollo — comentários sobre o Emmy da Apple TV; @justluvbourzgui, @theholydemi, @acervylaur — fandom de Lauren Jauregui/DWTS).
  • Contas de criptomoedas discutindo a votação de governança do Zcash (ZEC) (@CoinMarketCap, @zooko — cofundador do Zcash — e @Hasan_NFTOX, promovendo uma cunhagem gratuita de NFT).
  • Contas de sorteios/spam de baixo engajamento repetindo o texto “Pour PalZ Neon Crochet Bears Giveaway” (@corrysue1, @PHIFFERJ, @lilredshoper — todas com 0 curtidas, texto quase idêntico via @gaynycdad).

Nenhuma conta é de IA, Midjourney/Sora/Runway/Stable Diffusion etc., pesquisador ou veículo de notícias. Isto não mostra “quem conduz a conversa sobre IA de imagem/vídeo no X”, mas sim quem conduz os assuntos em alta na Croácia naquele dia.

Posts

Sem conclusões — nenhum dos 40 posts coletados menciona geração de imagens, geração de vídeo ou modelos de IA de qualquer tipo. Em vez de forçar relevância, esta seção não cria conclusões artificiais.

Sinais

Não é possível extrair sinais sobre o tema de pesquisa deste conjunto. O único padrão observável nos próprios dados é o predomínio de política regional (África do Sul, Sérvia/Kosovo, Israel-Hamas), uma votação de governança cripto (Zcash reduzindo o tempo de bloco de 75s para 25s, output/x.posts.md #19) e ruído de fandom/spam — nada relacionado a IA.

Limites

A coleta desta etapa não mirou o tema da pesquisa. Conforme output/x.posts.md e .json, o método do worker foi "source": "trending": ele leu a lista de tendências do Explore no X, que é geolocalizada para o servidor da sessão e retornou “Trending in Croatia” / “Politics · Trending” / “Technology · Trending”, e então buscou os nomes dessas tendências literalmente: “Africa”, “Serbia”, “Apple”, “Canada”, “Zcash”, “#sweepstakes”, “#giveaways”, “#chance”, “Lauren”, “Hamas”. Nenhum termo se relaciona a IA de geração de imagem ou vídeo; por isso, os 40 posts de 38 contas contêm zero material relevante.

Não pesquisei o X diretamente — conforme o playbook, esta sessão não possui acesso ao X em tempo real e só posso ler o que já foi coletado. Portanto, o critério de conclusão de aproximadamente 20 posts analisados por plataforma não pode ser atendido para o X nesta rodada: não há nenhum post relacionado ao tema no arquivo coletado e não posso executar novamente a coleta com termos adequados, como “Sora 2”, “Midjourney”, “Stable Diffusion”, “Runway”, “Nano Banana”, “Flux”, “Veo 3”, “closed-source image AI” ou “open-source video model”.

Esta etapa deve ser marcada como falha / necessitando de nova coleta com termos apropriados ao tema, em vez de termos de tendências.

YouTube

YouTube — Notícias sobre IA de geração de imagens e vídeo (código fechado/código aberto)

Canais

A página de resultados de busca do YouTube é renderizada por JavaScript; em muitos casos, só foi possível obter o rodapé, sem nome de canal ou número de inscritos (ver “Limites”). Canais/fontes identificáveis a partir dos títulos e snippets:

  • Canal oficial da OpenAI — Introducing GPT-Image-2.5 in the API (vídeo explicativo oficial)
  • Canais de notícias e análises de IA (não identificados individualmente): grupos de canais que publicam continuamente tutoriais ComfyUI e vídeos sobre GPT Image 2.5, Nano Banana Pro, fim do Sora 2, Wan/HunyuanVideo/Z-Image/Flux.2. A busca confirmou que canais especializados como MattVidPro AI, TheAIGRID, Theoretically Media e Matt Wolfe (cerca de 965 mil inscritos, focado em notícias de IA) tratam com frequência desses temas, mas não foi possível confirmar o vínculo exato entre cada vídeo e cada canal.
Vídeos

Modelos de código fechado

  1. GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model — início de setembro de 2026 (“1 semana atrás”) — https://www.youtube.com/watch?v=DY6TkI8XtkQ — análise geral do novo modelo de imagem “GPT Image 2.5”, lançado pela OpenAI em 08/09/2026, com duas variantes: Flare/Sunburst.
  2. Introducing GPT-Image-2.5 in the API — setembro de 2026 — https://www.youtube.com/watch?v=A7MSwdXj86k — vídeo explicativo oficial alinhado à OpenAI. Destaca que Sunburst oferece iluminação mais nítida e natural, além de melhor precisão de edição por API.
  3. OpenAI's New Image Model Is Brilliant… Until You Look Closer — meados de setembro de 2026 (“5 dias atrás”) — https://www.youtube.com/watch?v=pEYqorQrc4U — análise crítica que compara GPT Image 2.5 com os principais modelos e aponta fraquezas, como falhas em detalhes.
  4. [NEW] Meta Muse.Ai Image Generation First Reaction — por volta de julho de 2026 — https://www.youtube.com/watch?v=rAvnO1DWnMs — primeira análise do novo modelo de imagem “Muse Image”, da Meta Superintelligence Labs, baseado em Muse Spark e com geração agentiva que usa busca e execução de código.
  5. Grok Imagine Video 1.5 vs Seedance 2.0 | Full AI Video Test — 08 de junho de 2026 — https://www.youtube.com/watch?v=5mFkZiRTVu4 — comparação prática entre “Grok Imagine Video 1.5”, da xAI, e “Seedance 2.0”, da ByteDance.
  6. Grok's New FREE AI Video Generator Is INSANE — 06 de julho de 2026 — https://www.youtube.com/watch?v=lrCjbL51dbk — apresenta principalmente a possibilidade de testar gratuitamente o Grok Imagine Video 1.5.
  7. BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27 de março de 2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — após o anúncio/encerramento do app e da API Sora 2 pela OpenAI em 24/03/2026, testa alternativas como Veo 3.1, Kling e Hailuo, marcando uma mudança no cenário dos modelos fechados.

Modelos de código aberto

  1. Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! — 27 de novembro de 2025 — https://www.youtube.com/watch?v=sPQQPpQ9X4E — “Z-Image Turbo”, modelo Alibaba (Tongyi-MAI) de 6B parâmetros sob APACHE-2.0. Afirma ter qualidade e velocidade comparáveis ao Nano Banana Pro.
  2. New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — novembro–dezembro de 2025 — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — tutorial de ComfyUI que avalia o Z-Image Turbo como superior ao Flux.2.
  3. Flux.2 Has Landed! Is It the Open Source King? — novembro de 2025 — https://www.youtube.com/watch?v=D0_QGrdtvEg — avaliação do Flux.2 da Black Forest Labs (Pro/Flex/Dev/Klein sob Apache-2.0). Porém, textos críticos posteriores apontam uma abertura apenas aparente.
  4. We have a new #1 open-source AI video generator! (Tencent HunyuanVideo 1.5) — 25 de novembro de 2025 — https://www.youtube.com/watch?v=6EQP8-D37bs — análise e instalação do modelo aberto de vídeo de 8,3 bilhões de parâmetros lançado pela Tencent.
  5. HunyuanImage 3.0: Open Source Text To Image Model (Forget Nano Banana & Seedream 4) — setembro de 2025 — https://www.youtube.com/watch?v=32lhiZKhgOY — modelo aberto de imagem MoE, com mais de 80 bilhões de parâmetros, da Tencent. É apresentado como “o maior modelo aberto de geração de imagens”.
  6. WAN 2.2 Animate in ComfyUI (Step-by-Step Guide) — 26 de setembro de 2025 — https://www.youtube.com/watch?v=dyqz3PJ0wvo — tutorial sobre o recurso aberto do Alibaba Wan 2.2 para criar vídeo a partir de uma imagem de referência.
Sinais
  • A geração de vídeo da OpenAI, na linha Sora, está em retirada de facto — o app/API Sora 2 foi interrompido entre março e abril de 2026 (paralisação final da API prevista para 24/09/2026). Vídeos apontam Google Veo 3.1, Kling 2.5 Turbo e ByteDance Seedance 2.0 como os novos protagonistas da geração de vídeo fechada (BREAKING: Sora 2 is SHUTTING DOWN, https://www.youtube.com/watch?v=Zf9979o8RGk).
  • A fronteira fechada da geração de imagens é GPT Image 2.5 contra Nano Banana Pro (Gemini 3 Pro Image). Após a OpenAI lançar GPT Image 2.5 em 08/09/2026, aumentaram os vídeos que o comparam diretamente com o Nano Banana Pro, lançado pelo Google em novembro de 2025 (GPT Image 2.5 Is AMAZING, https://www.youtube.com/watch?v=DY6TkI8XtkQ).
  • A Meta entra de vez na geração de imagem/vídeo — Muse Image / Muse Spark / Muse Video, da Meta Superintelligence Labs, apareceram em julho de 2026 e são apresentados como uma nova abordagem agentiva, que fundamenta imagens usando busca na web e execução de código.
  • Grok Imagine, da xAI, está sendo iterado rapidamente — da primeira versão em agosto de 2025 ao Video 1.5 entre maio e julho de 2026, muitos vídeos enfatizam sua faixa gratuita.
  • Modelos chineses lideram o código aberto — Alibaba (Wan, Z-Image Turbo), Tencent (HunyuanVideo, HunyuanImage) e Black Forest Labs, da Alemanha (Flux.2), são o núcleo. Em particular, Z-Image Turbo (6B, Apache-2.0) já recebe avaliações de que supera Flux.2.
  • Sinal de reversão a observar: Wan era totalmente aberto sob Apache-2.0 até o Wan 2.2, mas vários artigos afirmam que o “Wan 3.0”, anunciado em 24/08/2026, adotou uma política fechada, apenas por API e sem pesos públicos. Ainda que as fontes sejam blogs, há no YouTube preocupação com a mudança de liderança no código aberto. O futuro do carro-chefe aberto de geração de vídeo é incerto.
  • O ecossistema ComfyUI continua sendo o principal campo de batalha da geração aberta de vídeo/imagem — Wan 2.1/2.2, HunyuanVideo e Z-Image Turbo seguem recebendo tutoriais ComfyUI em volume constante.
Limites
  • Mesmo ao buscar diretamente youtube.com/results?search_query=... por WebFetch, o retorno trazia apenas o rodapé antes da renderização JavaScript; títulos, canais, visualizações e datas não eram recuperáveis. O mesmo ocorreu ao acessar páginas individuais em youtube.com/watch?v=...: não foi possível alcançar JSON-LD ou tags OG incorporadas.
  • Por isso, visualizações e inscritos foram registrados apenas quando apareciam em snippets de busca; para muitos vídeos, não foi possível confirmar com precisão número de visualizações, nome do canal ou inscritos (não há nenhum vídeo com “views” confirmado). Para números precisos, seria necessário usar a YouTube Data API ou outra rota.
  • Para Kling 2.5 Turbo, foi possível confirmar em vários artigos externos que lidera o ranking da Artificial Analysis, mas não foi identificado um URL concreto de vídeo no YouTube correspondente.
  • Para o modelo de geração de vídeo da Midjourney, só surgiram notícias de abril a junho de 2025; não foi encontrada uma grande novidade nos 60 dias anteriores. Atualizações menores de V7.1/V8 existem apenas até setembro de 2025.
  • O conteúdo dos comentários não estava incluído nas páginas obtidas e não foi analisado.

Bluesky

Bluesky — Notícias sobre IA de geração de imagens e vídeo

Contas
  • 🚨 AI News | TestingCatalog @testingcatalog.com — 860 seguidores. Conta individual de notícias rápidas de IA que se apresenta como “Latest AI News on AI Agents, Model Releases, Tools, Leaks, and Rumors”. Publica várias vezes por dia, em formato de manchetes curtas, lançamentos e vazamentos; foi a fonte mais frequente e próxima do tempo real nesta investigação.
  • Tendências diárias do HuggingFace @huggingfacetrends.bsky.social — 122 seguidores. Bot que publica automaticamente, diariamente após as 19h, os modelos em tendência no Hugging Face (GitHub: aegisfleet/hugging-face-trending-to-bluesky). Útil para acompanhar modelos abertos.
  • Midjourney (oficial) @midjourneyofficial.bsky.social — 112 seguidores. Entrou no Bluesky em agosto de 2025, mas sua última publicação é de 08 de outubro de 2025; desde então está inativa.
  • Stability AI (oficial) @stabilityai.bsky.social — 241 seguidores. Há anúncios como o da API de edição “Stability AI Image Services”, mas as publicações mais recentes são de novembro de 2025 e as atualizações são esporádicas.
  • ComfyUI (oficial) @comfyuiorg.bsky.social — conta oficial da ferramenta aberta de fluxos de trabalho para geração de imagens/vídeo. Porém, sua última publicação é de junho de 2025, sem movimentos acompanháveis em 2026.
  • Black Forest Labs (criadora do Flux) @blackforestlabs.bsky.social / Runway @runwayml.bsky.social / Kling AI @klingai.bsky.social — as contas existem, mas quase não publicam: Black Forest Labs tem zero posts, Runway tem apenas um de outubro de 2024 e Kling tem feed vazio. Elas não usam o Bluesky como canal principal de comunicação.
Posts
  1. OpenAI anuncia “ChatGPT Images 2.5” (código fechado) — @testingcatalog.com, 09/09/2026, 👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
    Apresenta geração e edição de imagens mais rápidas, maior consistência de assunto e os novos modelos para API “Flare” e “Sunburst”.

  2. Primeiras saídas do modelo de vídeo “Muse Video” da Meta (código fechado) — @testingcatalog.com, 19/08/2026, 👍2
    https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24
    Informação preliminar sobre o modelo de geração de vídeo para “Muse”, uma suposta superapp agentiva em desenvolvimento para a Meta Connect.

  3. A startup Visko anuncia o modelo de vídeo em tempo real “Orbis” (código fechado) — @testingcatalog.com, 01/09/2026
    https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j
    Menciona a entrada de um novo player que promete geração em tempo real.

  4. O MCP da ElevenLabs passa a gerar também música, imagens e vídeo (serviço de API mais próximo de código fechado) — @testingcatalog.com, 14/09/2026, 👍3 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mvj6k7eycz2n
    Exemplo da ElevenLabs, antes especializada em voz, expandindo para geração de imagem e vídeo.

  5. Tencent lança o modelo de prévia aberto Hy4 (código aberto) — @testingcatalog.com, 29/08/2026
    https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h
    Lançamento aberto de um modelo de prévia que parece ser sucessor da família Hunyuan.

  6. Lightricks/LTX-2.5 entra nas tendências do Hugging Face (geração aberta de vídeo) — @huggingfacetrends.bsky.social, 15/09/2026 (republicado também em 13 e 11/09)
    https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvkun3tjqp2t
    O modelo de vídeo LTX-2.5, da Lightricks, foi apresentado como tendência no Hugging Face por três dias seguidos, sugerindo atenção contínua.

  7. ComfyUI integra FLUX.1 Kontext como nó oficial de API (código aberto) — @comfyuiorg.bsky.social, 06/06/2025
    https://bsky.app/profile/comfyuiorg.bsky.social/post/3lqvsxzzjhb2t
    O post diz explicitamente “Open Source coming soon!” e marca uma integração importante entre o ecossistema Flux da Black Forest Labs e o ComfyUI. A data é antiga, mas é um marco relevante para modelos abertos de edição de imagens.

  8. Wan2.1 é lançado com suporte ao ComfyUI (geração aberta de vídeo) — @comfyuiorg.bsky.social, 26/02/2025
    https://bsky.app/profile/comfyuiorg.bsky.social/post/3lj42stgelb2l
    Disponibiliza simultaneamente quatro modelos: texto→vídeo (14B/1.3B) e imagem→vídeo (14B). Embora antigo, é um marco relevante dos modelos abertos chineses de vídeo.

  9. Stability AI disponibiliza serviço de API de edição de imagens no Amazon Bedrock (fechado/API) — @stabilityai.bsky.social, 18/09/2025
    https://bsky.app/profile/stabilityai.bsky.social/post/3lz5eotkuvk2i
    Ferramentas de edição corporativas via API, como transformar um esboço em uma foto realista de produto.

  10. Midjourney dobra o número de estilos no “Style Explorer” (código fechado) — @midjourneyofficial.bsky.social, 18/09/2025, 👍10 🔁2
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
    Um dos poucos anúncios de atualização de funcionalidade feitos diretamente pela conta oficial.

Sinais
  • O Bluesky tem pouca densidade como espaço para acompanhar notícias rápidas de IA de geração de imagem/vídeo. Contas oficiais de Midjourney, Runway, Kling AI, Black Forest Labs, ComfyUI e Stability AI existem, mas publicam pouco ou ficaram inativas no segundo semestre de 2025. Ao contrário de X e Reddit, não é um canal central de divulgação.
  • A única conta com notícias realmente contínuas foi a individual @testingcatalog.com, que em setembro de 2026 publicava de um a três itens diários sobre OpenAI, Meta, Google, Anthropic e outros. Ainda assim, apenas uma parcela tratava diretamente de geração de imagem/vídeo: ChatGPT Images 2.5, Meta Muse Video, Visko Orbis, expansão da ElevenLabs e Tencent Hy4. O foco geral continua sendo agentes e LLMs.
  • Tendências abertas foram mais fáceis de encontrar por bots de agregação, como “Tendências diárias do HuggingFace”, do que por contas de notícias. Lightricks/LTX-2.5 entrou nas tendências em 11, 13 e 15 de setembro, indicando interesse contínuo como modelo aberto de vídeo.
  • Muitos posts individuais de arte em IA, feitos com Stable Diffusion, ComfyUI ou Midjourney, foram encontrados, mas são apresentações de obras, não fontes primárias de notícia; por isso, não foram incluídos em Posts.
Limites
  • A API oficial de busca de posts do Bluesky (app.bsky.feed.searchPosts) devolveu sempre HTTP 403 Forbidden, independentemente das palavras-chave. getProfile, getAuthorFeed, getPostThread e actor.searchActors funcionaram normalmente. Portanto, em vez de busca textual completa, a pesquisa seguiu três etapas: encontrar contas com actor.searchActors, ler seus feeds com getAuthorFeed e verificar posts com getPostThread. Isso limita a cobertura de posts de usuários comuns que seriam encontrados por hashtags ou busca transversal.
  • A página web https://bsky.app/search?q=... é uma SPA renderizada no cliente; o texto dos posts não está disponível no HTML para leitura direta.
  • A descoberta de posts via motores de busca com site:bsky.app retornou principalmente posts antigos, de 2024 a início de 2025; quase não havia posts recentes de setembro de 2026 indexados.
  • Por esses motivos, os posts coletados se concentram nos feeds de contas específicas, principalmente @testingcatalog.com, @huggingfacetrends.bsky.social e marcas oficiais. Não é possível medir o volume de menções ou o sentimento da plataforma como um todo.

Lemmy

Lemmy — Tópicos sobre IA de geração de imagens e vídeo (pesquisa de 17/09/2026)

Comunidades
  • !«メールアドレス» — 5,71 mil assinantes, 1,41 mil posts e 1,93 mil comentários. Moderadores: db0 e Even_Adder. É a comunidade mais ativa, com lançamentos quase diários de ferramentas de pesos abertos, LoRAs e nós personalizados para ComfyUI.
  • !«メールアドレス» — 2,36 mil assinantes (362 locais). Galeria de obras feitas com Stable Diffusion/modelos de pesos abertos. Um usuário, Even_Adder, publica quase a cada uma ou poucas horas.
  • !«メールアドレス» — 51 assinantes, 25,2 mil posts acumulados. Comunidade que espelha subreddits de IA via RSS. Tem poucos assinantes, mas permite encontrar comparações de IA generativa que não aparecem em outras instâncias.
  • !«メールアドレス» — recebe obras ligadas a Nano Banana, mas o Anubis (proteção contra bots) bloqueou a obtenção da lista.
  • !«メールアドレス» — segundo resultados de busca, comunidade muito pequena, com 222 assinantes e 11 posts; o acesso direto falhou com erro 500.
  • !«メールアドレス» (também chamada sneerclub) — comunidade de ironia e crítica sobre a indústria de IA, com ocasionais posts céticos sobre empresas de geração de imagens.
Posts
  1. “Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?” — !«メールアドレス», 14/09/2026, pontuação 1
    https://lemmy.durstig.online/post/60037
    Comparação de colorização de um quadro de Berserk por quatro IAs. ChatGPT Images 2.5 foi o melhor em preservar traço e composição; Wan 2.7 Pro teve boa iluminação, mas repintou partes; Nano Banana Pro ignorou a instrução de não alterar elementos; Seedream 5.0 Pro preservou a composição, mas foi saturado demais. O custo total do teste foi declarado como US$0,30.

  2. “Taking a traditional filmmaking approach while making the Robo Dad animation” — !«メールアドレス», 22/08/2026, pontuação 0
    https://lemmy.durstig.online/post/55214
    Exemplo de fluxo híbrido: filmagem de marionetes artesanais → geração de folha de personagens com Nano Banana → vídeo com Seeddance 2.0.

  3. “Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images” — !«メールアドレス», 07/08/2026, pontuação 1
    https://lemmy.durstig.online/post/52162
    Recurso que integrou Nano Banana 2 ao Google Earth foi retirado no dia seguinte ao lançamento, após a produção em massa de imagens que inventavam desastres e instalações militares em lugares reais.

  4. “It's like an album cover...” — !«メールアドレス», 07/08/2026, pontuação -8
    https://lemmy.ca/post/69025640
    Imagem em estilo de capa de álbum tropical criada com Nano Banana (Gemini 2.5 Flash). A pontuação negativa mostra também uma reação fria às imagens geradas por IA.

  5. “Midjourney wants Hollywood studios to reveal AI usage” — !«メールアドレス», 05/07/2026, pontuação 12
    https://lemmy.today/post/56011946
    Notícia de que a Midjourney pede aos estúdios de Hollywood que revelem o uso de IA.

  6. “Midjourney AI pivots to Theranos: Ultrasonic CT” — !«メールアドレス» (autor David Gerard), meados de junho de 2026, pontuação 41
    https://awful.systems/post/8731127
    Post irônico sobre a entrada da Midjourney no setor de equipamentos médicos de “tomografia ultrassônica”, que faria uma varredura semelhante a ultrassom do corpo inteiro debaixo d’água. Compara a empresa à Theranos e reúne muitos comentários céticos: “por que uma empresa de geração de imagens e violação de direitos autorais entraria em dispositivos médicos?”.

  7. Novas ferramentas abertas (!«メールアドレス», autor Even_Adder, 14–17/09/2026)

  8. “Dark Wings Silhouette” — !«メールアドレス», 17/09/2026, pontuação 2
    https://lemmy.dbzer0.com/post/75601450
    Obra criada com o modelo Krea2 e processamento de Qwen Image. Nos comentários, discute-se como usar localmente variantes Qwen 3.5/3.8 e GLM 5.2, além de questões de hardware: modelos de fronteira não caberiam nem em clusters B300 com 2,1 TB de HBM.

Sinais
  • Conversas sobre produtos fechados tendem a ser sobre acidentes, polêmicas e ironia, e não novos lançamentos: a controvérsia Nano Banana no Google Earth e a comparação da Midjourney com Theranos. Muitos itens só aparecem em comunidades espelho de Reddit, como !ai_reddit e !imageai; comunidades nativas do Lemmy fazem poucas menções.
  • No código aberto, !«メールアドレス» é o polo de atividade de facto. Foi possível observar o movimento OSS típico em que o ecossistema ComfyUI — nós, LoRAs e versões de baixo uso de memória — se organiza intensamente em poucos dias em torno de um único modelo, MiniMax H3.
  • As comunidades são pequenas, de dezenas a alguns milhares de assinantes, e têm volume limitado em comparação com Reddit/X.
  • A ferramenta de busca captura ruído com facilidade. Em um momento, um post irlandês sobre guarda de uma criança chamado “#BringSoraHome” quase foi confundido com o fim do serviço OpenAI Sora. Após leitura individual, confirmou-se que “Sora” era o nome da criança, e o item foi excluído deste relatório.
Limites
  • O objetivo de analisar “cerca de 20 posts” não foi alcançado somente com o Lemmy. Mesmo combinando busca na API e navegação por comunidades, foram encontrados pouco mais de 10 itens diretamente ligados ao tema; por ser uma plataforma pequena, não houve inflação artificial.
  • lemmy.world/c/stablediffusion e lemmy.world/c/«メールアドレス» retornaram erro 500 no acesso direto.
  • !«メールアドレス» foi bloqueada pelo Anubis, impedindo a coleta da lista de posts.
  • Buscas por “Grok Imagine”, “Veo 3” e “Kling AI” não retornaram posts relevantes; discussões específicas desses serviços fechados de geração de vídeo quase não aparecem no Lemmy.
  • A busca da API retorna muito ruído de baixa relevância. Foram incluídos apenas posts cuja leitura individual confirmou relação com o tema.

Pinterest

Pinterest — Notícias sobre IA de geração de imagens e vídeo

Temas visuais
  • Androide humanoide cromado/branco como atalho visual para “IA”: cabeça ou torso robótico brilhante, com olhos azuis luminosos/circuitos, muitas vezes numa mesa de notícias ou segurando um microfone, representa “IA” em dezenas de pins sem relação entre si [5, 7, 10, 12, 20, 26, 30, 33, 47]. É o motivo mais repetido do conjunto.
  • Enquadramento “o jornalismo está morrendo por causa da IA?”: cenas de redações em que robôs substituem ou ficam ao lado de apresentadores humanos, geralmente com uma pessoa ansiosa no quadro, acompanhadas por chamadas como “AI Is Writing the News — Can We Still Trust Journalism?” [2, 7, 12, 17, 19, 26, 33].
  • Gráficos de ansiedade sobre deepfakes/desinformação: sobreposições de malha facial que transformam um rosto em outro, interfaces HUD de escaneamento biométrico e selos explícitos de “FAKE” sobre conteúdo criado por IA [9, 14, 16, 18, 44, 47].
  • Paleta azul/ciano de tecnologia domina: seja um robô, uma mão segurando um chip “AI” iluminado ou um painel holográfico de escritório, a gradação padrão é azul/ciano profundo com destaques brancos [6, 16, 20, 21, 30, 44].
  • Anúncios de conteúdo sem rosto/comércio UGC: anúncios de serviços no estilo Fiverr e ferramentas de “Go Viral Without Showing Your Face” vendem avatares de IA, troca de rosto e geração de vídeos de demonstração de produtos para profissionais de marketing e criadores [4, 9, 11, 18].
  • Infográficos de listas e resumos para descoberta de ferramentas: “Top 5 Free AI Tools for Photo Generation”, “Top AI News of July 2026”, painéis de logos de ChatGPT/Gemini/Claude/Microsoft/Google/Apple/Samsung/Meta/Nvidia — todos nomes grandes e fechados [30, 36, 42].
  • Produtos fechados identificáveis que de fato aparecem: Adobe Firefly (colagem de marca) [42], diagrama do VASA-1 da Microsoft para áudio→rosto [14], o modelo Vidu S1 da ShengShu Technology, mostrado duas vezes com arte cyberpunk quase idêntica [29, 38], e a controvérsia da atriz de IA Tilly Norwood em uma captura de tela de TV [1].
  • Renders fofos de animais feitos por IA como isca de marketing leve: uma lontra com colete salva-vidas em um stand-up paddle e um filhote entre flores aparecem como demonstrações de geradores de foto/vídeo, não como “notícias de IA” propriamente ditas [13, 36].
Pins notáveis
  • #1 — “Hollywood Reporter Interviews the First AI Actress...”: captura de TV com a tarja “AI-GENERATED IMAGE” sobre a foto de Tilly Norwood/Instagram — a polêmica mais claramente ligada ao mundo real no conjunto.
  • #7 — androide sem título numa redação: robô numa bancada de apresentação cercado por painéis “NEWS”, enquanto uma repórter humana parece surpresa — a imagem mais pura da ansiedade de “IA tomando a bancada de notícias”.
  • #47 — “AI content and social media concerns”: robô segurando celular ao lado de um selo “FAKE” sobre foto de gato feita por IA e uma figura encapuzada — a visualização mais direta do problema compartilhado de confiança no debate aberto/fechado.
  • #14 — diagrama VASA-1: uma imagem + clipe de áudio + sinais de controle → grade de animação facial ao vivo — figura técnica real, não arte de banco de imagens, relacionada à pesquisa da Microsoft em rostos falantes dirigidos por áudio.
  • #29 / #38 — Vidu S1 (ShengShu Technology): “The World's Most Advanced Model for Real-Time AI Interaction”, arte principal cyberpunk repetida em dois pins — lançamento genuíno de um modelo fechado chinês de vídeo.
  • #42 — colagem de marca Adobe: marca Adobe/Firefly vermelha sobre retrato e paisagens gerados — incumbente fechado marcando posição no setor.
  • #36 — “Top 5 Free AI Tools for Photo Generation”: lista Midjourney, Bing Image Creator, Canva AI, Leonardo AI e Playground AI com exemplos — o resumo mais próximo de ferramentas abertas/com faixas gratuitas no conjunto.
  • #13 — lontra gerada por IA em stand-up paddle: descrita como “3D digital render”, usada como demonstração de uma ferramenta de vídeo — mostra como “notícias de vídeo de IA” no Pinterest muitas vezes significam demos de produto, não jornalismo.
  • #18 — “Go Viral Without Showing Your Face”: criador encapuzado diante de uma estação de edição com dois monitores para clonagem de rosto — IA de avatar/face é vendida como produto de growth hacking para criadores.
  • #9 — anúncio de troca de rosto (“Videos Pro”): os rostos de duas mulheres se fundem por uma malha de rastreamento, vendido como “hyperrealistic face editing” — ferramenta de deepfake comercializada diretamente ao consumidor.
Sinais
  • O que é atual: a narrativa dominante do Pinterest não é “qual modelo lançou o quê”, mas ansiedade e oportunismo em torno de rostos gerados por IA: deepfakes, âncoras de IA, apps de troca de rosto e ferramentas de conteúdo sem rosto formam um grupo muito coeso. A história da atriz de IA Tilly Norwood [1] e o modelo de vídeo interativo em tempo real Vidu S1 [29, 38] são os dois pins que parecem notícias de fatos atuais, em vez de arte conceitual ou conteúdo de afiliados.
  • O que está praticamente ausente: notícias específicas de código aberto são essencialmente invisíveis. Nenhum pin cita Stable Diffusion, Flux, HunyuanVideo, Wan, ComfyUI ou algum projeto nativo do GitHub. Os pins de ferramentas [30, 36, 42] listam produtos fechados hospedados, como ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney, Bing Image Creator, Canva e Leonardo. A estrutura de incentivos do Pinterest — miniaturas de SEO, listas de afiliados e anúncios de serviços — parece favorecer produtos fechados voltados ao consumidor em vez de lançamentos de comunidades abertas.
  • O detalhamento técnico é escasso: fora o diagrama VASA-1 [14] e a marca Vidu S1 [29, 38], quase tudo é foto de banco/clipart genérico que ilustra o conceito de IA, em vez de retratar uma notícia, lançamento ou demonstração concreta.
Limites
  • Esta etapa usou pins que o worker havia coletado anteriormente em navegador headless (output/pinterest.pins.md, 50 pins sob uma única busca/gênero sem rótulo). Conforme o playbook, não naveguei no Pinterest diretamente; portanto, trata-se de uma única passagem de busca, não de uma varredura exaustiva.
  • Abri e revisei visualmente 30 das 50 imagens. As 20 restantes não foram abertas individualmente, embora seus títulos tenham sido revisados e sejam consistentes com os temas acima.
  • Nenhuma página de destino dos pins foi buscada: só estavam disponíveis a imagem e o título salvo. Assim, não foi possível verificar contexto além do que aparece na imagem, como artigo completo, comentários ou números de salvamentos/repins.
  • Notícias de geração de imagem/vídeo em código aberto são quase um beco sem saída nesta plataforma: o conjunto simplesmente não mostra projetos abertos identificáveis. A metade “tendências de código aberto” do relatório deve se apoiar nas demais etapas — Reddit, X, YouTube, Bluesky e Lemmy — e não no Pinterest.

Ações recomendadas

  • Refazer a coleta no X (antigo Twitter) com buscas como “Sora 2”, “Nano Banana Pro”, “Wan” e “Flux”, em vez de passar por tendências.
  • Verificar a suspeita de fechamento do Wan 3.0 em fonte primária (anúncio oficial da Alibaba) e acompanhar as consequências para o cenário aberto de geração de vídeo.
  • Monitorar !«メールアドレス» para acompanhar rapidamente os movimentos em torno do MiniMax H3.
  • Como GPT Image 2.5 e Nano Banana Pro são comparados de forma consistente em várias plataformas, investigar também comparações com uma terceira força, como Seedream 5.0 Pro, na próxima rodada.
  • Recomenda-se observar continuamente filtros de segurança excessivos e problemas de geração incorreta nos modelos do Google como notícias de confiabilidade, pois há relatos repetidos.

Imagens coletadas

Hollywood Reporter Interviews the First AI Actress...New York's Bold Gambit: Inside the Legislative...imageDiscover how Grok is revolutionizing video...De toekomst van creativiteit: MrBeast over AI’s impact op YouTubeI will create ai ugc video, ai ugc ads, ugc, ai product ads, ai commercial video adsBest 10 AI YouTube Script Writers in 2026AI Ecosystem interconnected Artificial Intelligence Ecosystem"Why AI Chatbots Fail at Keeping Up with Breaking News"Het perfecte avatar-tijdperk: De opmars van AI-influencersTransforma tus fotos y videos ¡Akool es la herramienta impulsada por IA que estabas esperando! 🚀The Snarky AI News RoundUp #8imageNew Microsoft AI Tool Can Now Animate Faces from...imageWhat are the Applications of AI in Video Recognition?AI News Anchors & Creator-Led Coverage Take Over U.S. Media!Free AI-Powered Visual Content Generation Platform – Viva AIAI Is Writing the News – Can We Still Trust Journalism?Go Viral Without Showing Your FaceCreate A News Channel Using AI | News Presenter| AI Avatar | Video Generator Free |ChatGPT & CanvaUncategorized Archives - Expert Graphic International: Photo Editing CompanyimageTurn AI art into physical products. Follow for tips!imageWatermarking AI Content: Proving Origin (2025 Challenge)imageAI Draft vs Human Editing: What Makes Content Feel Real?Revolutionize Your Videos with AI: Top 5 Tools!Top AI News of July 2026: Biggest AI Updates, New Features & Industry TrendimagePhotogtraphy — Blog — Glyn DewisThe state of AI in the newsroom | Framing the...Looking for latest world news updates? Here are ten global headlines you should knowAITop 5 Free AI Tools for Photo Generation in 2026 | Best AI Image GeneratorsFuturistic Classroom – Learning About Global TechnologyShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoCreate Amazing Videos in Minutes with Invideo AI! 🚀🎥XIAOMI 12_ Life is a filmthe invisible wardenMarch 16 Cutoff: Firefly Opens Unlimited AI Images and VideosAI Tool To Turn Text Into ImagesAdvancements in AI Facial Recognition for Headshot...GoDaddy “Make a Different Future 2021”I will create ai art video or animated story using aiAI content and social media concernsHow Artificial Intelligence is changing education trends15 Biggest AI Updates You Need to Know | Latest AI News & TrendsReduce Decision Fatigue with a Better Notion System

Nota sobre a qualidade dos dados

O método de coleta do X se desviou do tema e obteve zero itens relevantes, tornando a plataforma praticamente inútil nesta rodada. Reddit e Lemmy não alcançaram o critério de conclusão de “cerca de 20 itens”. No YouTube, não foi possível confirmar visualizações e nomes de canais; no Bluesky, a API de busca não funcionou e foi necessário usar métodos alternativos.

Galeria