KEN’S CAT LOG

Notícias de IA para Geração de Imagens e Vídeos — 2026-09-07

O lado de código fechado anuncia uma troca de protagonismo com o fim da API do Sora2 (2026/9/24) e a transformação do GPT-6 Astra em um agente generalista, enquanto o ecossistema de código aberto de ComfyUI/MiniMax-H3/Qwen-Image-Edit cresce diariamente e já alcança uso prático até em GPUs de consumo.

Notícias mais recentes de IA para geração de imagens e vídeos — 7 de setembro de 2026

Nossa, foi uma semana insana 🔥🔥 No lado de código fechado, o "GPT-6 Astra" da OpenAI está sendo rapidamente valorizado não só como gerador de imagens e vídeos, mas como um "agente que comanda várias outras ferramentas". Já o até então rei "Sora 2" entrou inesperadamente na reta final de encerramento do serviço (Web/app encerrados em 2026/4/26, e a API também deve ser descontinuada por completo neste mês, em 2026/9/24) 😱 Enquanto isso, o pessoal do código aberto está discretamente fervendo: o ecossistema de "MiniMax-H3" e "Qwen-Image-Edit" em torno do ComfyUI ganha novos componentes quase todos os dias, e chegamos à era em que é possível gerar vídeos de verdade em GPUs de consumo, inclusive AMD 🛠️✨ Outra coisa comum a todas as plataformas é o clima de que "se descobrirem que foi gerado por IA, você vai ser criticado"; foi realmente surpreendente ver exigências por rotulagem de autenticidade e vozes anti-IA dominando os posts com mais curtidas.

Entre plataformas 🌐

Plataforma por plataforma 📱

Reddit: Posts de benchmark de geração local em r/StableDiffusion e listas de ferramentas grátis em r/freetoolsAI (Deepany, Aifun, Perchance etc.) são fortes como informação prática voltada ao código aberto. Já em r/aiwars, a qualidade de imagens comerciais de IA de código fechado para publicidade de alimentos foi criticada (177 comentários, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Como houve apenas um termo de busca, a coleta parou em 12 tópicos e não atingiu a meta de 20.

X: Foram coletados 40 posts, mas apenas 4 eram relacionados ao tema 😅 (todo o resto era ruído de tendências sobre futebol, política ou Croácia). Esses quatro posts, porém, elogiaram fortemente o GPT-6 Astra e não fizeram nenhuma menção a código aberto. Foi inteiramente dominado por código fechado.

YouTube: Foi a plataforma com maior volume de informação. No código fechado: fim do Sora2, GPT-6 Astra, atualização Midjourney V7 (compatível com entrada de voz em japonês, https://www.youtube.com/watch?v=wFHlG7wcRUQ) e Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY). No código aberto, os protagonistas foram Flux.2 (Dev/Klein sob Apache 2.0, https://www.youtube.com/watch?v=ISRy5Skd04U) e Qwen-Image-Edit-2511 (muitos tutoriais de ComfyUI, https://www.youtube.com/watch?v=ScoIZYsoRwo). Também houve testes executando Wan2.2 e Hunyuan1.5 em GPUs AMD de consumo (https://www.youtube.com/watch?v=a_xzC7ckwno).

Bluesky: Estrutura bipolar entre pessoas que usam ferramentas e pessoas anti-IA. No código fechado, o fluxo de trabalho Nano Banana (Gemini 3.1) + Kling 3.0 foi popular (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), enquanto o anúncio do novo modelo Grok Imagine, da xAI, não recebeu curtidas. No código aberto, havia opiniões favoráveis ao ComfyUI e usuários do Stable Diffusion WebUI reForge com AMD ROCm. Devido às limitações da API (muitos erros 403), foram analisados efetivamente só 11 itens, em vez da meta de 20.

Lemmy: O entusiasmo pelo código aberto foi esmagador: somente em !«メールアドレス» houve 11 posts de ferramentas, como Viggle-Animate e integração nativa de Trellis.2 + Pixal3D com ComfyUI. No código fechado, o único assunto consistente foi a notícia de que a Midjourney estaria mudando de geração de imagens para escaneamento médico por ultrassom (score máximo de 73, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood), republicada em várias instâncias. O fato de não ter sido encontrada nenhuma notícia sobre Sora ou Veo no Lemmy foi, por si só, uma descoberta.

Pinterest: Foram revisados todos os 50 pins coletados previamente, e a plataforma foi quase inteiramente dominada por infográficos de ranking de ferramentas comerciais de código fechado — Veo, Sora, Runway, Kling, Pika, Adobe Firefly e outras. Quase não havia referência ao código aberto, exceto "Amuse 3.0", que promove execução local. Também chamou atenção que preocupações e conteúdo de detecção de deepfakes já se tornaram um gênero independente.

O que observar 👀

Recomendações 💡

  • Se houver um fluxo de trabalho dependente do Sora2, faça agora um plano de migração para Kling 3.0 ou Veo 3.1 antes do fim da API, em 2026/9/24.
  • Acompanhe o ComputerUse do GPT-6 Astra avaliando-o como uma ferramenta de automação do pipeline de produção, e não como uma IA generativa isolada.
  • Para reduzir custos, parece mais vantajoso experimentar edição local com Qwen-Image-Edit + ComfyUI antes de decidir por assinaturas de ferramentas de código fechado.
  • Para se preparar para riscos de repercussão negativa com falsos timelapses ou edição por IA, estabeleça antes internamente regras de divulgação do uso de IA em conteúdo público.
  • Vale testar o fluxo de trabalho dividido Nano Banana (imagem estática) + Kling 3.0 (transformação em vídeo), pois já foi aprovado por vários criadores independentes.
  • Continue acompanhando a mudança de negócio da Midjourney para verificar se outras empresas de código fechado também seguirão uma diversificação semelhante.

Qualidade dos dados 📊

Nenhuma plataforma atingiu totalmente os critérios de conclusão de brief.md — cerca de 20 análises por rede social 😅 Em especial, no X, mesmo após coletar 40 posts, apenas 4 eram relevantes, pois os termos de busca vieram de tendências regionais da Croácia e estavam cheios de ruído sobre futebol e política. No Bluesky, quase metade dos termos testados falhou por limitações 403 de taxa da API, deixando apenas 11 itens efetivos. No Reddit, houve só 12 tópicos porque foi usado apenas um termo; no Lemmy, foram 15 itens, 11 de código aberto e 4 de código fechado, porque a própria comunidade especializada em notícias não existe. O YouTube foi considerado concluído com 11 vídeos segundo o critério do playbook (5 a 12), embora metadados como número de visualizações não pudessem ser coletados devido à renderização em JS. Somente no Pinterest foi possível revisar todos os 50 itens pré-coletados, mas quase não apareceram pins relacionados a código aberto por causa da consulta única. Em resumo: embora a quantidade tenha ficado abaixo da meta, seis plataformas confirmaram de forma independente a mesma direção — GPT-6 Astra, fim do Sora2 e expansão do ecossistema ComfyUI —, então o panorama das grandes tendências parece suficientemente confiável 🙆

Resumo por plataforma

Reddit

Reddit — Notícias de IA para Geração de Imagens e Vídeos

Onde

Foram coletados 12 tópicos de 11 subreddits com o termo de busca "Image and Video Generation AI News".

Subreddit Número de membros Tópicos coletados
r/antiai 316,504 1
r/generativeAI 151,065 2
r/freetoolsAI 7,817 1
r/StableDiffusion 1,001,556 1
r/teenagers 3,675,063 1
r/aiwars 166,920 1
r/RemoteWorkers 74,882 1
r/aislop 82,721 1
r/TopAITools4U 2,396 1
r/GoogleFlow 1,750 1
r/EyesWideShut 15,320 1

A composição dos subreddits mostra uma divisão quase equilibrada entre comunidades especializadas em IA generativa (r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI) e comunidades contrárias ou críticas a imagens de IA (r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers). r/RemoteWorkers menciona o tema no contexto de uma vaga de trabalho.

Vozes das pessoas
  • Tópico nº 1 r/antiai · 6.792 pt · 994 comentários · 2026-09-05 — "Warning: There is a new form of ai generated image". Em vez de modelos de difusão, o post afirma que um LLM, identificado como GPT-6, pode controlar mouse e teclado para falsificar "ilustrações reais" junto com timelapses que parecem desenhados à mão. O tópico chegou a 994 comentários. Comentário principal (2.483 pt, u/Nayutantantan): "Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common." — Também recebeu forte apoio a exigência de rotulagem imediata (u/Soggy_Supermarket100, 170 pt).

  • Tópico nº 5 r/teenagers · 7 pt · 41 comentários · 2026-08-31 — "To all AI image/video generator users". O argumento é que "a IA apenas executa sua ideia; quem realmente está desenhando é a própria IA". u/LiterallyGarbage_0 (5 pt): "if you want to make art, pick up a pencil and start drawing". Por outro lado, u/TheDarkmoore (2 pt) defendeu o uso prático: utilizou IA para a arte de um jogo de cartas, pois era a opção necessária para alguém que não desenha bem. Há divisão também entre essa geração.

  • Tópico nº 6 r/aiwars · 4 pt · 177 comentários · 2026-09-03 — "Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food". A discussão cresceu de forma incomum, chegando a 177 comentários. u/Your-local-enjoyer (9 pt): "Fotografar comida real dá ao cliente uma expectativa mais precisa". Como contraponto, u/Bassed_Hummble (5 pt) mostrou um prompt específico gerado localmente com Krea 2 em 40 segundos e argumentou que conseguiu criar um "burrito de café da manhã apetitoso"; surgiu também a visão de que o problema seria o prompt, e não o modelo.

  • Tópico nº 4 r/StableDiffusion · 31 pt · 10 comentários · 2026-09-03 — "VPIPE: Not Just Video — Local Image Generation Is Fast Too". Benchmark de geração local no Apple Silicon (M5 Pro de 24 GB), usando krea/Krea-2-Turbo-M87 (16 bits) + LoRA M87: aproximadamente 45 segundos por imagem em 1024×1024, 8 etapas; em quantização de 8 bits em tempo real, 35 segundos. u/Glittering-Call8746 (1 pt) comentou que está avaliando as diferenças de velocidade entre M5 Max e M5 Pro e comparações com a série RTX 5000.

  • Tópico nº 11 r/GoogleFlow · 12 pt · 6 comentários · 2026-09-01 — "AutoFlow just got continuous AI video generation". A extensão não oficial de Chrome "AutoFlow" para Google Flow/Veo adicionou o recurso "Continue from Last Frame", reutilizando automaticamente o último quadro do clipe anterior como o primeiro do próximo, facilitando vídeos longos. O próximo recurso planejado é renderizar vários clipes em um único vídeo contínuo.

  • Tópico nº 10 r/TopAITools4U · 1 pt · 10 comentários · 2026-09-01 — "Tested 4 best AI video generators in 2026 for beginners". O autor comparou Sora 2 (cinematográfico, mas com preço e acesso como entraves), Kling AI (adequado para B-roll realista), DomoAI (adequado para animação e conversão de estilo) e Google Veo 3.1 (gera imagem e áudio ao mesmo tempo e oferece cota gratuita). Nos comentários, u/brarkaddy (2 pt) sugeriu também a geração gratuita de vídeo com Qwen.

  • Tópico nº 3 r/freetoolsAI · 38 pt · 45 comentários · 2026-09-04 — "Free AI Image Generator". Em resposta à divulgação de aifreeforever.com, que promete uso grátis, ilimitado e sem cadastro, u/Odd-Lingonberry1516 (3 pt) listou Deepany (família z-image turbo/illustrious), Aifun (wai illustrious e dois usos diários gratuitos para vídeo) e Perchance (família Stable Diffusion/flux) como alternativas. u/Relevant_Syllabub895 (2 pt) reclamou das restrições de NSFW.

  • Tópico nº 2 r/generativeAI · 43 pt · 29 comentários · 2026-08-31 — "List of daily AI video generative websites". u/Jenna_AI (4 pt, bot de IA) apresentou detalhes da cota gratuita do Kling AI: 66 créditos a cada 24 horas, equivalentes a 2–6 vídeos de 5 segundos por dia. u/Julia_Leeds94 (2 pt) informou que o YalleryLabs custa US$ 0,18 por vídeo de 5 segundos em 720p com um orçamento de US$ 3.

  • Tópico nº 12 r/EyesWideShut · 35 pt · 9 comentários · 2026-09-06 — "AI generated images shouldn't be allowed here". Sobre um post que usava IA para modificar screenshots de um filme de Kubrick, o autor acusou a publicação de espalhar desinformação. A pessoa que fez a edição, u/ffcc01 (2 pt), respondeu que apenas sobrepôs duas fotos e não alterou o conteúdo. As opiniões da comunidade se dividiram sobre os limites aceitáveis da edição com IA.

  • Tópico nº 8 r/RemoteWorkers · 130 pt · 623 comentários · 2026-09-04 — "Get Paid $30/Hour Reviewing AI-Generated Images". Anúncio de vaga pagando US$ 30 por hora para verificar legendas geradas por IA, identificando objetos, cores e textos reconhecidos incorretamente. Apesar dos 623 comentários, a maioria era apenas uma repetição da palavra "images" de pessoas tentando obter o link de candidatura, sem discussão substancial.

  • Tópico nº 9 r/aislop · 37 pt · 4 comentários · 2026-09-06 — "Saw this on a news article, an AI slop image explaining what is AI slop". Uma imagem gerada por IA que explicava o que é "AI slop", publicada em uma notícia, foi tratada como uma piada autorreferencial. Houve apenas quatro comentários, sem análise aprofundada.

Sinais
  • Tendência de alta: Relatos de implementação de geração local e de código aberto, como VPIPE/Krea 2 no tópico nº 4, foram bem recebidos quando acompanhados de benchmarks concretos — segundos, número de etapas e hardware. Em r/StableDiffusion, equilibrar velocidade e qualidade é o principal critério de avaliação.
  • Tendência de alta: A exigência por rotulagem de autenticidade de conteúdos gerados por IA, vista no tópico nº 1, recebeu forte apoio em uma discussão de 994 comentários. "Falsificação de timelapse" foi citado especificamente como uma nova preocupação.
  • Desprezado ou recebido com ironia: Imagens comerciais de IA de código fechado, especialmente para publicidade de alimentos, foram tratadas até em r/aiwars como qualidade difícil de defender (tópico nº 6), e a discussão de 177 comentários foi quase inteiramente crítica.
  • Ponto inesperado: Em muitos tópicos, quem sustentava a discussão prática eram bots de IA — u/Jenna_AI apareceu tanto no tópico nº 2 quanto no nº 7. Em vez de debates profundos entre pessoas, o principal valor estava em informação utilitária, como listas de cotas gratuitas.
  • Conflito: No tópico nº 12 (EyesWideShut), o grupo que entende "edição por IA = alteração/desinformação" confronta diretamente o grupo que entende que uma composição simples não altera o conteúdo. Não há consenso claro sobre o limite aceitável de edição por IA.
  • Ponto inesperado: O tópico nº 8 teve o maior engajamento da coleta, com 623 comentários, mas quase todos eram mensagens repetidas buscando o link da vaga. É um exemplo típico de que muitos comentários não significam profundidade de debate.
Limites
  • Foi usado apenas o termo "Image and Video Generation AI News". Não houve buscas adicionais com "open source image generation", "closed source video AI" ou nomes de serviços específicos, como Midjourney, Sora e Kling. Portanto, os dados estão inclinados a assuntos encontrados por essa busca genérica.
  • Foram coletados apenas 12 tópicos, abaixo do critério de conclusão de brief.md, que previa aproximadamente 20 tópicos por rede social.
  • Os tópicos nº 7 e nº 9 tiveram somente 1 e 4 comentários, respectivamente; alguns casos continham apenas respostas de bot, como u/Jenna_AI, deixando pouco material para aprofundamento.
  • O período de coleta cobre apenas cerca de uma semana, de 2026-08-31 a 2026-09-06; não permite comparação com tendências anteriores.
  • Poucos tópicos podem ser classificados claramente no eixo código fechado/código aberto — mais próximos de código fechado: nº 6, nº 10 e nº 11; mais próximos de código aberto: nº 3 e nº 4. Para chegar às dez observações de cada lado no relatório final, seriam necessários dados de outras plataformas.

X

X — Notícias de IA para Geração de Imagens e Vídeos

Contas

Dos 40 posts e 37 contas coletados, somente as quatro contas abaixo estavam efetivamente relacionadas ao tema de IA para geração de imagens e vídeos. Todas são contas pessoais com um único post, compartilhando experiências diretas com ferramentas, não grandes contas especializadas em viralização.

Conta Nome Número de posts Curtidas Perfil
@aigeboku AI様の下僕 1 1,281 Pessoa testando ComputerUse do GPT-6 Astra
@MiraMusic_AI MiraMusic 1 525 Conta que publica produção de anime com IA
@manaimovie Mankyu 1 562 Criador individual de modelos 3D × vídeo por IA
@Yokohara_h Hirokazu Yokohara 1 2,156 Maior reação entre as quatro contas; perfil técnico pessoal

As outras 33 contas — lideradas por @kaihavertz29, com 96.184 curtidas, e incluindo perfis pessoais sobre futebol, F1, política alemã, bitcoin e Bósnia — não tinham relação com o tema. Veja detalhes em "Limites" abaixo.

Posts
  • nº 29 @aigeboku (2026-09-05 · 1.281 curtidas · 135 reposts · 14 respostas · cerca de 94.000 visualizações) https://x.com/aigeboku/status/2096187322924687799 — "Como se diz que o GPT-6 Astra é bom em controlar outras coisas, ao usar ComputerUse ele amplia muito o que podemos fazer 😎🙌". Avalia o GPT-6 Astra menos como gerador de imagens e vídeos em si e mais como base para controlar outros aplicativos.

  • nº 30 @MiraMusic_AI (2026-09-06 · 525 curtidas · 50 reposts · 6 respostas · cerca de 26.000 visualizações) https://x.com/MiraMusic_AI/status/2096441679847006358 — "【Compartilhando produção de anime com IA nº 1】Tentei criar uma cidade com GPT-6 Astra e blender! Como o vídeo foi feito em 15 minutos, talvez não fique fácil de entender...". Exemplo de criação de arte de cenário combinando GPT-6 Astra e Blender.

  • nº 31 @manaimovie (2026-09-05 · 562 curtidas · 61 reposts · 19 respostas · cerca de 35.000 visualizações) https://x.com/manaimovie/status/2096176821377380677 — "Entreguei ao professor Astra um modelo feito no Tripo e pedi para torná-lo animado; foi isso que ele conseguiu. Ainda há muitos pontos que me incomodam, mas está bem melhor do que na época de Fable ou Sol!". Compara nominalmente com ferramentas semelhantes, "Fable" e "Sol", avaliando a superioridade do Astra.

  • nº 32 @Yokohara_h (2026-09-06 · 2.156 curtidas · 299 reposts · 19 respostas · cerca de 178.000 visualizações; a maior reação entre os quatro) https://x.com/Yokohara_h/status/2096622171011666003 — "Passei uma imagem, ele modelou automaticamente uma paisagem urbana de fundo no Blender e também editou automaticamente o breakdown. A qualidade ainda está longe do ideal, mas sinto que começou uma era em que 3DCG não é mais feito manualmente por pessoas". Embora reconheça que a qualidade ainda está em desenvolvimento, avalia a mudança para produção de 3DCG sem trabalho manual direto.

Entre os 40 posts coletados, nenhum além desses quatro mencionou IA para geração de imagens ou vídeos, seja de código fechado ou aberto.

Sinais
  • Tendência de alta: O GPT-6 Astra, de código fechado, chama atenção pelo papel de "controlar outras ferramentas" — ComputerUse e integração com Blender. Em vez de ser discutido como modelo isolado de geração de imagens e vídeos, é apresentado como um hub que automatiza todo o pipeline de produção 3DCG (nº 29, nº 30 e nº 32).
  • Ponto inesperado: Os quatro autores fazem ressalvas como "a qualidade ainda é bruta" ou "há muitos pontos que me incomodam", mas todos avaliam a ferramenta de forma positiva. Há coexistência entre expectativa elevada e julgamento sóbrio da qualidade (nº 31 e nº 32).
  • Ignorado/sem menções: Não houve nenhuma referência a IA aberta de geração de imagens ou vídeos — famílias Stable Diffusion, Krea, Kling, Veo etc. A conversa relevante no X ficou completamente concentrada no GPT-6 Astra, de código fechado.
  • Ferramentas citadas como comparação: "Fable" e "Sol" (nº 31). O post não explica detalhadamente nenhuma delas, portanto exigem investigação adicional.
  • A escala de engajamento é pequena em comparação com tendências irrelevantes para o tema — futebol com até 96.184 curtidas e política com 10.062, por exemplo. Mesmo o máximo de 2.156 curtidas indica que o tema ainda não está realmente viralizando no X.
Limites
  • Os termos de busca estavam desalinhados do tema: Os termos usados — Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin e Bosnia — vieram diretamente da lista de tendências do X Explore. Exceto Astra, eram assuntos de futebol, F1, nomes/pessoas, política alemã, criptomoedas e conversas sobre Bósnia, sem relação com IA generativa de imagens e vídeos. Trinta e seis dos 40 posts eram ruído, e os quatro posts encontrados vieram apenas de "Astra".
  • Critério de conclusão não atingido: Em vez dos aproximadamente 20 posts relacionados por rede social exigidos por brief.md, foram coletados apenas quatro.
  • Regionalidade do Explore: A coluna "Where" indicava "$SONG" e "Bosnia" como "Trending in Croatia". Portanto, a lista de tendências do Explore nesta sessão refletia a Croácia/região dos Bálcãs, não tendências globais. Além disso, a coluna de quantidade de "Posts on X" estava vazia, então não foi possível obter esse indicador.
  • Nenhum movimento de código aberto foi encontrado no X: Esta coleta não encontrou um único post sobre IA aberta para geração de imagens e vídeos. É necessário complementar com dados de outras plataformas, como Reddit.
  • Todos os quatro posts relevantes vieram de contas em japonês; reações de comunidades em inglês, chinês e outros idiomas não foram coletadas.

YouTube

YouTube — Notícias de IA para Geração de Imagens e Vídeos

Canais
Canal Linha editorial Conteúdo abordado
AI大学【AI&ChatGPT最新情報】 Japonês, explicativo Vídeos sobre os modelos mais recentes de IA, incluindo GPT-6 Astra
まさおAI じっくり解説ch Japonês, explicativo Testes práticos e análises de modelos de IA
RKJ VIDEO【イケている動画を作りたいなら】 Japonês, especializado em vídeo por IA Comparações entre Sora/Veo/Kling e outras IAs de vídeo
AI収益化ラボ Japonês, monetização Monetização com ferramentas de IA e impacto de encerramentos de serviços
StableDiffusion等 チュートリアル&自作アニメ Japonês, especializado originalmente em código aberto Originalmente tutoriais da família Stable Diffusion, mas passou a abordar notícias de código fechado, como o fim do Sora2
AIたろう Japonês, explicativo Explicações de recursos de IAs de imagem como Midjourney
Teacher's Tech Inglês, explicativo Avaliações de ferramentas e recursos de IA do Google
OpenArt Inglês, mais próximo de canal oficial Vídeos de apresentação de modelos como Flux.2 em sua interface
Donato Capitella Inglês, técnico Testes de geração aberta de imagens e vídeos em GPUs locais, incluindo AMD
ErrorFixer Inglês, tutoriais Tutoriais de operação de modelos abertos em ComfyUI
AI Search Inglês, análises Avaliações rápidas de novas ferramentas de IA para imagens e vídeos

A quantidade de inscritos está na parte renderizada por JavaScript das páginas de vídeo; não foi possível obtê-la via WebFetch de youtube.com/watch ou youtube.com/results (veja "Limites"). Esta lista cobre apenas o que foi possível confirmar pelos snippets de busca e pelo oEmbed, uma API leve que retorna somente título e nome do canal.

Vídeos
  • "OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全" — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — Afirma que o GPT-6 Astra, lançado em 2026/9/3, supera Claude Fable 5.1 em quase todos os benchmarks e é o modelo mais inteligente e seguro de todos. O foco não é geração de imagens e vídeos em si, mas desempenho de agente generalista, incluindo controle de navegador e geração de código.

  • "【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説" — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — Após uso real, o canal o avalia como o modelo mais próximo de AGI no momento. Destaca muito a capacidade de ComputerUse para controlar outros apps, em linha com a avaliação observada no X.

  • "VEO 3.1とSORA2どっちがすごい?最新比較!" — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Compara Veo 3.1, lançado em 2025/10/15, com Sora 2 em recursos e qualidade de imagem. Foi publicado logo após o lançamento do Sora 2, por volta de outubro de 2025, fora da janela de 60 dias, mas foi incluído como contexto para as notícias posteriores de encerramento do Sora2.

  • "Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説" — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Explica, com base em informações oficiais, o encerramento do serviço Web/app do Sora 2 em 2026/4/26 e o fim da API em 2026/9/24, três semanas após a data deste relatório. Apresenta a hipótese de que a razão seria liberar recursos computacionais para o desenvolvimento de AGI.

  • "【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します" — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Explica o impacto do encerramento do Sora2 para criadores que monetizavam conteúdo com ele. Menciona exportação de dados via sora.chatgpt.com/sunset e a necessidade de migrar APIs para Kling, Runway e outras opções.

  • "Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。" — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — Apresenta os novos recursos do Midjourney V7: ferramenta de geração de vídeo, modo conversacional e entrada de voz em japonês. Mostra como uma ferramenta tradicional de geração de imagens vem incorporando texto para vídeo.

  • "The New Gemini Image Generator is Insane (Nano Banana 2)" — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Testa o recurso de geração de imagens Gemini do Google, "Nano Banana 2", e o considera uma grande evolução em relação à geração anterior. Demonstra que a competição em geração de imagens de código fechado está se expandindo de Midjourney/Ideogram para Google Gemini.

  • "FLUX.2 Has Landed On OpenArt!" — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Apresenta a disponibilidade da família Flux.2 da Black Forest Labs — Pro/Flex/Dev/Klein, anunciada em 2025/11/25 — no OpenArt. Destaca que Dev/Klein são pesos abertos sob Apache 2.0, com suporte a 10 imagens de referência e edição em 4 MP.

  • "Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)" — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Teste reunindo três modelos abertos — Qwen Image, Wan 2.2 e Hunyuan 1.5 — em uma GPU AMD de consumo, R9700 AI PRO. Indica que a geração aberta de imagens e vídeos está deixando de depender exclusivamente de equipamentos NVIDIA de ponta.

  • "Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)" — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — Tutorial de operação local em ComfyUI do modelo de edição de imagens de pesos abertos Qwen-Image-Edit-2511, da Alibaba, lançado em 2025/12/26. Demonstra edição de imagens e geração de múltiplos ângulos apenas com instruções textuais.

  • "This new AI image editor is a BEAST. Qwen Image Edit tutorial" — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — Também testa Qwen-Image-Edit, com 20 bilhões de parâmetros e suporte nativo a ControlNet, considerando que seu desempenho rivaliza com ferramentas de edição de código fechado.

Sinais
  • O maior tema de código fechado é o GPT-6 Astra, lançado em 2026/9/3: Ele é apresentado como agente generalista capaz de operar navegador/aplicativos com ComputerUse e realizar tarefas de edição de vídeo, não como um modelo isolado de geração de imagens ou vídeos. Isso coincide com a tendência observada no X, que o avalia como hub de produção em integrações com Blender, confirmando a mesma narrativa entre plataformas.
  • O fim do Sora 2 é uma das maiores notícias da geração de vídeo de código fechado: Web/app foram encerrados em 2026/4/26, e a API também deve terminar em 2026/9/24, três semanas após a data deste relatório. Vários canais abordam "por que desapareceu" e "para onde migrar"; no YouTube, o foco passou de recursos novos do Sora2 para o que fazer depois dele.
  • Kling disputa a posição de sucessor do Sora2: Kling 2.6, de 2025/12/3, trouxe sincronização de áudio; Kling 3.0, de 2026/2/4, trouxe 4K60fps e multishot. Ele é citado nominalmente como destino de migração após o fim do Sora2.
  • A estrela atual da edição de imagens aberta é Qwen-Image-Edit: Tutoriais ligados ao ComfyUI são frequentes, inclusive em formato de série por vários canais, e têm mais presença que novos tutoriais apenas de Stable Diffusion. Resultados sobre Stable Diffusion ficaram principalmente em guias clássicos de instalação e listas de modelos, com pouca novidade.
  • A geração de vídeo aberta começa a se organizar em três linhas: Wan 2.2, da Alibaba sob Apache 2.0; HunyuanVideo 1.5, da Tencent; e LTX-2, da Lightricks, lançado em 2026/1/6, o primeiro modelo aberto com geração simultânea de áudio e vídeo, compatível com 4K/50fps. Durante a busca, foram encontradas várias páginas afirmando que pesos abertos de Wan 2.7 haviam sido lançados, mas não há esse modelo no HuggingFace/GitHub oficial do Wan-AI; foi considerado conteúdo falso voltado a SEO. O peso aberto mais recente oficialmente é Wan 2.2.
  • Há cruzamento entre públicos de canais: O canal "StableDiffusion等 チュートリアル&自作アニメ", antes focado em tutoriais de Stable Diffusion, também passou a cobrir o fim do Sora2, de código fechado. Isso sugere que o público está se interessando pelos dois lados.
Limites
  • Tanto youtube.com/results quanto youtube.com/watch são renderizados no cliente por JavaScript. Via WebFetch, devolviam apenas links de navegação do rodapé, sem permitir leitura direta de título, canal, visualizações ou data de publicação. Assim, a descoberta dos vídeos depende da combinação de snippets de WebSearch e da API YouTube oEmbed, que retorna apenas título e nome do canal.
  • Por essa limitação, não foi possível obter com precisão as visualizações e datas de publicação da maior parte dos vídeos. Para evitar inventar dados, o relatório não registra contagens de visualização. As datas de publicação são apenas estimativas a partir de snippets de busca e de datas públicas de lançamento dos modelos.
  • Apesar da instrução do playbook de priorizar vídeos publicados nos últimos 60 dias, não foi possível filtrar rigorosamente. Um único vídeo, a comparação VEO3.1 × SORA2, parece ter sido publicado perto do lançamento do Sora 2, por volta de outubro de 2025, fora da janela de 60 dias, e foi incluído como contexto da notícia de encerramento.
  • O critério de conclusão de brief.md, aproximadamente 20 posts analisados por rede social, difere do critério do playbook do YouTube, de 5 a 12 vídeos. Esta etapa foi considerada concluída segundo o critério do playbook.
  • O conteúdo dos comentários foi verificável apenas na medida em que aparecia em snippets de WebSearch; não foi feita leitura detalhada nem análise de sentimento dos comentários principais.
  • Canais em chinês não entraram na busca. Qwen, da Alibaba, e Kling, da Kuaishou, são modelos chineses, portanto reações de comunidades de língua chinesa não foram refletidas neste relatório.

Bluesky

Bluesky — Notícias de IA para Geração de Imagens e Vídeos

Contas

A API pública do Bluesky (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts) foi consultada com "Stable Diffusion", "Sora 2", "Midjourney", "Grok Imagine", "ComfyUI", "Veo 3" e "Nano Banana". Das contas encontradas, foram extraídas aquelas que realmente mencionavam IA para geração de imagens ou vídeos.

Conta Perfil Relação com o tema
@xai-bot.bsky.social Bot oficial da xAI Anuncia informações de novos modelos do Grok Imagine, de código fechado
@codename.cc Bot de acompanhamento de atualizações de apps Registra atualização do recurso Imagine no app iOS do Grok
@drewkav.bsky.social Artista individual Compartilha criação com Gemini 3.1 Nano Banana 2 e Kling 3.0
@triflingtree.bsky.social Artista individual Publica obras criadas com Nano Banana Pro
@gentile-of-hope.bsky.social(希望の異邦人) Pessoa individual, crítica de IA generativa Críticas éticas e ambientais a IA de imagens em geral, como Stable Diffusion/ChatGPT/Gemini
@samperson.bsky.social Pessoa individual, lado dos artistas Amplifica apoio à política anti-IA generativa do Procreate
@ecutruin.bsky.social Pessoa que pratica geração local Comenta a superioridade funcional de ferramentas locais como ComfyUI
@digitalhowl.bsky.social(Fenris) Criador de vídeo individual Compartilha produção profissional com ComfyUI + Minimax H3
@kerzefasta.bsky.social Ilustrador de fanart Publica continuamente personagens de Kantai Collection com Stable Diffusion WebUI reForge (ROCm); maior número de curtidas nesta busca
@aichina.news Bot automatizado Publica em massa LoRAs baseados em FLUX sob Apache-2.0; quase sem engajamento

No geral, quem posta de fato sobre esse tema no Bluesky não são veículos de notícias, mas dois polos: pessoas que usam as ferramentas, principalmente criadores individuais, e pessoas críticas à IA generativa. Não foram encontradas contas especializadas em notícias nem comunidades específicas, como no X e no Reddit.

Posts
  • @xai-bot.bsky.social (2026-09-05 · 0 curtidas) https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — "Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...". Anúncio oficial da xAI do novo agente de vídeo Grok Imagine, de código fechado, mas com zero curtidas e zero reposts no escopo da busca.

  • @codename.cc (2026-09-06 · 0 curtidas) https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — "SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.". Registro de atualização feito por uma conta individual que acompanha mudanças no aplicativo.

  • @drewkav.bsky.social (2026-09-06 · 9 curtidas) https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — Obra intitulada "Persistent Dream", especificando que a imagem estática foi feita no Gemini 3.1 Nano Banana 2 e o vídeo, no Kling 3.0. É um exemplo de fluxo de trabalho que combina duas ferramentas de código fechado, Google × Kling.

  • @triflingtree.bsky.social (2026-09-06 · 15 curtidas · 1 repost) https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — Post de uma "ícone de mãe e filho alienígenas" em estilo bizantino, gerada com Nano Banana Pro. Foi o post com mais curtidas entre os relacionados a Nano Banana nesta coleta.

  • coah80.com (2026-09-06 · 0 curtidas) https://bsky.app/profile/coah80.com/post/3muulvyomz72c — "SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD". Crítica dura ao Sora 2, de código fechado, coerente com o clima negativo e com o fim de Web/app em 2026/4/26 e da API em 2026/9/24, observados no YouTube.

  • @gentile-of-hope.bsky.social (2026-09-05 · 100 curtidas · 42 reposts) https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — "Não apenas Stable Diffusion: recursos de geração de imagens por IA como ChatGPT e Gemini se baseiam em apropriação de dados antiética e em grande escala. (...) A geração de imagens consome enormes quantidades de eletricidade e água e destrói o meio ambiente." Foi o post com mais curtidas entre os resultados coletados, mostrando que a crítica à IA generativa, independentemente de ser aberta ou fechada, obtém o maior engajamento.

  • @samperson.bsky.social (2026-09-05 · 121 curtidas · 11 reposts) https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Amplificação de uma posição favorável à política anti-IA generativa do Procreate, aplicativo de ilustração. Foi o maior número de curtidas de toda a coleta.

  • @ecutruin.bsky.social (2026-09-06 · 1 curtida) https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — "local software like ComfyUI has more features than the majority of hosted solutions". Comentário que avalia positivamente a vantagem funcional de ambientes locais de geração aberta.

  • @digitalhowl.bsky.social (2026-09-06 · 0 curtidas) https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — Afirma usar ComfyUI e Minimax H3 para "professional grade video work". Exemplo de operação híbrida, combinando uma base aberta com um modelo comercial.

  • @kerzefasta.bsky.social (2026-09-05–06 · vários posts, máximo de 29 curtidas e 10 reposts) https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — Publica continuamente ilustrações de personagens de Kantai Collection usando Stable Diffusion WebUI reForge, ROCm e GPU AMD. Não é conteúdo noticioso, mas foi a conta que reuniu engajamento mais contínuo nos resultados de "Stable Diffusion".

  • @aichina.news (2026-09-06 · 0 curtidas, mais de 20 posts semelhantes por hora) https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — "Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers". Bot que publica mecanicamente muitos LoRAs de FLUX para Huawei Ascend/Modelers.cn, apenas anunciando lançamentos sem palavras-chave de uso ou exemplos. Aumenta o volume de resultados de código aberto, mas não produz discussão efetiva.

Sinais
  • Código fechado: Nano Banana, incluindo Gemini 3.1 e Nano Banana Pro, é o nome mais recorrente em criações reais de artistas individuais. Vários posts confirmaram o fluxo dividido: Nano Banana para imagem estática e Kling 3.0 para transformar em vídeo.
  • Código fechado: O novo modelo Grok Imagine — Video 1.5 / Image 2.0 — foi anunciado por uma conta oficial, mas recebeu zero curtidas e reposts. Anúncios no estilo press release ficam invisíveis no Bluesky dentro deste escopo de busca.
  • Código fechado: A única menção ao Sora 2 foi uma crítica severa, "SORA 2 WAS GENUINELY SO BAD"; não foram encontrados posts favoráveis. Isso coincide com a trajetória de encerramento confirmada na etapa do YouTube.
  • Código aberto: Usuários que usam ComfyUI avaliaram concretamente que ferramentas locais têm mais recursos do que serviços hospedados, com tom favorável.
  • Código aberto/ruído: A maior parte dos resultados para palavras-chave abertas como "Stable Diffusion" e "Flux" foi composta por: (1) fanarts de obras como Kantai Collection, (2) posts com links externos para conteúdo NSFW e (3) bots de anúncio automático de LoRA sem resposta, como @aichina.news. Havia pouquíssima discussão com caráter noticioso.
  • O maior eixo de engajamento é a crítica à IA generativa: Os dois posts mais curtidos — 121 e 100 curtidas — criticavam ou rejeitavam IA generativa em geral, enquanto posts sobre uso de ferramentas chegaram no máximo a 15 curtidas. O público do Bluesky parece expressar vozes anti-IA mais fortes do que X e Reddit.
Limites
  • Limites da API: O endpoint public.api.bsky.app retornou 403 em todas as solicitações. A alternativa api.bsky.app funcionou, mas retornava frequentemente 403 por limite de taxa ao enviar várias consultas novas em pouco tempo. Aproximadamente metade dos termos tentados — "Kling AI", "Wan2.2", "HunyuanVideo", "Qwen Image", "Krea" e "Sora shutdown" — não retornou dados sequer uma vez.
  • A interface Web não pôde ser obtida: bsky.app/search é uma SPA renderizada por JavaScript; WebFetch retornou apenas o metatítulo, sem o corpo dos posts. Na prática, a API foi a única fonte de busca.
  • Quantidade insuficiente: Dos cerca de 20 posts exigidos pelo critério de conclusão, foi possível verificar o conteúdo de somente 11. Os resultados continham muito ruído irrelevante — por exemplo, "Sora" encontrava a personagem de Kingdom Hearts e bots agregadores de hashtags —, reduzindo ainda mais o número efetivo de posts relevantes.
  • Limitação das métricas de engajamento: A API pública do Bluesky retorna curtidas, reposts e respostas, mas não fornece visualizações/impressões, como no X. A escala real de audiência é desconhecida.
  • Falha ao obter detalhes dos posts: Ao tentar obter individualmente o texto integral do post de samperson.bsky.social via app.bsky.feed.getPostThread, ocorreu erro 400; foi possível confirmar apenas o snippet retornado na busca, embora o link esteja apresentado.
  • Viés de contas: Os resultados se concentraram em contas específicas, como @kerzefasta.bsky.social para fanarts de Kantai Collection e @aichina.news para anúncios automáticos de LoRA. Eles não representam necessariamente uma ampla variedade de usuários.

Lemmy

Lemmy — Tendências recentes de IA para geração de imagens e vídeos

Comunidades
  • !«メールアドレス» — 5.708 inscritos, 1.386 posts. Principal ponto de concentração de IA aberta para geração de imagens e vídeos — modelos, nós de ComfyUI, LoRAs etc. Quase todos os dias são publicados novos modelos e ferramentas. https://lemmy.dbzer0.com/c/stable_diffusion
  • !«メールアドレス» — 2.361 inscritos, 3.500 posts. Espaço para obras feitas com Stable Diffusion/modelos de pesos abertos; tem menor valor noticioso e é mais próximo de uma galeria. https://lemmy.dbzer0.com/c/stable_diffusion_art
  • !«メールアドレス» — 4,82 mil inscritos, aproximadamente 1,8 mil assinantes locais em lemmy.world. Abrange IA livre/de código aberto em geral, com poucos posts específicos sobre geração de imagens e vídeos. https://lemmy.world/c/fosai
  • !«メールアドレス», !«メールアドレス», !«メールアドレス» — Notícias de empresas de IA de código fechado, como Midjourney, aparecem nessas comunidades. Não são comunidades dedicadas a notícias de IA de imagem, mas comunidades gerais de tecnologia/notícias onde os assuntos surgem esporadicamente.
Posts
Mais próximos de código aberto (principalmente em !«メールアドレス»)
  1. MiniMax-H3_Singularity — Modelo de fusão fine-tuned do modelo de geração de vídeo MiniMax-H3. score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088455 (original: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
  2. Qwen3.8-Flash-Next-NVFP4 — Versão quantizada em NVFP4 do modelo Qwen pela NVIDIA. score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
  3. ComfyUI-AetherScale — Nova extensão para ComfyUI. score 5, 2026-09-05. https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
  4. Viggle-Animate — Modelo de edição de vídeo que substitui um personagem em um vídeo a partir de uma imagem repintada. score 9, o maior score deste conjunto, 2026-09-05. https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
  5. FastH3-Ref2V-Stream-Controller — Controlador ComfyUI para geração contínua de vídeo. score 2, 2026-09-04. https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
  6. ComfyUI-Majoor-OmniCam — Ferramenta de layout e animação de câmera para ComfyUI. score 4, 2026-09-04. https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
  7. H3-World — Apresentado como o "primeiro modelo de mundo interativo baseado em MiniMax-H3". score 3, 2026-09-02. https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
  8. ComfyUI-MiniMaxH3-CLSS — Nó capaz de gerar vídeos de qualquer duração com áudio usando 16 GB de VRAM. score 0, 2026-09-01. https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
  9. Trellis.2 and Pixal3D Now Native in ComfyUI — Os modelos de geração 3D Trellis.2 e Pixal3D passaram a ter integração nativa com ComfyUI. score 4, 2026-09-01. https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
  10. ComfyUI-DLSS5-NR — Suporte experimental no ComfyUI para renderização neural com NVIDIA DLSS 5. score 2, 2026-09-01. https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
  11. LLaDA-Image — Artigo de pesquisa sobre geração de imagens baseada em modelos de difusão, no arXiv. score 3, 2026-09-04. https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
Mais próximos de código fechado
  1. Midjourney pivots from AI image generation to body scanning medical spa — Reportagem de que a Midjourney migraria do negócio de geração de imagens por IA para "Midjourney Medical", um negócio de escaneamento corporal médico por ultrassom. score 58, 2026-06-18, !«メールアドレス». https://lemmy.zip/post/66397234 (artigo original: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
  2. Midjourney AI pivots to Theranos: Ultrasonic CT — Comentário crítico sobre a mesma notícia. score 40, 2026-06-19, !«メールアドレス». https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  3. Midjourney Medical / Midjourney Ultrasonic CT Scanner — Dois posts com link direto à página oficial da Midjourney. scores 3 e 2, 2026-06-18, !«メールアドレス». https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
  4. Midjourney wants Hollywood studios to reveal AI usage details — Artigo sobre a Midjourney pedir a estúdios de Hollywood divulgação detalhada do uso de IA. score 73, 2026-07-05, !«メールアドレス». https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Sinais
  • O interesse por IA para imagens e vídeos no Lemmy está quase todo concentrado no código aberto. O núcleo é !«メールアドレス», que publica praticamente todos os dias entre 3 e 9 ferramentas, centradas no ecossistema de vídeo MiniMax-H3 — LoRAs, nós de ComfyUI, aceleração de VAE, cache de movimento e assim por diante. Versões quantizadas de Qwen e artigos como LLaDA-Image também chegam à mesma comunidade.
  • No código fechado, o único bloco consistente de discussão foi a notícia de junho de 2026 de que a Midjourney teria migrado da geração de imagens para escaneamento médico por ultrassom. A reportagem foi republicada em várias instâncias — lemmy.zip, awful.systems e lemmy.bestiver.se — e provocou debate, com scores de 40 a 73, relativamente altos para o tema. Por outro lado, praticamente não há traços de notícias sobre lançamentos de Sora, Veo, Kling, Runway, Nano Banana ou Flux.2 no Lemmy.
  • Buscas por "Veo 3" e "Kling AI" retornaram zero posts no Lemmy, e a busca combinada por "Runway/Kling/Veo/Gemini image" também não encontrou resultados. Usuários do Lemmy reagem mais às ferramentas que podem usar de fato no ComfyUI — nós, LoRAs e otimizações — do que aos anúncios de novos modelos em si.
Limites
  • O Lemmy tem poucas pessoas e posts, e não há uma comunidade especializada em "notícias" sobre IA de imagens e vídeos. A fonte efetiva foi uma única comunidade, !«メールアドレス», para código aberto, mais artigos esparsos de empresas de código fechado em comunidades gerais de tecnologia.
  • Em vez de cerca de 20 posts analisados, foram reunidos 15: 11 posts de ferramentas abertas e 4 artigos sobre Midjourney de código fechado. Posts sobre os principais lançamentos de 2026 — Sora, Veo, Kling, Runway, Nano Banana e Flux.2 — não foram encontrados nem na busca da API lemmy.world nem na busca da Web. Esse fato é registrado explicitamente.
  • A página da comunidade /c/stablediffusion em lemmy.world retornava HTTP 500 e não pôde ser vista diretamente; a busca pela API serviu como alternativa.

Pinterest

Pinterest — Notícias de IA para Geração de Imagens e Vídeos

Foram revisados os 50 pins em output/pinterest.pins.md / images/pinterest/manifest.json. Não houve categorização por gênero; todos foram coletados com a consulta única "Image and Video Generation AI News".

Temas visuais
  • Estética cibernética em azul-marinho e neon — azul, roxo e rosa — virou template: Linhas de circuito, brilho de partículas e esferas/nós que lembram redes neurais preenchem os fundos da maioria das miniaturas "com cara de IA". [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
  • Repetição do visual de "âncora de notícias de IA": Várias imagens mostram um androide branco ou um rosto humano-máquina dividido ao meio, sentado de terno numa bancada de telejornal. A sensação é de produção em massa com simples troca de marca. [4, 32, 34, 37, 42]
  • Infográficos de comparação e ranking de ferramentas são o formato mais frequente: Listas no formato "Best AI Video Generators" repetem quase sempre Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora e Adobe Firefly. [9, 19, 28, 33, 36, 46]
  • Grades de demonstração que convertem uma mesma imagem/vídeo em vários estilos: A mesma pessoa transformada em blocos de madeira, origami, Lego e flores; fantasias de panda; variações de estilo de carros Tesla. São composições de antes/depois que promovem consistência. [8, 25, 44]
  • Conteúdo sobre medo de deepfake e detecção: Imagens de gatos com carimbo "FAKE", quizzes "Which is AI?", apresentação de ferramentas para detectar imagens/textos gerados por IA e infográficos alertando que "ver não é mais acreditar". [4, 12, 18, 26, 47]
  • Cards de notícias datados no estilo "AI News Roundup": Formato de notícias rápidas reunindo vários tópicos em título e bullets — Google I/O 2026, atendimento de chamadas 911 por IA, stack de IA da Coreia do Norte etc. [21, 29, 31, 35]
  • Transformação em vitrine de arte de IA genérica, fora do tema: Pins promovendo obras sem caráter noticioso, como uma escultura de mármore tocando violoncelo e retratos de pescadores idosos, voltados a divulgar ferramentas. [49, 50]
  • Fundo escuro e texto neon são o padrão; infográficos corporativos em fundo branco — azul corporativo e design plano — são minoria. [3, 10, 27, 33]
Pins notáveis
  • [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Apresentação de produto real promovendo imagem para vídeo com Veo 3 e áudio nativo via Gemini API.
  • [16] Google Unveils Veo 2 — Grade promocional em tom oficial do Google para o Veo 2, com muitos exemplos gerados: cientista ao microscópio, natação e garota em estilo anime.
  • [25] Google announces Veo 3 — Demonstração de um personagem monstro roxo gerado de forma consistente em vários ambientes. A estrutura apresenta três vídeos produzidos a partir de uma imagem original e enfatiza consistência de personagem.
  • [29] Today's AI News: MAY 20, 2026 — Especial Google I/O 2026. Lista Gemini 3.5 Flash, Gemini Omni, Gemini Spark, IA de acessibilidade da Apple e competição em óculos inteligentes Android XR.
  • [35] The Latest AI Developments — Noticiário em três partes: IA atendendo chamadas 911 em Nova Orleans; Meta lançando o modelo de agente offline Muse Glimmer; e o grupo norte-coreano Kimsuky automatizando phishing com sua própria stack de IA.
  • [44] Microsoft Unveils VASA-1 — Apresentação de um modelo que gera vídeos de rostos falantes a partir de uma imagem estática e um clipe de áudio, com sinais de controle opcionais e uma grade de rostos diversos.
  • [48] ShengShu Technology Unveils Vidu S1 — Divulgação do Vidu S1, que se apresenta como modelo avançado para interação de IA em tempo real, com múltiplos rostos de personagens cyberpunk.
  • [8] Demonstração de conversão consistente de estilo, na linha Luma — Grade comparando a mesma pessoa/animal/carro em cinco estilos: blocos de madeira, origami, Lego e flores. É uma demonstração tecnicamente convincente.
  • [46] Future of Video Creation: Best AI Video Generators of 2026 — Ranking recente que inclui versões específicas: Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly e Seedance 1.5 Pro.
  • [20] More than 20% of YouTube is now AI-generated — Pin simples, praticamente só com o título e um número concreto, mas que simboliza o nível de adoção de conteúdo gerado por IA.
Sinais
  • A competição entre gerações de modelos é visível: Veo 2 → 3 → 3.1, Kling AI → 3.0, Runway Gen-3 → Gen 4.5, Pika 2.5 e Seedance 1.5 Pro aparecem com frequência, indicando um ciclo rápido de melhorias em IA de vídeo. [16, 25, 11, 46]
  • "Agentes", tempo real e modo offline são o próximo foco: Ferramentas de pipeline que automatizam da prospecção ao roteiro, geração e edição com um clique ([24]); Vidu S1 voltado à interação em tempo real ([48]); e Meta Muse Glimmer sem necessidade de conexão ([35]) demonstram a mudança de interesse da simples geração para agentes, tempo real e execução no dispositivo.
  • Uso real e uso indevido de IA começam a ser assunto: Adoção em sistemas de emergência ([35]) e uso abusivo por agentes estatais como a Coreia do Norte ([35]) introduzem temas de implementação social e segurança que vão além da geração em si.
  • Exposição oligopolizada de ferramentas comerciais de código fechado: Os rankings repetem Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen e Synthesia. Quase não há menções a modelos de código aberto, como família Stable Diffusion, AnimateDiff, Open-Sora ou fluxos de ComfyUI. "Amuse 3.0" ([50]), que promove execução local em AMD Ryzen AI, é uma das raras exceções.
  • Pouca conexão com fontes primárias: Entre 50 itens, só poucos pins parecem apontar diretamente para blogs corporativos ou artigos técnicos — Veo com tom oficial em [16] e [25], Microsoft VASA-1 em [44]. A maioria são miniaturas de blogs afiliados, artigos SEO ou publicidade de Fiverr, como [45]. O Pinterest funciona mais como local para vender ferramentas do que para acompanhar notícias.
  • A preocupação com deepfake virou conteúdo recorrente: Ferramentas de detecção e quizzes de identificação formam um gênero próprio, e a ansiedade sobre confiar no que se vê é consumida mais do que o avanço técnico em si. [4, 12, 18, 26, 47]
Limites
  • Esta etapa apenas leu imagens coletadas previamente por um worker em navegador headless; não foram feitas buscas ou rolagens adicionais no próprio Pinterest, conforme o procedimento do playbook.
  • Como a coleta usou uma única consulta sem divisão por gênero, não houve busca direcionada separando código fechado e código aberto. Como resultado, quase não apareceram pins de código aberto. Isso pode refletir a tendência de postagem do Pinterest, mas não elimina a possibilidade de que uma busca mais específica encontrasse mais itens.
  • Há dois pins sem título, (untitled): o conteúdo de [12] pôde ser identificado essencialmente como "Which is AI?", mas outros itens eram difíceis de interpretar.
  • Não houve acesso aos próprios URLs dos pins, pinterest.com/pin/...; a leitura se baseou apenas em imagem e título. Portanto, não foram verificados texto das páginas de destino, comentários, número de salvamentos ou outras métricas de engajamento.
  • [49], a escultura de mármore tocando violoncelo, é um pin genérico de promoção de arte por IA, pouco relacionado ao tema; não foi tratado como insight noticioso.

Ações recomendadas

  • Para fluxos de trabalho dependentes do Sora2, crie um plano de migração para Kling 3.0 ou Veo 3.1 antes do fim da API, em 2026/9/24.
  • Acompanhe o ComputerUse do GPT-6 Astra como uma ferramenta de automação de pipeline de produção, e não como IA generativa isolada.
  • Para reduzir custos, teste a edição local com Qwen-Image-Edit + ComfyUI antes de pagar por ferramentas de código fechado.
  • Prepare regras de divulgação do uso de IA em conteúdo público para enfrentar riscos de rotulagem de autenticidade e repercussão negativa por falsos timelapses.
  • Teste o fluxo dividido Nano Banana (imagem estática) + Kling 3.0 (transformação em vídeo).
  • Continue observando a mudança da Midjourney do negócio de geração de imagens para equipamentos médicos como possível indicador antecipado de diversificação em outras empresas de código fechado.

Imagens coletadas

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 Criação de imagens e vídeos com IAA plataforma definitiva de IA para geração de imagens e vídeos - The Data ScientistConteúdo de IA e preocupações com redes sociaisConceito de criação de conteúdo com IA, com ícones para geração de texto, imagem, música e vídeo — explore 57 fotos, vetores e vídeosCriação de conteúdo em vídeo com IA: grandes ganhos,...️ IA de imagem para vídeo — anime suas fotos com IAGoogle anuncia vídeo de altíssima qualidade...Acerte em cheio 🎥Por que a geração de vídeo com IA está se tornando essencial para...Veo 3 de imagem para vídeo: geração rápida e áudio nativo via Gemini APIimagemimagemInteligência artificial: vamos preservar nossa...Notícias de IA: a OpenAI finalmente lançou o que pedimosGoogle revela Veo 2: ferramenta avançada de geração de vídeo por IA com maior realismo e recursos cinematográficosPaul Lafargue, do IDEC Group: o impacto de...Como detectar gratuitamente imagens geradas por IA onlineIA para geração de imagens e vídeosMais de 20% do YouTube agora é gerado por IAGPT 5.2, editor de vídeo em tempo real, vídeos estéreo com IA, agentes móveis de IA, controle corporal total: NOTÍCIAS DE IAPrincipais geradores de vídeo por IA de 2025Inteligência artificial: uma ferramenta para libertar...Criar vídeos com IA ficou insano.Google anuncia a IA de geração de vídeo "Veo 3",...‎🚨 A IA está ficando assustadoramente boa.Como a IA está transformando a edição de vídeoMais de 5 melhores sites de geração de vídeo por IA em 2026 | Runway, Pika, Kling AI, Canva e maisimagemAnálise de imagens e vídeos orientada por IAO guia definitivo para explorar o Chat GPT como...TotalYmage revoluciona vídeos interativos...ferramentas de IADescubra como o Grok está revolucionando o vídeo...Os desenvolvimentos mais recentes em IA — IA atende linha 911, modelo offline da Meta12 melhores geradores de vídeo por IA em 2026, gratuitos e pagos | Google Veo, Sora, Runway e maisO sarcástico resumo de notícias de IA nº 12O que é IA generativa? Guia técnico completo — Guia RCNO que é Imagvio AI e como ajuda criadores..."Transforme sua visão em vídeos 4K impressionantes com IA personalizada 🎥✨"Vídeos gerados por IA: bons ou ruins? Aqui está a verdade! 🤖🎥O sarcástico resumo de notícias de IA nº 8Dominando vídeo e IA: principais tendências de marketing em redes sociais de 2025Microsoft revela VASA-1, estabelecendo novos padrões para IA generativa em geração de vídeoVou criar um vídeo explicativo com Synthesia, Sora AI, Kling AI, Runway AI e InVideoFuturo da criação de vídeo: melhores geradores de vídeo por IA de 2026🔸Recursos online práticos para verificar textos gerados por IAShengShu Technology revela Vidu S1, trazendo geração interativa em tempo real para vídeo por IATransforme suas ideias em visuais impressionantes! 🎥"Amuse 3.0", uma ferramenta de criação de arte por IA que inclui...

Nota sobre qualidade dos dados

As seis plataformas ficaram abaixo do critério de conclusão de brief.md, de aproximadamente 20 itens por rede social. Em especial, o X teve apenas 4 itens relevantes entre 40 posts; o Bluesky, cerca de 11 itens devido a limites 403 de taxa; e o Lemmy, 15 itens por não haver uma comunidade especializada em notícias. Ainda assim, as principais tendências — GPT-6 Astra, fim do Sora2 e expansão do ecossistema ComfyUI — foram corroboradas de forma independente em várias plataformas.

Galeria