KEN’S CAT LOG

Notícias de IA para geração de imagens e vídeos — 2026-09-12

O campo open source, especialmente os modelos chineses Z-Image, Qwen-Image e MiniMax-H3, aproxima-se dos modelos fechados em avaliações cegas. Enquanto isso, o Google avança em todas as frentes com Nano Banana, Veo e Gemini Omni, e o Sora da OpenAI mostra sinais de desaceleração após a remoção de modelos da página de preços e a saída de seu responsável.

Notícias de IA para geração de imagens e vídeos — 2026-09-12

Olá! Desta vez fiz uma investigação séria sobre o universo de IA para geração de imagens e vídeos em seis plataformas: Reddit, X, YouTube, Bluesky, Lemmy e Pinterest 🔥 Em resumo, no lado fechado o Google está avançando com força total tanto em imagens quanto em vídeo, enquanto o Sora da OpenAI parece estar perdendo ritmo 😳. No open source, os grupos chineses (Qwen, Z-Image, MiniMax e Wan) estão chegando muito perto em avaliações cegas, e o cenário está muito quente 🔥🔥

A pesquisa no X, porém, foi um fracasso completo: não apareceu uma única publicação sobre IA de geração de imagens ou vídeos. Isso é uma lacuna real e será tratado com transparência 💦 Em todas as plataformas, também houve muito debate sobre autenticidade, confiabilidade e a pergunta “isso é IA?”, que surpreendentemente teve mais alcance do que notícias sobre desempenho de modelos 👀

Em todas as plataformas

  • O protagonismo open source é claramente chinês 🇨🇳: YouTube, Bluesky e Lemmy destacam independentemente Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) e Alibaba Wan como os “novos campeões”. No ranking cego do Bluesky, o Qwen-Image-3.0-Pro ficou apenas 92 pontos Elo atrás do GPT Image 2 (high), o que é impressionante (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
  • O Google está atacando em imagem e vídeo ao mesmo tempo: há análises do Veo 3.1 no YouTube (https://www.youtube.com/watch?v=sTOFXi2eY_k), uma apresentação do Nano Banana 2 pela Teacher's Tech (https://www.youtube.com/watch?v=nikIxHM_AQY) e relatos no Bluesky de um aplicativo de desktop para Windows com “Gemini Omni” (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n). A ofensiva em todas as direções é muito forte 💪
  • Conteúdo do tipo “descubra se é IA” é realmente popular: tópicos de identificação no Reddit (r/isthisAI) (https://www.reddit.com/r/isthisAI/comments/1wbspxo/) e infográficos do Pinterest sobre deepfakes e detecção de voz por IA ganharam destaque independentemente. A ansiedade sobre autenticidade se tornou um tema transversal.
  • Promessas como “ilimitado” e “afiliado” são recebidas com desconfiança: um comentário no Reddit afirma que sites que prometem “unlimited” costumam ser quase golpes, enquanto o circuito de spam do WAN 3.0 no Bluesky publica a mesma mensagem afiliada mais de 15 vezes por dia. Usuários estão céticos com esse tipo de marketing 😤
  • Usuários comuns não distinguem muito entre aberto e fechado: em tópicos de recomendações no Reddit, Qwen, Flux, Seedream, Veo e GPT Image aparecem lado a lado como modelos utilizáveis. Há uma diferença considerável entre essa percepção prática e a divisão open source/closed source proposta pelo briefing.

Plataforma por plataforma

Reddit — Foram reunidos 12 tópicos, abaixo da meta aproximada de 20. O post com maior alcance não falava de um modelo novo, mas da possibilidade de usar GPT-6 para controlar mouse e teclado e produzir falsos timelapses de desenho manual (r/antiai, 7.146 pontos, https://www.reddit.com/r/antiai/comments/1w81kdd/). O tema provocou indignação por representar uma forma de engano por IA. Vários tópicos também mencionaram plataformas integradas e sem censura/NSFW, como WildOwl.ai, cyberbara e Tensor.art, sugerindo demanda por esse tipo de serviço.

X — Fracasso total 😭 As 40 publicações coletadas tratavam de Iêmen, memecoin $SONG, Chelsea FC e outros temas. Não houve nenhuma publicação relacionada a IA de geração de imagens ou vídeos. Os termos pesquisados, baseados em tendências, não correspondiam ao tema; na próxima rodada, será necessário buscar nomes específicos como Midjourney, Sora e Runway.

YouTube — Foi a plataforma com mais informação ✨ No lado fechado, GPT Image 2/2.5 lidera a Artificial Analysis Image Arena com Elo de 1.339 e a maior diferença histórica entre primeiro e segundo lugar (https://www.youtube.com/watch?v=DY6TkI8XtkQ). Veo 3.1 melhorou a sincronia labial, e ByteDance Seedream 5.0 Pro foi avaliado como superior a modelos existentes (https://www.youtube.com/watch?v=WpcxwSNT3X4). No open source, FLUX.2 foi apontado como possível novo campeão (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo foi chamado de rei dos modelos locais (https://www.youtube.com/watch?v=K0FgDU-9uik), e Lightricks LTX-2 foi descrito como o “Santo Graal” do vídeo open source.

Bluesky — O Sora talvez esteja desacelerando de forma preocupante 👀 Além de um post que detectou a remoção silenciosa de sora-2 e sora-2-pro da página de preços (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), houve uma reportagem de que o ex-responsável pelo Sora, Bill Peebles, criou uma startup independente com grandes nomes de Hollywood (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). No open source, Qwen, Z-Image, MiniMax, WAN 3.0 e SenseNova-U1.5 dominaram a conversa.

Lemmy — A escala é pequena e a curadoria depende praticamente de uma única pessoa, Even_Adder 😅 Ainda assim, a maior notícia do lado fechado foi surpreendente: a Midjourney teria mudado seu foco da geração de imagens para um negócio de spa médico com tomografia ultrassônica (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429). A iniciativa foi ironizada como um possível “novo Theranos”. No open source, o ecossistema MiniMax-H3 explodiu, com mais de sete ferramentas de ComfyUI e quantização lançadas em uma semana.

Pinterest — Todos os 50 pins foram verificados visualmente 👀 Ferramentas comerciais fechadas, como Runway, Pika, Kling AI, Luma, Canva, Hailuo e Synthesia, aparecem repetidamente em infográficos de ranking. Quase não há pins open source. Há notícias reais, como materiais promocionais de Google Veo 2/3 e um acordo de direitos autorais entre ByteDance e Hollywood/MPA, mas a maior parte é composta por miniaturas produzidas para SEO e afiliados. Um pin afirmava que mais de 20% do YouTube já é gerado por IA.

O que acompanhar

Recomendações

  • Na próxima pesquisa no X, usar nomes próprios como Midjourney, Sora, Runway, Kling, Flux e ComfyUI, em vez de palavras em tendência.
  • Acompanhar continuamente contas do Bluesky que monitoram a página de preços da OpenAI para confirmar a situação do Sora.
  • Observar a evolução da diferença de Elo entre Qwen-Image-3.0-Pro e GPT Image 2 como o indicador mais claro da distância entre aberto e fechado.
  • Tratar a mudança da Midjourney para a área médica como notícia de estratégia empresarial, não apenas de tecnologia.
  • Ampliar os termos de busca do Reddit para alcançar a meta de 20 tópicos.
  • Não confiar isoladamente em infográficos de ranking do Pinterest ou postagens afiliadas repetidas no Bluesky; só usá-los quando houver confirmação em outras plataformas.

Qualidade dos dados

No X, a escolha inadequada de termos de pesquisa resultou em zero publicações sobre IA de geração de imagens e vídeos; portanto, não há dados substanciais sobre o tema. O Reddit reuniu apenas 12 tópicos, abaixo da meta de aproximadamente 20, e seu conteúdo tende mais a consultas sobre ferramentas do que a notícias. O Pinterest não classificava originalmente o material entre open source e fechado, exigindo reclassificação manual. O Lemmy é uma plataforma pequena, dependente na prática da curadoria de uma conta, Even_Adder. No YouTube, páginas renderizadas em JavaScript impediram a coleta do conteúdo principal por WebFetch; visualizações e inscritos também não puderam ser obtidos via oEmbed. No Bluesky, algumas palavras-chave, como Runway, Kling e Black Forest Labs, retornaram 403 de forma persistente, e os resultados sobre WAN 3.0 estavam saturados por contas de spam.

Resumo por plataforma

Reddit

Reddit — Notícias de IA para geração de imagens e vídeos

Onde

Os 12 tópicos coletados vieram dos nove subreddits abaixo.

Subreddit Número de membros Tópicos coletados
r/isthisAI 408.823 1
r/antiai 322.973 1
r/GetNoted 298.488 1
r/generativeAI 152.415 3
r/aiwars 167.809 1
r/hatethissmug 134.660 1
r/aivideomaking 6.823 2
r/GoogleFlow 1.884 1
r/AItips101 1.299 1

Houve forte participação de grandes subreddits que discutem a própria legitimidade da IA generativa, como r/antiai, r/aiwars, r/isthisAI e r/GetNoted. Já comunidades médias voltadas a ferramentas e recomendações, como r/generativeAI e r/aivideomaking, transmitiram melhor os movimentos reais de uso.

O que as pessoas dizem
  • 【#6, r/antiai, 7.146 pontos / 1.025 comentários, 2026-09-05】Post sobre dar a um LLM, identificado como GPT-6, controle de mouse e teclado para fazê-lo “desenhar à mão” em uma tela digital e até falsificar um timelapse. O comentário principal, de u/Nayutantantan (2.511 pontos), expressa revolta: já não sente vontade de gravar timelapses do próprio trabalho porque os falsos se tornaram comuns. Foi, de longe, o tópico com maior reação da coleta. https://www.reddit.com/r/antiai/comments/1w81kdd/
  • 【#11, r/GetNoted, 4.470 pontos / 325 comentários, 2026-09-10】Um post no X que usava uma imagem gerada por IA, com texto deformado como “Handloags” em uma imagem de cronograma, virou alvo de piadas. Os comentários principais ridicularizam a baixa qualidade da imagem gerada. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
  • 【#1, r/AItips101, 145 pontos / 83 comentários, 2026-09-07】“Ranking 2026 de geração de imagens por IA sem censura”. WildOwl.ai ficou em primeiro e foi apresentado como uma plataforma de pagamento por uso com acesso a mais de 35 modelos, incluindo Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image, sem mensalidade e com créditos sem validade. Um comentário aprovou a proposta por evitar desperdício de créditos bloqueados por filtros; outro recomendou Perchance/Uncensored.ai. https://www.reddit.com/r/AItips101/comments/1w9yftp/
  • 【#8, r/aivideomaking, 4 pontos / 21 comentários, 2026-09-09】Em resposta a um pedido por ferramentas gratuitas ou baseadas em créditos para imagens e vídeos fotorrealistas, foram citados OpenartAI, fal, dzine, pixverse, Higgsfield e RunningHub. Um usuário comentou que o Seedance 2.5 da cyberbara seria sem censura e aceitaria rostos reais. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
  • 【#3, r/generativeAI, 0 pontos / 7 comentários, 2026-09-11】Tópico procurando uma ferramenta de geração de imagens e vídeos NSFW que funcione inteiramente no navegador. Um usuário organizou recomendações para RunDiffusion/Tensor.art, PornGen/PornJourney e espelhos do Pika Labs; outro recomendou o aplicativo exclusivo para iPhone PixelForge como local e sem censura. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
  • 【#4, r/generativeAI, 1 ponto / 11 comentários, 2026-09-07】Ao perguntar pelo serviço ilimitado mais barato de imagem para vídeo em 1080p, Artlist.io (€550/ano) foi citado. Mas vários comentários criticaram a promessa de “ilimitado”; um deles afirmou que serviços assim são frequentemente quase golpes e que, após pagar US$ 550, recebeu apenas cerca de US$ 200 em uso e teve de esperar 24 horas. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
  • 【#5, r/aivideomaking, 16 pontos / 38 comentários, 2026-09-07】Para a pergunta sobre gerar gratuitamente um vídeo de 45 segundos apenas com celular/iPad, um usuário respondeu que isso é praticamente uma demanda de datacenter: gratuitamente, no máximo seriam possíveis um ou dois clipes de cinco segundos com marca-d’água, que precisariam ser unidos. Outro ironizou que quem resolvesse isso de uma vez dominaria o mundo. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
  • 【#7, r/GoogleFlow, 6 pontos / 2 comentários, 2026-09-10】Lançamento da extensão Chrome AutoFlow para Google Flow/Veo. Ela oferece geração em lote, continuação a partir do último quadro do clipe anterior e edição automática de vídeos narrados com áudio e legendas, com versão gratuita e assinaturas Pro/Ultra. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
  • 【#12, r/aiwars, 0 pontos / 14 comentários, 2026-09-08】Discussão sobre riscos de direito de imagem e uso publicitário quando uma pessoa gerada por IA se parece por acaso com alguém real. Um comentário observou que o caso mais difícil é coincidir com o rosto de uma pessoa anônima; empresas podem apenas verificar por busca reversa de imagem e torcer. https://www.reddit.com/r/aiwars/comments/1wafe86/
  • 【#10, r/hatethissmug, 59 pontos / 20 comentários, 2026-09-12】Debate interno entre críticos de IA sobre um vídeo que critica IA enquanto a utiliza. Um usuário afirmou ser anti-IA, mas considerou exageradas as discussões sobre impacto ambiental e irrealista a ideia de que a IA “desaparecerá sozinha”. https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
  • 【#2, r/isthisAI, 0 pontos / 31 comentários, 2026-09-09】Tópico tentando determinar se um vídeo era IA ou gravação real. O desaparecimento e reaparecimento de um colar foi considerado decisivo; outro usuário observou que o vídeo ter exatamente 15 segundos também parece um limite típico dos vídeos de IA atuais. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Sinais
  • Em crescimento: menções a plataformas integradas sem censura/NSFW, como WildOwl.ai, cyberbara, RunDiffusion, Tensor.art e PixelForge, aparecem independentemente em vários tópicos. Há forte demanda simultânea por acesso aos modelos mais recentes e menor censura.
  • Em crescimento: ferramentas de automação complementares a produtos oficiais, como o AutoFlow para Google Flow.
  • Malvisto: assinaturas que prometem “ilimitado”, como Artlist.io, são recebidas com desconfiança consistente pela comunidade.
  • Malvisto: mesmo entre críticos de IA, argumentos que enfatizam o impacto ambiental recebem críticas internas por possível exagero; o discurso anti-IA não é homogêneo.
  • Surpresa: os tópicos de maior engajamento não foram lançamentos de modelos, mas a denúncia sobre falsificação de timelapses desenhados por IA (#6, 7.146 pontos) e a piada viral causada por uma imagem de IA (#11, 4.470 pontos). No Reddit, temas de engano e confiabilidade se espalham muito mais do que notícias de produto.
  • Surpresa: a distinção entre open source e fechado não é o centro do interesse dos usuários. Modelos como Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo e GPT Image são tratados como uma mesma lista de opções utilizáveis.
Limites
  • Foi usada apenas uma consulta, “Image and Video Generation AI News”, e só foram coletados 12 tópicos, abaixo dos cerca de 20 esperados pelo critério de conclusão.
  • A coleta consistia em ler material previamente reunido por um worker em navegador headless; não foi possível pesquisar ou navegar adicionalmente no Reddit, pois a plataforma rejeita páginas via WebFetch e busca.
  • Muitos posts são perguntas e respostas sobre recomendações de ferramentas, não notícias especializadas sobre open source e modelos fechados.
  • r/AItips101 (1.299 membros) e r/GoogleFlow (1.884 membros) são subreddits muito pequenos; seus sinais representam vozes individuais, não a comunidade como um todo.

X

X — Tendências em notícias de IA para geração de imagens e vídeos

Contas

As 40 publicações coletadas vieram de 40 contas distintas, uma publicação por conta, sem autores recorrentes. Nenhuma delas se especializa em IA de imagens ou vídeos, como Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI ou Flux. Os resultados formaram grupos por termos de tendência:

  • Yemen/Saudi (Oriente Médio e OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX.
  • $SONG (memecoin ligada a Cardano): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej.
  • Charlie Kirk (aniversário de um ano): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr.
  • Britain (política britânica): @brigantia__, @Steven41849941, @SirJBritain, @BROKENBRITAIN0.
  • Anthropic (economia e segurança de IA): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84.
  • Apple/Samsung (disputa de smartphones): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill.
  • Sony (indústria de games): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ.
  • “one ai os” (autopromoção de startups): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt.
  • Chelsea (futebol): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe.

Não há autores recorrentes suficientes para comparar quem viralizou com uma publicação ou quem acumulou várias pequenas publicações. @rokkstarrrrrrr (9.404 curtidas), @TheHateCentra (19.654) e @Cris_Uther (17.095) tiveram os melhores desempenhos isolados, mas todos fora do tema.

Publicações

Não houve nenhuma publicação que mencionasse diretamente IA de geração de imagens ou vídeos. As mais próximas, embora ainda fora do escopo, foram:

  1. #21 @restitutorII — 458 curtidas, 69 repostagens, 41 respostas, cerca de 57.000 visualizações, 2026-09-10
    https://x.com/restitutorII/status/2097918742571139093

    “Anthropic em seu relatório imagina três futuros possíveis para a economia americana em 2030, com base no poder e na adoção de IA...”
    → Cenários econômicos da Anthropic; trata de IA em geral, não de geração de imagens ou vídeo.

  2. #24 @claudecode84 — 2.585 curtidas, 268 repostagens, 24 respostas, cerca de 741.000 visualizações, 2026-09-10
    https://x.com/claudecode84/status/2097959830942367747

    “O próprio principal responsável pela Anthropic está tornando todo o seu ambiente Claude Code open source.”
    → Trata de Claude Code, uma IA de programação, não de modelos de imagem ou vídeo.

  3. #33 @de1lymoon — 49 curtidas, 6 repostagens, 9 respostas, cerca de 3.500 visualizações, 2026-09-11
    https://x.com/de1lymoon/status/2098428267158032841

    “Grok Bot + Kimi K3 é onde um agente de IA começa a se transformar em um sistema operacional...”
    → Discussão sobre orquestração de agentes de IA, sem relação com geração de imagens e vídeo.

  4. #22 @BrianRoemmele — 792 curtidas, 187 repostagens, 105 respostas, cerca de 100.000 visualizações, 2026-09-10
    https://x.com/BrianRoemmele/status/2098024115231924568
    → Post de meme crítico à Anthropic e à ameaça da IA, sem geração de imagens ou vídeo.

  5. #23 @walterkirn — 723 curtidas, 91 repostagens, 39 respostas, cerca de 28.000 visualizações, 2026-09-10
    https://x.com/walterkirn/status/2098059171325427949
    → Contexto semelhante de crítica à Anthropic e à mídia, sem menção a IA de imagens ou vídeos.

Sinais
  • Os dez principais termos do Explore do X, aparentemente com base na Croácia, eram “Yemen”, “Saudi”, “$SONG”, “Charlie Kirk”, “Britain”, “Anthropic”, “Apple”, “Sony”, “one ai os” e “Chelsea”. Nenhum era relacionado a Midjourney, Sora, Stable Diffusion, Runway, Kling, Veo ou ferramentas similares.
  • Anthropic e “one ai os” indicam atividade em torno de agentes de IA, LLMs e seu impacto econômico, mas isso é uma conversa distinta do tema desta pesquisa.
  • Entre as 40 publicações, não houve menção a ferramentas, lançamentos, demos ou comparações de IA para geração de imagens ou vídeos.
Limites
  • Os termos usados foram tendências diárias do Explore do X, não nomes de ferramentas ou empresas de IA para imagem/vídeo. Por isso, não houve dados utilizáveis para o tema.
  • Não foi possível produzir observações sobre dez itens open source e dez fechados a partir do X; a coleta efetivamente não foi realizada com consultas alinhadas ao tema.
  • A próxima execução deve usar termos como Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux e ComfyUI.

YouTube

YouTube — Notícias de IA para geração de imagens e vídeos (fechado/open source)

Canais
  • There's An AI For That — canal de apresentação de ferramentas de IA; publicou uma análise de FLUX.2.
  • AI Search — canal de notícias rápidas sobre novos modelos; publicou vídeos sobre Sora 2 e HunyuanVideo 1.5.
  • Theoretically Media — canal especializado em geração de vídeo por IA; análise detalhada do Veo 3.1.
  • Teacher's Tech — canal de ferramentas práticas; análise do Nano Banana 2.
  • Codebreakers — análises e explicações de modelos open source; especial sobre MiniMax H3.
  • Bijan Bowen — canal avançado de IA local para imagens; testes do Z-Image Turbo.
  • Benji's AI Playground — tutoriais de ComfyUI e geração local; explicação sobre Ideogram 4.0.
  • Curious Refuge — canal estabelecido de educação em produção audiovisual com IA; análise do Midjourney V8.
  • RandomAI — notícias e comparações de novos modelos; explicação sobre GPT Image 2.5.
  • Standarity / The AI Filmmaking Advantage — notícias rápidas e testes comparativos; cobertura e testes completos de Seedream 5.0 Pro.
  • MattVidPro AI — menção em vídeo de primeiras impressões sobre Runway Gen-4.
Vídeos
  1. “Is FLUX 2.0 The New Open Source King?” — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Examina se o FLUX.2, da Black Forest Labs, pode se tornar o novo rei open source de geração de imagens.
  2. “We have a new #1 open-source AI video generator!” (2025-11-25) — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Análise e instalação de HunyuanVideo 1.5 no ComfyUI, apresentado como viável mesmo com pouca VRAM.
  3. “Sora 2… wtf” — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Compara OpenAI Sora 2 com Veo 3, Kling 2.5 e Hailuo 02, destacando melhorias em sincronização de áudio e física.
  4. “Veo 3.1 Is More Powerful Than You Realize!” (2025-10-16) — Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Explica melhorias em sincronia labial, consistência de personagens e upscaling para 1080p no Google Veo 3.1.
  5. “The New Gemini Image Generator is Insane (Nano Banana 2)” — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Apresenta a substituição do padrão do app Gemini pelo Nano Banana 2.
  6. “MiniMax H3: The New Open-Source Video Champ?” (2026-08-03) — Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Mostra que o modelo de vídeo open-weight multimodal MiniMax H3 (Hailuo 3.0) pode gerar vídeo com áudio estéreo nativo em uma única passada.
  7. “Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models” — Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Testa localmente o Z-Image Turbo, sob licença Apache-2.0, e o chama de rei.
  8. “Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right” (2026-06-04) — Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Relata que o primeiro modelo open-weight da Ideogram alcançou o primeiro lugar na Design Arena e melhorou a renderização de texto.
  9. “I Tried Midjourney 8… Here's the Truth” (2026-03-19) — Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Avaliação franca do desempenho do Midjourney V8.
  10. “GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model” — RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Explica GPT Image 2/2.5, com melhorias em renderização de texto e suporte multilíngue.
  11. “ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted” — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Resume o anúncio do Seedream 5.0 Pro, que permite edição por camadas.
  12. “🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)” (2026-07-16) — The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Teste completo que avalia o Seedream 5.0 Pro como superior aos modelos existentes.
Sinais

Movimentos do lado fechado

  • OpenAI GPT Image 2 / 2.5 lidera a Artificial Analysis Image Arena, com Elo 1.339 e a maior diferença entre primeiro e segundo lugar na história da arena, segundo relatos de setembro de 2026.
  • Google Veo 3.1 e Nano Banana Pro (Gemini 3 Pro Image) evoluem simultaneamente em vídeo e imagem, com foco profissional em sincronia labial, upscaling 1080p e edição por camadas.
  • ByteDance Seedance 2.0 e Seedream 5.0 Pro ampliam rapidamente sua presença usando multimodalidade — referências de texto, imagem, vídeo e áudio.
  • Vários vídeos afirmam que xAI Grok Imagine 1.5 supera Veo e Sora em benchmarks, gerando discussão por volta de junho de 2026.
  • Runway Gen-4/4.5 e Midjourney V8 (V8.1, V8.2) seguem recebendo atualizações contínuas, gerando muitas análises de “defesa do trono”.

Movimentos do lado open source

  • Black Forest Labs FLUX.2 é repetidamente descrito como um novo campeão de imagem de alta qualidade executável localmente.
  • Tencent HunyuanVideo 1.5 ganhou suporte nativo ao ComfyUI e se tornou uma nova referência open source para ambientes com pouca VRAM.
  • Z-Image e Z-Image Turbo, da Alibaba/Tongyi-MAI, foram lançados sob Apache-2.0 e receberam o rótulo de novos reis dos modelos locais.
  • Ideogram 4.0 foi lançado como o primeiro modelo open-weight da empresa, alcançando o primeiro lugar na Design Arena e destacando-se pela precisão de texto.
  • MiniMax H3 (Hailuo 3.0) ganhou força em agosto de 2026 como um modelo multimodal open-weight executável em GPUs pessoais, como RTX 3090, com uma onda de vídeos de integração ao ComfyUI.
  • Lightricks LTX-2 entrega geração open source de vídeo 4K a 50 fps com áudio sincronizado e é chamado de “Santo Graal do vídeo open source”.
  • Alibaba Wan 2.5/2.6 continua aparecendo como modelo de vídeo open source que aceita texto, imagem, áudio e vídeo como entrada.
Limites
  • As páginas de resultados e vídeos do YouTube são renderizadas em JavaScript; WebFetch retornou apenas o rodapé. Títulos e canais foram confirmados via API oEmbed.
  • A API oEmbed não fornece visualizações, datas, inscritos ou comentários; por isso, esses dados não puderam ser incluídos. Datas só foram listadas quando apareciam em snippets de busca.
  • “LTX-2: Open Source AI Video, Released to the Community” (zSvCnVi181A) retornou 403 ao acessar o oEmbed.
  • Não foi possível verificar comentários dos vídeos; os resumos se baseiam apenas em títulos e descrições.
  • Informações de busca na web, snippets de artigos e blogs relacionados foram combinadas para reforçar a análise, mas todos os URLs de vídeo foram confirmados como links reais do YouTube.

Bluesky

Bluesky — Notícias de IA para geração de imagens e vídeos (fechado/open source)

Contas
  • theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — bots de notícias conectados a RSS; difundem reportagens sobre OpenAI e Sora em vários idiomas.
  • ctxwindow.kynth.studio (#TechBluesky) — observador que monitora continuamente alterações na página de preços da OpenAI.
  • gen-ai.news — conta individual de notícias rápidas sobre atualizações do Midjourney.
  • oludai.bsky.social — mantém um ranking próprio de avaliações humanas cegas em olud.ai, classificando modelos abertos e fechados a cada hora.
  • aichina.news — conta de perfil automatizado que relata quase diariamente LoRAs da família FLUX sob Apache-2.0 no Modelers.cn da Huawei.
  • circuitai.bsky.social — conta de spam/promoção que publica links afiliados para Alibaba WAN 3.0 no vidhapi.app mais de uma dúzia de vezes por dia.
  • arxiv-cs-cv.bsky.social — publica automaticamente novos artigos do arXiv sobre geração de imagens e vídeo.
  • un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — artistas individuais que publicam obras diárias com Midjourney.
  • rin-yamami.bsky.social / satomin6.alimika.jp — ilustradores de IA de língua japonesa que usam Qwen-Image-Edit e ComfyUI.
Publicações
  1. theinformation.com (2026-09-10, 👍1 🔁0) — Reportagem de que o ex-chefe do Sora na OpenAI, Bill Peebles, está criando uma startup própria de IA para geração de vídeo com Jeffrey Katzenberg, ex-CEO da DreamWorks, e um ex-CFO da Dropbox.
    https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n
  2. ctxwindow.kynth.studio (2026-09-08, 👍0/1 🔁0) — Detectou que a OpenAI removeu silenciosamente sora-2 e sora-2-pro de sua página de preços; preços anteriores: US$ 0,05 a US$ 0,30 para 720p. É um possível indício de redução do Sora.
    https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23
  3. somewhattolerable.com (2026-09-06, 👍2) — Especulação de que a OpenAI encerrou o Sora porque engenheiros internos reclamaram do consumo excessivo de recursos.
    https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223
  4. itmatterss.bsky.social (2026-09-11, 👍1) — Relato de aplicativo de desktop do Gemini para Windows, iniciado com Alt+Space. Declara Nano Banana para imagens e “Gemini Omni” para vídeo.
    https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n
  5. dimnews.bsky.social (2026-09-11, em russo) — SenseTime anunciou o modelo multimodal de 8 bilhões de parâmetros SenseNova-U1.5 e afirma superar Nano-Banana-Pro em raciocínio visual.
    https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25
  6. gen-ai.news (2026-08-30, 👍1) — Relatou que o modelo de edição Midjourney V8.2 foi corrigido silenciosamente após reclamações de perda de qualidade.
    https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s
  7. futureautomationai.bsky.social (2026-09-03, 👍2) — Resumo “Midjourney em 2026”: V8.2, personalização, moodboards, modelo de edição e funções de referência.
    https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d
  8. oludai.bsky.social (2026-09-10/11, 👍1-2) — No ranking de avaliação cega, o melhor modelo disponível para download é Qwen-Image-3.0-Pro (#12), apenas 92 Elo atrás de GPT Image 2 (high).
    https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t
  9. ddigitalmedia.bsky.social (2026-09-10, 👍1) — Avaliação de que Qwen, Z-Image e MiniMax são os únicos capazes de competir com produtos ocidentais de LLM e imagem.
    https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223
  10. circuitai.bsky.social (2026-09-11 a 12, publicações repetidas) — Promove Alibaba WAN 3.0 como alternativa barata e de pagamento por uso ao Seedance 2.5 da ByteDance, com clipes de até 30 segundos. A mesma mensagem afiliada foi postada mais de 15 vezes por dia.
    https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p
  11. minaxlab.bsky.social (2026-09-11) — Anunciou o lançamento do ComfyUI v0.35.1, demonstrando atualização contínua do ambiente local open source.
    https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i
  12. aichina.news (2026-09-08 a 09, sequência de posts) — Relatou a publicação contínua de LoRAs da família FLUX, sob Apache-2.0, no Modelers.cn da Huawei, mas observou que muitos não apresentam palavras-chave de ativação ou benchmarks; portanto, não há evidência suficiente para afirmar que superam Qwen-Image.
    https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24
  13. arxiv-cs-cv.bsky.social (2026-09-11) — Novo artigo sobre avaliar e aprimorar capacidades de raciocínio “Think-with-Video” em modelos de geração de vídeo.
    https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Sinais
  • Sora está efetivamente desacelerando: a remoção de modelos da página de preços, a saída de seu responsável para abrir uma startup concorrente e especulações de que foi encerrado por custo de recursos ocorreram no mesmo período. A geração de vídeo da OpenAI parece defensiva.
  • O Google, ao contrário, está em expansão total: Nano Banana, Nano Banana Pro, Veo e Gemini Omni estão sendo integrados até a um aplicativo de Windows, numa estratégia de inserir IA generativa em todas as superfícies.
  • A liderança open source é chinesa: Qwen-Image-3.0-Pro, Z-Image Turbo, MiniMax, Alibaba WAN 3.0 e SenseTime SenseNova-U1.5 concentram a conversa. Diversas contas sugerem que apenas modelos abertos chineses competem com produtos ocidentais de imagem e vídeo.
  • A distância para modelos fechados está diminuindo: em avaliações cegas contínuas do oludai.bsky.social, Qwen-Image-3.0-Pro chegou a 92 Elo de GPT Image 2 (high).
  • Cuidado com ruído e promoção: grande parte das postagens sobre WAN 3.0 é spam afiliado repetido por circuitai.bsky.social, não interesse orgânico.
  • ComfyUI e LoRA seguem evoluindo: além de atualizações do ComfyUI, há portabilidade de LoRAs FLUX para NPUs Ascend da Huawei, ampliando o ecossistema além de CUDA.
Limites
  • A API pública do Bluesky retornou erros 403 intermitentes, aparentemente ligados a limite de taxa. Muitas consultas só funcionaram após espera e nova tentativa.
  • Termos como Runway Gen, Kling AI, Black Forest Labs e Wan 2.5 tiveram 403 persistente; foram substituídos por consultas alternativas, como “Wan video”. Não há posts diretos sobre Runway e Kling no material.
  • A interface web bsky.app/search é uma SPA renderizada em JavaScript; como o conteúdo não era recuperável por fetch, a análise dependeu inteiramente de JSON da API pública.
  • Termos como Flux e Z-Image produziram muitos resultados irrelevantes, incluindo Aeon Flux, fluxo solar, Pokémon Z-A e sites adultos.
  • A reportagem do The Information e o artigo do arXiv foram verificados apenas por título e resumo, não pelo texto completo, devido a paywall e complexidade técnica.

Lemmy

Lemmy — Notícias de IA para geração de imagens e vídeos

Comunidades
  • !«メールアドレス» — 5.709 inscritos totais, dos quais 893 locais. É o maior hub do tema no Lemmy. Quase todos os posts recentes foram publicados por um único usuário, Even_Adder, que compartilha lançamentos diários no GitHub e Hugging Face.
  • !«メールアドレス» / lemmy.world — comunidades de compartilhamento de arte gerada; são galerias, não fontes de notícias.
  • !«メールアドレス» — comunidade especializada em arte abstrata com SDXL e LoRAs personalizados; teve mais de dez posts em setembro.
  • !ai_reddit@[várias instâncias] — agregador de crossposts do Reddit r/ArtificialInteligence, com pouca discussão original.
  • !«メールアドレス» — notícias gerais de tecnologia; artigos da Midjourney receberam mais de 70 pontos.
  • !hackernews@[várias instâncias] — crossposts do Hacker News, incluindo várias entradas sobre a Midjourney.
  • !techtakes@[várias instâncias] — comunidade com viés crítico a IA; o post “Midjourney pivots to Theranos” recebeu 40 pontos.
  • !llm@[várias instâncias] — comunidade de LLMs; o lançamento do GPT-6 Astra recebeu reação fria, com -3 pontos.
  • !«メールアドレス» — pequena comunidade dedicada à ferramenta de texto e imagem Perchance.

Os números exatos de inscritos não puderam ser confirmados para várias comunidades, pois a API retornou 404 dependendo da instância.

Publicações
Mais próximas de modelos fechados
  1. “Midjourney pivots from AI image generation to body scanning medical spa” — !«メールアドレス», 58 pontos, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Notícia de que a Midjourney mudou da geração de imagens para um negócio de spa médico com tomografia ultrassônica, Midjourney Medical.
  2. “Midjourney AI pivots to Theranos: Ultrasonic CT” — !techtakes, 40 pontos, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Comentário irônico que compara a mudança a um novo Theranos.
  3. Página oficial “Midjourney Medical” — !hackernews, 3 pontos, 2026-06-18. https://www.midjourney.com/medical
  4. “Midjourney wants Hollywood studios to reveal the details of their AI usage” — !«メールアドレス», 73 pontos, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney pediu a estúdios de Hollywood que revelem detalhes do uso de IA.
  5. “Behind the scenes with the Midjourney scanner” (vídeo) — !hackernews, 1 ponto, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
  6. “Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'” — !ai_reddit, 1 ponto, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Relatório de direitos humanos criticando a coleta de dados de grandes sistemas generativos fechados, incluindo geração de imagens.
  7. Lançamento do GPT-6 Astra — !llm, -3 pontos, 2026-09-04. https://openai.com/index/gpt-6-astra/ — O LLM não gera imagens ou vídeo diretamente; usa chamadas de ferramentas via Responses API. O interesse no Lemmy foi baixo.
Mais próximas de open source (todas em !«メールアドレス», por Even_Adder)
  1. Ferramentas do ecossistema de vídeo MiniMax-H3 — Mais de sete lançamentos entre 4 e 10 de setembro, incluindo ComfyUI-MiniMax-H3-W4A4-VSA, MiniMax-H3-Semantic-Bridge, ComfyUI-Ref2VA-VSA, Minimax-h3_Singularity, minimax-h3_fl2v_8Step_motion_enhancer, ComfyUI-VDN-H3, vdn-minimax-h3 e FastH3-Ref2V-Stream-Controller. O ecossistema de quantização, aceleração e pontes semânticas do MiniMax-H3 cresceu rapidamente. Exemplo: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA
  2. “LLaDA-Image: Building Strong Image Generators” — 3 pontos, 2026-09-04. https://arxiv.org/abs/2609.03796 — Artigo sobre um Diffusion Transformer open source de 6 bilhões de parâmetros.
  3. Dois LoRAs para Krea 2 TurboF16/krea2-turbo-sda (2 pontos, 10/09, https://huggingface.co/F16/krea2-turbo-sda) e lvladikov/Krea2-Turbo-Distill-4step-LoRA (2 pontos, 08/09), que promete 45% de melhoria de qualidade por destilação em quatro passos.
  4. “Viggle/Viggle-Animate” — 10 pontos, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Técnica para substituir um personagem em vídeo usando um único quadro redesenhado.
  5. “How a 20-year-old independent builder from Bihar created an open omni AI model” — !ai_reddit, 0 pontos, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — Relato de modelo omni aberto de 5,84 bilhões de parâmetros que teria superado o AFM 3B da Apple no benchmark MATH-500.
Sinais
  • No open source, o principal campo de batalha é o ecossistema em torno dos modelos, não apenas os modelos-base. Em torno do MiniMax-H3, foram lançados mais de dez itens em uma semana, incluindo quantização, aceleração, nós de ComfyUI e LoRAs.
  • A cobertura do tema no Lemmy depende na prática da curadoria de uma pessoa, Even_Adder. O formato se parece mais com uma lista de links do que com discussões; quase não há comentários.
  • O maior assunto fechado não foi uma disputa de desempenho, mas a polêmica mudança da Midjourney para o setor de spa médico. O tom predominante é de crítica empresarial e ironia.
  • Críticas de entidades como a Amnesty International sobre legalidade e coleta de dados também aparecem como tema relevante relacionado a sistemas fechados.
  • GPT-6 Astra não gera imagem ou vídeo diretamente e gerou pouco interesse, com avaliação negativa no Lemmy.
Limites
  • Pesquisas por Sora, Veo, Runway, Kling, Grok Imagine e Nano Banana não encontraram conteúdo relevante; essas conversas praticamente não acontecem no Lemmy.
  • !«メールアドレス» retornou HTTP 503; foi usada a instância dbzer0 como substituta.
  • APIs de inscritos para várias comunidades retornaram 404, impedindo a confirmação de números precisos.
  • Embora 20 posts relacionados tenham sido reunidos, o Lemmy é uma plataforma pequena para esse tema e suas fontes estão concentradas em poucas comunidades e contas. Predominam links e repostagens, não discussões originais.

Pinterest

Pinterest — Notícias de IA para geração de imagens e vídeos

Os 50 pins presentes em output/pinterest.pins.md, coletados por uma única consulta “Image and Video Generation AI News” e sem classificação de gênero, foram todos abertos e verificados visualmente.

Temas visuais
  • Fundos futuristas em azul-neon e roxo predominam. Fundos pretos com padrões de circuitos, logos brilhantes de IA e silhuetas humanas holográficas aparecem repetidamente em infográficos e miniaturas de vídeo [1, 3, 4, 5, 34, 37, 39, 41, 48].
  • Rosto de youtuber homem barbudo + texto grande “AI NEWS” + colagem de logos empresariais é um formato recorrente. Expressões de choque ou suspeita são usadas com logos de Google, OpenAI, Microsoft, Meta e Anthropic [4, 20, 21, 45].
  • Infográficos de ranking do tipo “best AI video tool” são muito comuns. Eles reutilizam o mesmo modelo visual: cartões numerados, logos, listas de recursos e “best for”. Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo e Synthesia são os nomes constantes [7, 8, 13, 24, 40].
  • Formatos de identificação “real vs. IA” se destacam: quizzes de comparação de paisagens, explicações de tendências de deepfake e medidores de detecção de voz por IA [16, 17, 20, 37].
  • Robôs humanoides como símbolo genérico de IA aparecem repetidamente, apesar de não terem relação direta com a tecnologia exibida [2, 34, 37, 39, 48].
  • Uma grade de demonstração de transformação de materiais mostra a mesma pessoa, cão e carro em vídeo convertidos em blocos de madeira, origami, Lego e flores; é uma demonstração específica de capacidade de geração de vídeo [6].
  • Pins promocionais de freelancers também aparecem, oferecendo criação de vídeos de IA no estilo Fiverr, alguns com contatos de WhatsApp ou imagens geradas de Jeff Bezos [15, 32, 42].
  • Notícias reais de produtos são minoria. A maior parte é de infográficos e miniaturas produzidos para SEO/afiliados. Os itens mais concretos envolvem Google Veo 2/3, Microsoft VASA-1, Vidu S1 da ShengShu, modelo de upscaling da Adobe, AMD Amuse 3.0 e acordo de direitos autorais entre ByteDance e MPA [3, 5, 12, 29, 46, 10, 47, 31].
Pins notáveis
  1. #3/#5 — Google anuncia vídeo de qualidade ultra-alta / promoção do Veo 2 — Materiais promocionais oficiais do Google, com exemplos reais de saída do Veo 2, incluindo cachorro nadando, flamingos e uma animação de menina na cozinha.
  2. #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Atualização funcional concreta: imagem para vídeo com Veo 3 e áudio nativo via Gemini API.
  3. #6 — Grade de demonstração de transformação de materiais, em estilo Luma — Comparação que transforma o mesmo vídeo-fonte em blocos de madeira, origami, Lego e flores.
  4. #16 — “Why Is Trump Obama AI Video Trending?” — Infográfico detalhado sobre uma tendência viral de vídeos de IA; cita Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI e DeepBrain AI.
  5. #29 — ShengShu Technology unveils Vidu S1 — Pin sobre modelo chinês que promete geração interativa em tempo real.
  6. #31 — ByteDance and Hollywood reach global deal on AI copyright — Notícia sobre um acordo entre ByteDance e MPA em relação à proteção de direitos autorais em ferramentas de geração de imagem e vídeo.
  7. #44 — “More than 20% of YouTube is now AI-generated” — Um dos poucos pins que apresenta uma estatística específica.
  8. #46 — Microsoft VASA-1 — Demonstração de pesquisa que gera vídeo falante a partir de uma foto e um clipe de áudio.
  9. #47 — “Amuse 3.0” (AMD) — Anúncio de nova versão de ferramenta de geração de imagens por IA.
  10. #37 — Infográfico de detecção de voz por IA (“97% likely AI generated”) — Conteúdo educativo sobre identificação e ética de IA.
Sinais
  • O centro da conversa continua sendo formado por ferramentas comerciais fechadas: Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia e D-ID. Seus logos estão em praticamente todos os rankings. Não foram encontrados pins centrados em ferramentas open source ou auto-hospedadas, como Stable Video Diffusion, fluxos de ComfyUI ou Open-Sora.
  • Google Veo 2/3 é a notícia oficial de produto mais visível, com ênfase em imagem para vídeo e áudio nativo via Gemini API.
  • Entre os modelos chineses, Vidu S1 da ShengShu aparece com o conceito de geração interativa em tempo real.
  • Ansiedade sobre deepfakes e autenticidade — vídeo Trump-Obama, detecção de voz e quizzes “qual é IA?” — é um subtema consistente no Pinterest.
  • Há alguma cobertura de estrutura da indústria e aspectos legais, como a proporção de conteúdo de IA no YouTube e o acordo ByteDance-MPA.
  • Quase não há aprofundamento técnico sobre arquitetura, treinamento ou benchmarks; pela natureza do Pinterest, o conteúdo favorece ferramentas, tutoriais e explicações de fenômenos virais.
Limites
  • A coleta usou somente a consulta "Image and Video Generation AI News" e não separou os resultados por open source, fechado ou outros gêneros. A classificação foi deixada para a etapa de integração.
  • Alguns pins eram pouco relacionados ao tema ou imagens genéricas, como #35 com mapa-múndi, #43 com uma estátua tocando violoncelo e #22 com ícones da Adobe Stock.
  • O Pinterest não exibe data de publicação dos pins; referências a “2025” e “2026” no título são as únicas pistas temporais.
  • Os títulos são textos armazenados em cache pelo Pinterest e podem divergir da data ou dos detalhes da página vinculada. Esta análise se restringe às imagens e títulos verificados.

Ações recomendadas

  • Refazer a pesquisa no X com nomes próprios como Midjourney, Sora, Runway, Kling, Flux e ComfyUI, e não com termos em tendência.
  • Acompanhar a diferença de Elo entre Qwen-Image-3.0-Pro e GPT Image 2 para monitorar a distância entre modelos abertos e fechados.
  • Seguir continuamente a conta do Bluesky que monitora a página de preços para verificar a hipótese de desaceleração do Sora.
  • Ampliar as consultas do Reddit até atingir a meta de 20 resultados.
  • Não tomar como confiáveis, isoladamente, rankings visuais do Pinterest ou sequências de posts afiliados no Bluesky; exigir confirmação em outras plataformas.

Imagens coletadas

🎨 Criação de imagens e vídeos com IAConteúdo de IA e preocupações nas redes sociaisimagemNotícias de IA: vazamento da Anthropic mostra o futuro da IA...Google revela o Veo 2: geração avançada de vídeos com IA...Google anuncia vídeo de qualidade ultra-alta...Acerte em cheio 🎥🎬 10 FERRAMENTAS GRATUITAS DE VÍDEO COM IA EM 2026 🤯 Crie vídeos sem software caro!imagemAdobe desenvolve modelo de IA para ampliar vídeos e transformar gravações borradas em HDImagem para vídeo com IA — anime suas fotos com IAVeo 3: imagem para vídeo rápida e áudio nativo via Gemini APIimagemIA para geração de imagens e vídeos🔥 Criação profissional de conteúdo com IA | Reels, vídeos e imagensPor que o “vídeo de IA Trump Obama” está em tendência?Vídeos gerados por IA: bons ou ruins? Aqui está a verdade! 🤖🎥A aposta ousada de Nova York: por dentro da legislação...Notícias de IA: a OpenAI finalmente lançou o que pedimosimagemGPT 5.2, editor de vídeo em tempo real, vídeos estéreo com IA, agentes móveis de IA e controle corporal completo: NOTÍCIAS DE IAConceito de criação de conteúdo com IA e ícones para geração de texto, imagem, música e vídeoPrincipais geradores de vídeo com IA de 2025Mais de 5 melhores sites de geração de vídeo com IA em 2026 | Runway, Pika, Kling AI, Canva e maisA arma secreta dos criadores de conteúdo: geração de vídeo com IATop 10 ferramentas de sincronização labial (2026) – melhores programas de IA para vídeos realistasAnálise de imagens e vídeos com IAFerramentas de IA para edição de vídeo — o que os criadores realmente usam em 2026ShengShu Technology revela Vidu S1 e traz geração interativa em tempo real para vídeo com IAimagemimagemCriação profissional de vídeos com IA | Vídeos cinematográficos com IA | Edição de vídeo personalizadaO que é Imagvio AI e como ajuda criadores...Descubra como o Grok está revolucionando vídeos...Imagens de atualidades com mapas nacionais e mundiaisComo a IA está transformando a edição de vídeo‎🚨 A IA está ficando assustadoramente boa.Ferramenta secreta de geração de imagens da OpenAI será lançada em breveTotalYmage revoluciona vídeos interativos...Criação de vídeos com IA: guia completo para criar vídeos profissionais mais rápidoO futuro da produção de mídia com IA em...Vou criar vídeo explicativo com Synthesia, Sora, Kling, Runway e InVideoTransforme suas ideias em visuais impressionantes! 🎥Mais de 20% do YouTube agora é gerado por IANotícias de IA: agora todo mundo está irritado com a AnthropicMicrosoft revela VASA-1 e estabelece novos padrões de IA generativa para geração de vídeo“Amuse 3.0”, uma ferramenta de criação de arte com IA que inclui...Inteligência artificial: vamos manter nossa...História da IA generativa“Transforme sua visão com vídeos 4K personalizados com IA 🎥✨”

Nota sobre a qualidade dos dados

No X, a escolha dos termos de busca resultou em zero posts relacionados a IA para geração de imagens e vídeos. O Reddit reuniu apenas 12 itens, abaixo da meta de aproximadamente 20. No YouTube, as limitações de renderização em JavaScript impediram a coleta de visualizações e inscritos. No Bluesky, erros 403 persistentes para algumas palavras-chave levaram ao abandono da coleta desses termos.

Galeria