KEN’S CAT LOG

Notícias diárias sobre LLM — 2026-09-25

A disputa de anúncios entre modelos fechados — com a OpenAI lançando GPT-6 Sol/Luna e reduzindo os preços pela metade apenas 89 minutos após a Anthropic anunciar Claude Opus 5.5 em 22 de setembro — foi o principal assunto do dia, confirmado de forma independente em X, YouTube, Bluesky e Lemmy. A avaliação sobre o avanço dos modelos de pesos abertos, porém, varia bastante entre plataformas.

A disputa de anúncios entre modelos fechados — com a OpenAI lançando GPT-6 Sol/Luna e reduzindo os preços pela metade apenas 89 minutos após a Anthropic anunciar Claude Opus 5.5 em 22 de setembro — foi o principal assunto do dia, confirmado de forma independente em X, YouTube, Bluesky e Lemmy. A avaliação sobre o avanço dos modelos de pesos abertos, porém, varia bastante entre plataformas.

Notícias sobre LLM mais comentadas hoje — 2026-09-25

O maior acontecimento da semana foi a "disputa pelo timing dos anúncios" entre modelos fechados: apenas 89 minutos depois de a Anthropic anunciar o "Claude Opus 5.5" em 22 de setembro, a OpenAI lançou o "GPT-6 Sol/Luna" e cortou os preços pela metade. O caso foi abordado de forma independente em X, YouTube, Bluesky e Lemmy, podendo ser considerado o assunto mais comentado do dia. Já no Reddit, o tema praticamente não apareceu: em vez disso, ganharam força assuntos em outro eixo, como a alta dos preços de GPUs locais e a investigação das autoridades de Pequim sobre DeepSeek/Kimi. As avaliações sobre o ímpeto dos modelos de pesos abertos estão completamente divididas entre plataformas, e não é possível simplesmente afirmar que "os abertos estão vencendo" ou "estão perdendo".

Entre plataformas

Plataforma por plataforma

Reddit: os principais campos de discussão foram r/LocalLLaMA (execução local e hardware) e r/singularity (notícias rápidas sobre novos modelos). A publicação com maior pontuação do dia foi o desabafo sobre a alta dos preços de GPUs locais/hardware especializado (647 pontos, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), seguida por um tópico segundo o qual DeepSeek/Kimi estão sendo investigadas pelas autoridades de Pequim por suspeita de "vazamento de dados para a Anthropic" (311 pontos, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Discussões sociais e culturais, como a normalização da redação com LLMs na academia (r/PhD, 493 pontos), receberam mais atenção do que notícias de produtos. Vale registrar como uma lacuna entre plataformas o fato de que a coleta do Reddit não encontrou menções a Opus 5.5 ou GPT-6 Sol/Luna, os maiores assuntos nas outras plataformas.

X: o Explore (tendências) estava preenchido por temas sem relação com LLMs, como Taylor, Sérvia e Cardano. Os únicos termos de busca que funcionaram para LLMs foram "Opus 5.5" e "Claude". As oito publicações encontradas eram todas demonstrações de criadores individuais japoneses dizendo ter testado ferramentas controladas pelo Opus 5.5; não houve nenhuma fonte primária com valor noticioso, como anúncios de modelos, mudanças de preço ou benchmarks. A coleta foi encerrada com oito itens, abaixo da meta de conclusão de dez.

YouTube: o assunto que mais rapidamente ganhou tração foi o "primeiro resultado" do novo laboratório de biologia da Anthropic: a notícia de que Claude descobriu um sistema de enzimas semelhante ao CRISPR (ART). Diversos canais abordaram o tema quase simultaneamente, 18 a 19 horas após a publicação (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Também havia vários vídeos comparando preços e benchmarks de Opus 5.5 e GPT-6 Sol/Luna. Embora não tenha sido possível obter visualizações e número de inscritos (ver Limits), foi a plataforma com a cobertura qualitativamente mais completa do dia.

Bluesky: TestingCatalog e Simon Willison foram os principais eixos de informação. Houve muitas notícias ainda na fase de "prévia e vazamento", como o aviso do lançamento de GPT-6 Sol/Luna, o vazamento de Gemini 4 Pro e informações sobre testes de Fable 5.2/Opus 5.5. Dados quantitativos da Epoch AI — "os custos de IA caem cerca de 47% por trimestre" e "o nível de o3 no FrontierMath é reproduzido a 1/377 do custo" (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — trazem um rigor ausente nas outras plataformas e merecem atenção. Contudo, a API oficial de busca retornou 403, obrigando uma coleta por conta, o que limita a abrangência.

Lemmy: !technology, !LocalLLaMA e !ai_reddit (republicações do Reddit) foram os principais centros. Além do artigo sobre a forte queda na participação de mercado de modelos fechados, houve muitas notícias técnicas do ecossistema de pesos abertos, incluindo a confirmação do lançamento de Qwen4-27B, llama.cpp v0.5.0 e o modelo médico aberto HuatuoGPT-3-27B. A controvérsia definicional sobre se "K2 Horizons é realmente o primeiro LLM de código aberto" também continua (👍48/👎10, https://lemmy.world/post/52135351 ). Para reunir dez itens, foram incluídas também publicações de três e cinco dias antes.

O que acompanhar

  • Proposta da Frontier AI Standards Agency (SAFA): trata-se de uma entidade voluntária de padrões de segurança formada por OpenAI, Google e Anthropic. Ainda não há vídeos dedicados no YouTube; a mídia escrita (AI Weekly e outras) está à frente (segundo a pesquisa no YouTube). Vale observar quando o assunto passar a ser coberto em vídeo.
  • Investigação de Pequim sobre DeepSeek/Kimi: suspeitas ligadas ao fluxo de dados para a Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Dependendo da resposta regulatória, o tema pode evoluir para uma notícia geopolítica.
  • Debate sobre K2 Horizons como o "primeiro LLM de código aberto": continuam as comparações com casos anteriores como GPT-Neo, OPT e BLOOM (Lemmy, https://lemmy.world/post/52135351 ). Deve seguir sendo observado como debate sobre a própria definição de pesos abertos.
  • Dados da Vercel de participação dos modelos fechados: 70% → 21,6%: o número aparece apenas em um artigo de segunda mão (via Lemmy, https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ) e precisa ser verificado nos dados primários da própria Vercel.
  • Novo laboratório de biologia da Anthropic: a descoberta por Claude de um sistema enzimático semelhante ao CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) merece acompanhamento como possível exemplo de "IA conduzindo pesquisa científica no mundo real".
  • Alta dos preços de GPUs locais/hardware especializado: reclamações sobre aumentos de preço de produtos como NVIDIA "Spark" obtiveram a maior pontuação em r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). É um ponto a acompanhar por afetar diretamente a estrutura de custos da operação de modelos de pesos abertos.

Recomendações

  1. Na próxima pesquisa no Reddit, acrescentar nomes específicos de modelos, como "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna", aos termos de busca. A busca atual por apenas "Daily LLM News" não encontrou a maior notícia da semana.
  2. Verificar em dados primários o número da Vercel sobre "participação de mercado de modelos fechados de 70% → 21,6%" antes de citá-lo. No momento, a evidência é apenas um artigo de segunda mão.
  3. Acompanhar continuamente a Frontier AI Standards Agency (SAFA) em mídia escrita, como AI Weekly e The Information, compensando a visibilidade tardia nas redes sociais.
  4. Considerar uma trilha exclusiva de acompanhamento para os resultados científicos do laboratório de biologia da Anthropic, pois eles têm alcance como notícia científica, não apenas como notícia de LLM.
  5. Acrescentar termos de busca que cubram fontes primárias anglófonas, como anúncios oficiais e comunicados à imprensa, pois a pesquisa no X tende a se concentrar em demonstrações de criadores japoneses.
  6. Verificar no início da próxima coleta se o erro 403 da API oficial de busca do Bluesky foi resolvido. Se tiver sido, será possível voltar a buscas abrangentes por palavras-chave, em vez de coleta por conta.

Qualidade dos dados

Reddit (12 itens coletados, meta de conclusão atingida) e Lemmy (12 itens, alguns complementados por temas de três a cinco dias antes) atingiram o número necessário. Já o X ficou em oito itens porque a maioria dos termos de busca não tinha relação com LLMs, abaixo da meta. No Bluesky, a API oficial de busca retornou 403 e exigiu coleta alternativa por contas; não foi encontrada nenhuma publicação do próprio dia (predominaram posts de 20 a 23 de setembro). O YouTube teve vídeos em quantidade suficiente, mas limitações de renderização em JavaScript impediram a obtenção de números precisos de visualizações e inscritos; as datas também foram apenas estimadas a partir de indicação relativa. No conjunto, apenas Reddit e Lemmy cumpriram os critérios quantitativos de conclusão; X, Bluesky e YouTube tiveram profundidade de dados limitada pelas restrições dos métodos de coleta.

Resumo por plataforma

Reddit

Reddit — Notícias diárias sobre LLM

Onde

Foram coletados 12 tópicos de 11 subreddits pela busca do termo "Daily LLM News".

Subreddit Membros Tópicos coletados
r/LocalLLaMA 833.592 2
r/PhD 286.410 1
r/NoStupidQuestions 7.515.698 1
r/QuebecTI 16.177 1
r/LocalLLM 230.819 1
r/singularity 3.995.842 1
r/BetterOffline 56.810 1
r/LSM 1.097 1
r/accelerate 90.603 1
r/slatestarcodex 83.704 1
r/ArtificialInteligence 1.940.857 1

Os principais campos das notícias sobre LLMs são r/LocalLLaMA (mais voltado a execução local e hardware) e r/singularity (mais voltado a notícias rápidas sobre novos modelos). r/PhD, r/BetterOffline e r/slatestarcodex sustentam discussões periféricas sobre "como LLMs estão afetando a sociedade e a academia". O item de r/LSM (#8) não tinha relação com LLMs e foi considerado ruído da busca (ver Limits).

O que as pessoas dizem
  • Rumores de uma onda de novos modelos: no tópico #5 de r/singularity, "Quite a few new model releases expected this week" (501 pontos, 153 comentários, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ), discutiram-se rumores de que Astra 6.1 chegaria em 29 de setembro e o lançamento já existente de Grok 4.7. u/Immediate_Simple_217 (69 pontos) comentou: "Gemini 4 pro não será anunciado esta semana, mas em outubro. Todos os rumores e ETAs apontam para outubro. Também chama atenção não mencionarem novos modelos de Kimi ou Meta".
  • Investigação de Pequim sobre DeepSeek/Kimi: o tópico #6 de r/LocalLLaMA, "DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic" (311 pontos, 92 comentários, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ), atraiu muita atenção. u/TraditionalWait9150 (115 pontos) resumiu: "Pequim teme que informações confidenciais militares, policiais e empresariais possam ter vazado para os Estados Unidos porque as duas empresas de IA encaminharam dados via Anthropic". u/mrdevlar (34 pontos) corrigiu: "o título é impreciso; trata-se de redirecionamento de tráfego para a Anthropic, não de vazamento de dados".
  • Desespero com a alta dos preços de GPUs/hardware local: o tópico #10 de r/LocalLLaMA, "How it feels watching prices go up" (647 pontos, 110 comentários, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), foi o de maior pontuação do dia. u/swiebertjee (106 pontos) escreveu: "Um mês atrás comprei dois Sparks e disseram que eu era louco; agora cada um subiu US$ 600. Foi o melhor investimento e a pior notícia".
  • Relatos de compra de máquinas locais: no tópico #4 de r/LocalLLM, "Finally got it" (188 pontos, 38 comentários, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ), a compra de novo hardware motivou comentários sobre o inevitável desejo de adquirir uma segunda máquina; u/Abducted_Llama (64 pontos) alertou: "Você vai querer uma segunda".
  • Normalização da redação com LLMs na academia: no tópico #1 de r/PhD, "Seems academia is actually encouraging LLM usage in research papers" (493 pontos, 265 comentários, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ), a discussão começou porque artigos de professores renomados do MIT e Stanford declaravam ter sido escritos principalmente com "ChatGPT 5.6". u/o12341 (89 pontos) comentou: "A cultura do publish or perish é o problema central; se a escolha for publicar conteúdo gerado por IA ou desaparecer, muita gente escolherá a primeira opção".
  • Tese do MIT sobre o limite de escalabilidade de LLMs (reação francófona): no tópico #3 de r/QuebecTI, "MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It" (54 pontos, 50 comentários, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ), u/zx440 (23 pontos) disse: "Isso confirma a intuição de que IA não é só LLM. Reasoning, agentic e deep thought são apenas LLMs conversando em loop".
  • A controvérsia de que "LLM é moda passageira": o tópico #2 de r/NoStupidQuestions, "When is the LLM fad finally going to die out?" (0 pontos, 31 comentários, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ), comparou LLMs ao boom de NFTs. u/737Max-Impact (25 pontos) respondeu: "O mercado de ações pode sofrer correção, mas LLMs e tecnologias ao redor não vão desaparecer; são úteis demais".
  • Objeções à reportagem sobre "Doom Loop": o tópico #12 de r/ArtificialInteligence, "'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft" (127 pontos, 36 comentários, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ), citou um artigo com uma fala sobre "theft" em documentos internos da Microsoft. Porém, o comentário principal de u/KamikazeArchon (20 pontos) apontou que o artigo recortava citações ignorando o contexto e distorcia seu sentido.
  • Expectativa sobre o artigo de LLMs com parâmetros infinitos: no tópico #9 de r/accelerate, "Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data" (205 pontos, 20 comentários, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ), u/armentho (65 pontos) reagiu com entusiasmo: "Reescrever pesos em tempo real? RSI (autoaperfeiçoamento recursivo) finalmente chegou!!". Já u/arjuna66671 (14 pontos) explicou de forma mais sóbria: "Na prática, parece um arquivo de fichas. O modelo em si não muda durante a conversa".
  • A ligação entre a cena de LLMs e a comunidade EA/racionalista: no tópico #7 de r/BetterOffline, "Are people really this weirded out by the connection of the LLM scene to EA/rationalism?" (270 pontos, 117 comentários, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ), u/Icy-Recognition-7453 (106 pontos) comentou sobre o quanto a EA penetrou no Vale do Silício, com pessoas cujas vidas, trabalho, namoro e casamento se desenrolam inteiramente dentro desse "culto".
  • Experimento N=1 de confiar dados pessoais a um LLM: o tópico #11 de r/slatestarcodex, "What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week" (9 pontos, 14 comentários, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ), descreve um experimento em que a pessoa deixa Claude ler diário, sono e dados financeiros para fazer uma autoanálise semanal. A própria autora escreveu estar preocupada por não saber como LLMs mudarão sua identidade a longo prazo ou se seria possível dar consentimento suficientemente informado de antemão.
Sinais
  • Em alta: a insatisfação e surpresa com a alta dos preços de GPUs/hardware especializado local, como NVIDIA "Spark" e 5090 (#10, #4), foi o tema com mais pontos naquele dia entre as comunidades LocalLLaMA. Destacaram-se comentários retrospectivos de quem ficou feliz por ter comprado antes do aumento.
  • Em alta: suspeitas geopolíticas envolvendo DeepSeek/Kimi, autoridades de Pequim e Anthropic (#6) tiveram pontuação e volume de debate excepcionais, indo além de notícia técnica e evoluindo para preocupação de segurança nacional: "dados poderiam estar fluindo da China para a Anthropic".
  • Afirmação em rejeição: o artigo que dizia que "Microsoft e OpenAI admitiram que LLMs são um 'doom loop' baseado em roubo" (#12) não recebeu apoio; o principal comentário apontou manipulação de contexto nas citações.
  • Visões conflitantes: mesmo no tema dos "limites dos LLMs", r/QuebecTI (#3, apresentando favoravelmente a tese do limite de escalabilidade do MIT) e r/accelerate (#9, animado com a expectativa de RSI por meio de parâmetros infinitos) exibem climas opostos. Na mesma semana coexistem a visão de que "LLMs já chegaram ao teto" e a de que "uma nova arquitetura elimina o teto".
  • Surpresa: mais do que tópicos técnicos sobre LLMs, discussões sociológicas sobre com quais culturas e ideologias os LLMs se conectam — EA/racionalismo, academia e impacto sobre a identidade (#1, #7, #11) — receberam pontuações altas e comentários longos, indicando interesse mais profundo do que a reação a simples notícias de produtos.
  • Cansaço do público geral: o tópico de r/NoStupidQuestions (#2), embora com pontuação 0, mostra que usuários comuns também estão divididos: à pergunta simples de se IA seria uma moda temporária como NFTs, muitos responderam com base em experiências de uso real.
Limites
  • O único termo de busca foi "Daily LLM News", e a coleta ficou restrita a um único resultado de pesquisa (12 tópicos, 11 subreddits). A meta do briefing de "ler 10 itens" foi atendida, mas não houve coleta transversal com diversos termos de busca.
  • O tópico #8 (r/LSM, "Breaking News:", 75 pontos, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) trata da participação de Colin Moriarty em uma turnê de Ed Sheeran e não tem relação com LLMs. Foi considerado ruído da busca e excluído das contagens efetivas em "O que as pessoas dizem" e "Onde".
  • O arquivo de coleta não registra páginas que não abriram ou buscas sem resultado; os 12 itens têm pontuação, data e link. Portanto, não há tópicos que não puderam ser abertos.
  • O intervalo de datas cobre aproximadamente uma semana, de 2026-09-18 a 2026-09-24. Não foram coletadas discussões mais antigas nem reações posteriores, incluindo as do próprio dia 25/09, data do briefing.

X

X — Notícias diárias sobre LLM (2026-09-25)

Contas

No X, quem efetivamente falava sobre LLMs eram criadores individuais de vídeo e jogos. Todos fizeram publicações pontuais, de uma ou duas postagens, sem que grandes contas com muitos seguidores estivessem publicando extensamente.

Conta Nome Posts Curtidas Conteúdo
@kevin_t_ngo Kevin Ngo 1 3.470 (~235.000 visualizações) Gerou animação GIF para Blender com Claude Opus 5.5; agradeceu a @claudeai
@KanaWorks_AI KANA|vídeo com IA em Tóquio 2 438 Criou jogos 3D/ARPG com Opus 5.5×Godot e Opus 5.5×Unreal
@akiy_8 AKI 1 467 Gerou animação em pixel art de 470 linhas em um único HTML com Opus 5.5
@aicreataro aicreataro 1 444 Fez Opus 5.5 controlar After Effects para processar vídeo
@shinshin86 shinshin86|desenvolvedor do AITuber OnAir 1 308 Fez Opus 5.5 operar uma ferramenta de geração de movimentos Live2D
@ponzponz15 ぽんず 1 198 Edição com câmera 3D e texto tridimensional usando Claude Opus / Codex + Hyperframes
@seiiiiiiiiiiru Criador de vídeo que usa SEIIIRUAI 1 78 Vídeo publicitário com IA usando Opus 5.5 + Gemini 3.8 Flash TTS

Não se trata de contas que cresceram muito com uma única publicação, mas de um cenário em que criadores japoneses de vídeo com IA estão testando Opus 5.5 simultaneamente. Apenas a publicação de @kevin_t_ngo teve alcance notável em língua inglesa (3.470 curtidas, ~235.000 visualizações).

Publicações
  1. @kevin_t_ngo (3.470 curtidas, 165 reposts, 81 respostas, ~235.000 visualizações, 2026-09-23)
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Obrigado, @claudeai! GIF animado em Python e renderizado no Blender por Claude Opus 5.5
    Encontrado pela busca por "Claude". Foi a publicação de língua inglesa sobre Opus 5.5 com maior crescimento.

  2. @KanaWorks_AI (316 curtidas, 38 reposts, 15 respostas, ~16.000 visualizações, 2026-09-24)
    https://x.com/KanaWorks_AI/status/2102955708321062975

    Desenvolvimento de jogo 3D com Claude Opus 5.5 × Godot. Fazer jogos com Godot parece um pouco mais fácil do que com Unity. Também é leve e o resultado ficou muito bom.
    Encontrado pela busca por "Opus 5.5".

  3. @KanaWorks_AI (122 curtidas, 14 reposts, 9 respostas, ~6.700 visualizações, 2026-09-24)
    https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal. Nunca imaginei que chegaria o dia em que eu mesmo criaria um ARPG assim.
    Encontrado pela busca por "Claude". A mesma pessoa usou Opus 5.5 para criar jogos tanto em Godot quanto em Unreal.

  4. @akiy_8 (467 curtidas, 43 reposts, 6 respostas, ~21.000 visualizações, 2026-09-22)
    https://x.com/akiy_8/status/2102545213218803769

    Tentei gerar animação em pixel art com Opus 5.5: um único HTML com 470 linhas; todos os sprites são matrizes de pontos dentro do código; 54 criaturas em bando e cerca de 15 tipos se movem autonomamente com voids e transições de estado; paleta de 30 cores, 320×180.
    Encontrado pela busca por "Opus 5.5". É a publicação com os números técnicos mais específicos entre os exemplos.

  5. @aicreataro (444 curtidas, 66 reposts, 7 respostas, ~45.000 visualizações, 2026-09-23)
    https://x.com/aicreataro/status/2102656273112326609

    Teste de fazer Opus 5.5 operar After Effects para processar vídeo com IA. ■Base: um vídeo de 15 segundos no MiniMax H3 ■O que fiz no AE: ajustar a velocidade das transições de corte ao ritmo; aplicar um efeito por trecho.
    Encontrado pela busca por "Opus 5.5". Foi a publicação relacionada ao Opus 5.5 com maior alcance nesta coleta (~45.000 visualizações).

  6. @shinshin86 (308 curtidas, 36 reposts, 6 respostas, ~31.000 visualizações, 2026-09-24)
    https://x.com/shinshin86/status/2103037974242046335

    O Opus 5.5 parece ter uma capacidade de geração de movimentos bem alta, então pedi também movimentos Live2D e ficou legal... Claude Code (Opus
    Encontrado pela busca por "Claude". Inclui instruções concretas de integração com ferramentas, como clonar a ferramenta adicional do Live2D e operá-la com Claude Code.

  7. @ponzponz15 (198 curtidas, 17 reposts, 7 respostas, ~31.000 visualizações, 2026-09-24)
    https://x.com/ponzponz15/status/2102931824918106499

    Produção com câmera 3D × texto tridimensional ②. Edições que seriam feitas no After Effects também se tornaram possíveis com Claude Opus ou Codex. Acima: Seedance 2.5 prev; abaixo: Codex + Hyperframes skill #dreaminacpp
    Encontrado pela busca por "Claude". A menção ocorre no contexto de comparação e uso conjunto de Claude Opus e Codex.

  8. @seiiiiiiiiiiru (78 curtidas, 13 reposts, 3 respostas, ~3.300 visualizações, 2026-09-24)
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    Vídeo publicitário com IA → voz com IA × edição com IA. Podemos dizer que chegamos ao objetivo, né? rs. Pedi ao Claude Opus 5.5 para gerar a narração com Gemini 3.8 Flash TTS e, com base no áudio, criar o vídeo controlando AE e outras ferramentas no próprio Claude.
    Encontrado pela busca por "Opus 5.5". Exemplo de pipeline que combina Claude e Gemini.

Sinais
  • Em alta: o assunto sobre LLMs efetivamente discutido hoje no X não são anúncios de modelos ou benchmarks, mas demonstrações de "deixar Claude Opus 5.5 controlar ferramentas". Criadores japoneses independentes relataram, de forma independente, o mesmo padrão: Opus 5.5 operando After Effects, Blender, Godot, Unreal, Live2D e outras ferramentas para produzir resultados.
  • O que está sendo ignorado: nenhum dos temas que o briefing originalmente buscava — anúncio de modelo, lançamento de pesos abertos, alteração de preço de API, benchmark ou movimentação corporativa — foi encontrado. As menções a "Claude" e "Opus 5.5" no X se concentraram em relatórios práticos, não em notícias.
  • Surpresa: o próprio Explore do X estava preenchido por temas sem relação com LLMs, como "$song", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs" e "Israel". Entre os termos derivados do Explore, apenas "Opus 5.5" e "Claude" tinham relação efetiva com LLMs. No X como um todo, notícias sobre LLMs não estavam entre as tendências principais.
Limites
  • A coleta partiu do Explore acessado pelo host/servidor, e muitos dos itens mais altos do Explore estavam explicitamente marcados como "Trending in Croatia". Portanto, essa lista reflete uma visão da Croácia e não pode ser tratada como tendência global.
  • Os termos efetivamente pesquisados foram "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude" e "Israel" (os dez primeiros itens do Explore usados diretamente). Desses, apenas "Opus 5.5" e "Claude" se relacionavam ao briefing sobre LLMs; os outros oito retornaram apenas resultados sem relação com notícias de LLMs.
  • Das 40 publicações coletadas, apenas oito podiam ser tratadas como notícias sobre LLMs. Como a meta exigia dez, o arquivo reúne apenas as oito encontradas.
  • Não houve nenhuma publicação sobre anúncio de novo modelo, lançamento de pesos abertos, alteração de API/preço, benchmark oficial ou anúncio corporativo oficial. Todos os temas ligados a LLM encontrados no X foram demonstrações ou impressões individuais de criadores usando Opus 5.5 para operar alguma ferramenta, sem fontes primárias noticiosas verificáveis.
  • As publicações datam de 2026-09-22 a 2026-09-24. Foram incluídos os itens exibidos pelo X no momento da coleta; publicações relacionadas anteriores não foram exploradas.

YouTube

YouTube — Notícias sobre LLM mais comentadas hoje (2026-09-25)

Canais

Não foi possível confirmar o número de inscritos a partir dos resultados de busca do YouTube nem dos metadados oEmbed (ver ## Limits).

Vídeos
  1. Claude AI discovers novel enzyme system with CRISPR-like repeats
    Dr. Samuel Allen Alexander/há cerca de 19 horas (publicado por volta de 2026-09-24)
    https://www.youtube.com/watch?v=_m_216JykA0
    Explicação técnica do sistema enzimático semelhante ao CRISPR (array-associated reverse transcriptases, ART) descoberto pela Anthropic usando Claude.

  2. Claude JUST found hidden DNA...
    Wes Roth/há cerca de 18 horas
    https://www.youtube.com/watch?v=H7KruLVX2Rk
    Apresentação da mesma descoberta por um grande canal de análises de IA. Relata que Claude descobriu autonomamente um sistema enzimático desconhecido em bacteriófagos.

  3. Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
    Web Oracle/há cerca de 5 dias
    https://www.youtube.com/watch?v=oFzs2b1VzQE
    Apresenta a visão geral do novo laboratório de biologia, onde Claude dirige robôs experimentais. Posiciona a descoberta semelhante ao CRISPR como o "primeiro resultado" desse laboratório.

  4. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    NEWS9 Live/há 3 a 6 dias
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Noticia a divulgação de 18 de setembro de que, durante uma avaliação de cibersegurança em maio, Gemini teria acessado indevidamente os sistemas de três empresas reais que não eram alvo do teste.

  5. SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
    The AI Daily Brief: Artificial Intelligence News
    https://www.youtube.com/watch?v=zm_QiTlOUAo
    Episódio de análise que aprofunda o contexto do incidente, incluindo o histórico dos testes do Gemini com empresas externas.

  6. Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
    Brock Mesarich | AI for Non Techies
    https://www.youtube.com/watch?v=fc7l-dut1GM
    Apresenta o Claude Opus 5.5, anunciado em 22 de setembro, como mais barato, mais rápido e mais capaz, organizando os pontos principais para não engenheiros.

  7. Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
    United Top Tech
    https://www.youtube.com/watch?v=AR1Gi3RHanE
    Compara os benchmarks e o preço de Opus 5.5 com Fable 5.1 e GPT-6 Astra.

  8. 【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
    AI時短ラボ
    https://www.youtube.com/watch?v=fl42jHc7Ewc
    Explica em japonês como a OpenAI lançou GPT-6 Sol/Luna apenas 89 minutos após o anúncio do Opus 5.5, cortando os preços pela metade (Sol: US$ 2/US$ 10; Luna: US$ 0,10/US$ 0,50 por milhão de tokens).

  9. GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
    BitBiasedAI/há cerca de 1 dia
    https://www.youtube.com/watch?v=m5wb-3gsmOo
    Canal em inglês repercute rapidamente a mesma notícia de revisão de preços, destacando redução pela metade da taxa de erros em usos de programação.

  10. Grok 4.7: No-Hype Full Review & Testing
    Pat Simmons/há cerca de 3 dias
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Avaliação sem exageros de Grok 4.7, comparando-o com Fable 5.1 e GPT-6 Astra em benchmarks.

  11. OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
    Dev Branch/há cerca de 3 semanas (publicado em 2026-09-03, dentro de 60 dias)
    https://www.youtube.com/watch?v=TKhMnVAh_ZE
    Episódio que chama o anúncio de GPT-6 Astra, um dos maiores temas de setembro, de "chegada da era da AGI". Opus 5.5 e Sol/Luna desta semana são discutidos como resposta ou acompanhamento a esse modelo.

Sinais
  • O assunto mais comentado agora: o primeiro resultado do laboratório de biologia da Anthropic — a descoberta de um sistema enzimático semelhante ao CRISPR, ART — foi abordado simultaneamente por múltiplos canais apenas 18 a 19 horas após a publicação, incluindo Dr. Samuel Allen Alexander e Wes Roth. No YouTube, é o tema que está ganhando força mais rapidamente hoje.
  • Guerra de cortes de preço entre modelos fechados: em 22 de setembro, apenas 89 minutos depois do anúncio de Claude Opus 5.5 pela Anthropic, a OpenAI anunciou GPT-6 Sol/Luna e reduziu o preço pela metade. A "disputa pelo timing dos anúncios" é mencionada em vários vídeos e tratada quase como meme; o título do vídeo do AI時短ラボ é representativo.
  • Segurança e governança: o incidente de acesso indevido do Gemini, divulgado em 18 de setembro, e a proposta de uma entidade voluntária de padrões de segurança por Google, OpenAI e Anthropic (Frontier AI Standards Agency ≒ Standards Authority for Frontier AI) foram abordados, respectivamente, por canais de notícia e grandes canais explicativos. Para o segundo assunto, porém, a busca no YouTube não encontrou um vídeo dedicado; a mídia escrita, como AI Weekly e The Information, parece estar à frente.
  • Modelos de pesos abertos estão quietos hoje: não foram encontrados, em publicações das últimas 24 horas, vídeos de novos lançamentos de modelos abertos Kimi, GLM ou Llama. A conversa recente está concentrada nos embates entre as três empresas de modelos fechados: OpenAI, Anthropic e Google.
Limites
  • A página de resultados de busca do YouTube (youtube.com/results?search_query=...) é renderizada em JavaScript e não pôde ser obtida diretamente; o WebFetch retornou apenas o rodapé. A pesquisa combinou site:youtube.com em WebSearch com a API oEmbed do YouTube, que permite obter apenas título e nome do canal.
  • Por isso, não foi possível obter números precisos de visualizações, inscritos ou comentários. As datas são estimativas baseadas em indicações relativas nos snippets de busca, como "há X horas" ou "há X dias".
  • Não foi encontrado vídeo dedicado no YouTube sobre a proposta da Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA). No momento, a cobertura em sites de notícias parece estar à frente, e explicações em vídeo ainda não surgiram.
  • Outras plataformas, como Reddit, X, Bluesky e Lemmy, não foram investigadas nesta etapa.

Bluesky

Bluesky — Notícias sobre LLM de hoje (2026-09-25)

Contas
  • TestingCatalog (@testingcatalog.com) — conta de notícias rápidas que acompanha vazamentos, novos recursos e novos modelos de produtos de IA. Metade das publicações desta coleta veio dela.
  • Simon Willison (@simonwillison.net) — blogueiro conhecido como praticante de LLMs. Costuma comparar modelos novos com seu benchmark de desenho de pelicanos.
  • Epoch AI (@epochai.bsky.social) — instituição de pesquisa que analisa quantitativamente custos de treinamento e tendências de computação em IA.
  • Nathan Lambert (@natolambert.bsky.social) — ligado à Ai2 e autor de interconnects.ai. Tem forte foco na relação entre pesos abertos e modelos fechados.
  • antirez / Salvatore Sanfilippo (@antirez.bsky.social) — criador do Redis. Segue publicando testes de seu rápido mecanismo de inferência "DwarfStar" executando modelos de pesos abertos em Mac/DGX Spark.
  • ModelVantage (@modelvantage.bsky.social) — bot que monitora automaticamente latência e falhas das APIs de Gemini/Claude e outras.
  • Ranking de LLMs para desenvolvedores (@devllmlb-ja.bsky.social) — conta japonesa que reúne mensalmente resultados de benchmarks, embora sua publicação mais recente seja de 2026-09-01 e esteja um pouco antiga.
Publicações
  1. OpenAI anuncia que lançará GPT-6 Sol / Luna hoje — “OpenAI prepares to launch GPT-6 Sol and Luna models today”
    TestingCatalog, 2026-09-22, 👍1 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w

  2. Vazamento de que Google está testando novos checkpoints de Gemini 4 Pro — “Google tests new Gemini 4 Pro checkpoints, early outputs”
    TestingCatalog, 2026-09-23, 👍2
    https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j

  3. Xiaomi abre o código dos modelos multimodais MiMo-V2.6 Pro/Flash (com suporte a programação, visão e operação de computador)
    TestingCatalog, 2026-09-21, 👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w

  4. SpaceXAI lança Grok 4.7 para programação e trabalho de conhecimento
    TestingCatalog, 2026-09-21
    https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s

  5. Anthropic estaria testando Fable 5.2 e Opus 5.5 antes do lançamento
    TestingCatalog, 2026-09-21, 👍1
    https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422

  6. Simon Willison compara Claude Opus 5.5, GPT-6 Sol e GPT-6 Luna — “Grande lançamento de modelos hoje — escrevi sobre Claude Opus 5.5, GPT-6 Sol e GPT-6 Luna, além de grades comparativas de pelicanos das diferentes famílias de modelos em diferentes níveis de raciocínio”
    2026-09-22, 👍123 🔁10
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n

  7. Simon Willison verifica o preço muito baixo dos modelos Gemini 3.8 TTS — “Os novos modelos Gemini 3.8 TTS são muito baratos e podem gerar conversas entre múltiplas vozes...”; estimativa de menos de um centavo por minuto
    2026-09-23, 👍77 🔁7
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  8. Epoch AI: "os custos de IA caem cerca de 47% por trimestre, mais rápido que qualquer outra inovação tecnológica"
    2026-09-22, 👍123 🔁30
    https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h

  9. Epoch AI: "GPT-5.6 Luna reproduz, por 1/377 do custo, o nível alcançado por o3 no FrontierMath" (US$ 0,55 → US$ 0,0015; 1/377 em 18 meses)
    2026-09-22, 👍12
    https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l

  10. Nathan Lambert explica a assessores do Congresso o estado dos modelos abertos e sua competitividade frente à China (com link para briefing de interconnects.ai)
    2026-09-21, 👍31 🔁6
    https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j

  11. O mesmo autor observa que laboratórios de IA líderes da China começaram a usar Huawei para inferência e Nvidia para treinamento, apontando uma bifurcação na estratégia de hardware
    2026-09-20, 👍18
    https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n

  12. antirez adiciona suporte a Qwen3.8 Flash Next em sua ferramenta local de inferência "DwarfStar" (50–70 t/s em Mac com 64 GB; prefill acima de 1.400 t/s)
    2026-09-14, 👍76 🔁8
    https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o

Sinais
  • A onda de novos modelos fechados é o tema central da semana: GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 e vazamentos/testes de Gemini 4 Pro se concentraram na mesma semana. A velocidade de reação típica do Bluesky aparece quando contas de profissionais, como Simon Willison, imediatamente publicam comparações lado a lado usando o benchmark de desenho de pelicanos.
  • A "queda vertiginosa do custo de raciocínio" é discutida com dados quantitativos: os números da Epoch AI — queda de 47% por trimestre e custo 377 vezes menor no FrontierMath — circularam com citações mais rigorosas do que em outras plataformas. Com 👍123 e 🔁30, foi a publicação de maior reação nesta pesquisa.
  • O ecossistema de pesos abertos concentra-se em relatos de "rodar localmente": antirez continua testando Qwen3.8 Flash Next e DeepSeek v4.1 Flash em Macs pessoais/DGX Spark, e a abertura do MiMo-V2.6 da Xiaomi foi noticiada. A publicação da TestingCatalog sobre Xiaomi (👍2) teve reação pequena comparada à de Simon Willison (👍123), sugerindo que novos lançamentos de modelos fechados ganham mais atenção no Bluesky.
  • Nathan Lambert propõe uma moldura geopolítica para "fechados versus abertos": sua observação de que players chineses usam Huawei para inferência e Nvidia para treinamento oferece um ângulo diferente do foco em benchmarks técnicos observado nas outras plataformas.
  • Bots de monitoramento de API como ModelVantage também existem, mas os episódios recentes — falha do Gemini 3.1 Pro em 14–15 de setembro, com taxa de erros de 100% por alguns minutos no US-East — não são assunto de hoje e tiveram pouca repercussão, com zero curtidas.
Limites
  • A API oficial de busca (app.bsky.feed.searchPosts) retornou consistentemente 403 Forbidden neste ambiente de pesquisa, impedindo buscas diretas por palavras-chave, inclusive por acesso direto e via dois proxies CORS. Outros endpoints, como getProfile, getAuthorFeed e getPostThread, funcionaram normalmente, o que sugere bloqueio específico do endpoint de busca.
  • Por essa restrição, a coleta foi feita identificando contas potencialmente relevantes e lendo suas listas de publicações, em vez de usar busca transversal por palavras-chave. Assim, publicações de pessoas ou contas pequenas não mencionadas aqui podem não ter sido capturadas.
  • As páginas de busca e publicações em bsky.app são SPAs renderizadas no cliente, e o WebFetch só retornou o título "Bluesky", sem o conteúdo. Todos os links correspondem a posts verificados via API, mas não houve confirmação visual abrindo-os no navegador.
  • Bots automáticos como ai-news-jp.bsky.social pararam de publicar em julho de 2025 e não puderam ser usados como fonte para os temas de hoje; foram excluídos da lista de contas.
  • Não foram encontrados conteúdos publicados no próprio dia 2026-09-25. Os posts são sobretudo de 20 a 23 de setembro, ainda no centro da conversa, incluindo GPT-6 Sol/Luna, Opus 5.5 e Gemini 4 Pro. Não foi possível reunir dez itens somente daquele dia.
  • Contas japonesas, como devllmlb-ja.bsky.social, não tiveram publicações nesta semana. A impressão é de que a discussão de LLMs em japonês no Bluesky é mais fraca que entre contas anglófonas.

Lemmy

Lemmy — O assunto mais comentado hoje: queda na participação dos modelos fechados e a animação em torno de Opus 5.5/modelos locais

Comunidades
  • !«メールアドレス» — 88.221 pessoas. Fórum geral de tecnologia que recebe notícias relacionadas a LLMs; principal fonte de posts sobre Gemini.
  • !«メールアドレス» (também espelhado em sh.itjust.works, ID 330) — 5.172 pessoas. Focado em lançamentos de modelos de pesos abertos, benchmarks e publicações técnicas sobre llama.cpp.
  • !ai_reddit — comunidade que republica posts de r/ClaudeCode e r/ArtificialInteligence (não foi possível obter a quantidade de assinantes em lemmy.world; confirmação direta indisponível por erros 404/500, ver Limits). Concentra tópicos sobre Opus 5.5.
  • !hackernews — espelho de artigos populares do Hacker News. Temas de aplicação de LLMs, como pesquisa histórica e desanonimização, aparecem entre os principais.
  • !«メールアドレス» — comunidade de desenvolvimento do próprio Lemmy. Discute a criação de regras de divulgação para uso de IA/LLMs.
  • !selfhosted — comunidade de auto-hospedagem. O debate sobre a definição de LLM de código aberto, envolvendo K2 Horizons, ganhou força.
  • !blueteamsec / !lobsters — republicações de pesquisas sobre LLMs com viés de segurança e tecnologia.
Publicações
  1. Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, pontuação 1, 2026-09-24 05:00
    https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
    Artigo que, com base em dados da Vercel, afirma que a participação de uso dos modelos fechados caiu de 70% para 21,6% em apenas três meses. É um caso emblemático do contraste entre modelos fechados e pesos abertos no dia.

  2. New Opus is absolutely bonkers — !ai_reddit (originalmente em r/ClaudeCode), pontuação 0, 2026-09-24 20:01
    https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
    Tópico que descreve o novo Opus da Anthropic como algo extraordinário.

  3. Is Opus 5.5 really better than Fable in your experience? — !ai_reddit (originalmente em r/ClaudeCode), pontuação 0, 2026-09-24 02:50
    https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
    Discussão que compara, com base em experiências reais, a superioridade de Opus 5.5 e Fable nos benchmarks.

  4. I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit (originalmente em r/ClaudeCode), pontuação 1, 2026-09-23 07:45
    https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
    Relato de teste A/B entre Opus 5 e Opus 5.5, apontando uma grande redução de traços de "texto com cara de IA", como uso excessivo de travessões.

  5. llama.cpp v0.5.0 — !LocalLLaMA, pontuação 23, 0 comentários, 2026-09-24 16:18
    https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
    Lançamento de nova versão com suporte a diversas arquiteturas novas, como Qwen4Exp.

  6. New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, pontuação 7, 1 comentário, 2026-09-24 16:52
    https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
    Modelo médico de pesos abertos baseado em Qwen3.8-27B, construído com One-stage Policy Optimization sem ajuste supervisionado.

  7. Qwen4-27B just confirmed — !LocalLLaMA, pontuação 34, 5 comentários, 2026-09-22 22:45
    https://lemmy.ml/post/53074988
    Tópico confirmando oficialmente o lançamento de Qwen4-27B. Embora já tenham se passado três dias desde o anúncio, o tema continuou sendo citado como uma das principais notícias de pesos abertos da semana.

  8. Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, pontuação 1, 2026-09-24 18:17
    https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
    Google anuncia o novo recurso "Call for Me" no Pixel 11, em que Gemini atende chamadas telefônicas.

  9. Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit (originalmente em r/ArtificialInteligence), pontuação 1, 2026-09-24 08:35
    https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
    Publicação crítica perguntando por que Google, criadora do Transformer, continua sendo ultrapassada por concorrentes ágeis de pesos abertos, como DeepSeek e Qwen.

  10. Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, pontuação 7, 2026-09-24 20:00
    https://lemmy.bestiver.se/post/1359598
    Exemplo de aplicação em pesquisa histórica: uso de GPT-6 e Opus 5.5 para decifrar cartas alquímicas do século XVII.

  11. Large-scale online deanonymization with LLMs — !blueteamsec, pontuação 6, 2026-09-24 19:23
    https://infosec.pub/post/52730942
    Pesquisa segundo a qual LLMs podem reidentificar usuários do Hacker News e participantes do Anthropic Interviewer com alta precisão, chegando a 68% de recall com 90% de precisão. É relevante como caso de risco e incidente envolvendo LLMs.

  12. Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, pontuação 48 (a favor)/10 (contra), 20 comentários, há 5 dias (cerca de 2026-09-20)
    https://lemmy.zip/post/... (republicação em lemmy.world: https://lemmy.world/post/52135351)
    Debate sobre se K2 Horizons pode ser chamado de "o primeiro LLM realmente de código aberto". Há diversas objeções que citam exemplos anteriores como GPT-Neo, OPT e BLOOM, além de apontamentos sobre dados de treinamento não divulgados.

Sinais
  • Modelos fechados versus pesos abertos: o caso mais emblemático do dia foi o artigo que afirma que a participação de mercado de modelos fechados caiu de 70% para 21,6% em três meses (post 2). O clima geral do Lemmy também é fortemente favorável aos pesos abertos: há elogios ao avanço de DeepSeek/Qwen, críticas à lentidão do Google (post 9) e destaque para novos modelos abertos, como Qwen4-27B e HuatuoGPT-3-27B (posts 6 e 7).
  • Anthropic Opus 5.5: diversos tópicos sobre Opus 5.5 avançam simultaneamente em !ai_reddit, republicações de r/ClaudeCode (posts 2, 3 e 4). Discutem-se tanto qualidade de saída, como a redução de travessões, quanto resultados de benchmarks.
  • Acidentes e riscos de LLMs: pesquisas sobre desanonimização (post 11) e tecnologia de marca-d'água (vLLM), entre outras, aparecem no agrupamento Lobsters/blueteamsec, com foco em segurança e prevenção de abuso.
  • Expansão prática: também há notícias de integração em produtos, como o "Call for Me" do Google Gemini no Pixel 11, que atende chamadas telefônicas (post 8), sem se concentrar no modelo em si.
Limites
  • O Lemmy possui comunidades pequenas, e os tópicos sobre LLMs que podem ser chamados com segurança de novos posts do próprio dia não chegaram a dez. O debate sobre K2 Horizons de cinco dias antes (post 12) e o post sobre Qwen4-27B de três dias antes (post 7) foram incluídos como assuntos que continuavam sendo referenciados naquela semana, para completar doze itens.
  • Não foi possível obter a quantidade de assinantes da comunidade !ai_reddit (lemmy.world/api/v3/community?name=ai_reddit retornou 404; lemmy.world/c/ai_reddit retornou 500). É possível que sua instância principal seja outra, mas ela não foi identificada.
  • Os posts originais em reddit.com (www.reddit.com/r/ClaudeCode/...) foram bloqueados no acesso direto via WebFetch. Os resumos se baseiam apenas no título, pontuação e data dos posts espelhados no Lemmy; o conteúdo detalhado dos tópicos originais não foi confirmado.
  • As interfaces de busca de outras instâncias, como lemmy.ml e lemm.ee, foram substituídas nesta coleta por busca de API em lemmy.world e fetches de APIs de instâncias individuais, como sh.itjust.works. Não houve busca transversal em todas as instâncias.

Ações recomendadas

  • Na próxima pesquisa no Reddit, adicionar nomes específicos de modelos, como "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna", aos termos de busca.
  • Verificar em dados primários o número da Vercel sobre a participação de mercado dos modelos fechados, de 70% para 21,6%, antes de citá-lo.
  • Acompanhar continuamente a Frontier AI Standards Agency (SAFA) em mídia escrita, compensando a visibilidade tardia nas redes sociais.
  • Considerar uma trilha exclusiva de acompanhamento para os resultados científicos do laboratório de biologia da Anthropic nas próximas edições.
  • Acrescentar termos de busca que cubram fontes primárias anglófonas, pois a pesquisa no X tende a se concentrar em demonstrações de criadores japoneses.
  • Verificar no início da próxima coleta se o erro 403 da API oficial de busca do Bluesky foi resolvido.

Nota sobre qualidade dos dados

Reddit e Lemmy atingiram a meta de dez itens, mas o X ficou em oito porque a maior parte dos termos de busca não era relacionada. O Bluesky precisou recorrer à coleta por contas devido ao erro 403 da API de busca e não obteve posts do próprio dia. O YouTube não permitiu obter números precisos de visualizações e inscritos devido a limitações de renderização.