Notícias diárias sobre LLM — 2026-09-25
A disputa de anúncios entre modelos fechados — com a OpenAI lançando GPT-6 Sol/Luna e reduzindo os preços pela metade apenas 89 minutos após a Anthropic anunciar Claude Opus 5.5 em 22 de setembro — foi o principal assunto do dia, confirmado de forma independente em X, YouTube, Bluesky e Lemmy. A avaliação sobre o avanço dos modelos de pesos abertos, porém, varia bastante entre plataformas.
A disputa de anúncios entre modelos fechados — com a OpenAI lançando GPT-6 Sol/Luna e reduzindo os preços pela metade apenas 89 minutos após a Anthropic anunciar Claude Opus 5.5 em 22 de setembro — foi o principal assunto do dia, confirmado de forma independente em X, YouTube, Bluesky e Lemmy. A avaliação sobre o avanço dos modelos de pesos abertos, porém, varia bastante entre plataformas.
Notícias sobre LLM mais comentadas hoje — 2026-09-25
O maior acontecimento da semana foi a "disputa pelo timing dos anúncios" entre modelos fechados: apenas 89 minutos depois de a Anthropic anunciar o "Claude Opus 5.5" em 22 de setembro, a OpenAI lançou o "GPT-6 Sol/Luna" e cortou os preços pela metade. O caso foi abordado de forma independente em X, YouTube, Bluesky e Lemmy, podendo ser considerado o assunto mais comentado do dia. Já no Reddit, o tema praticamente não apareceu: em vez disso, ganharam força assuntos em outro eixo, como a alta dos preços de GPUs locais e a investigação das autoridades de Pequim sobre DeepSeek/Kimi. As avaliações sobre o ímpeto dos modelos de pesos abertos estão completamente divididas entre plataformas, e não é possível simplesmente afirmar que "os abertos estão vencendo" ou "estão perdendo".
Entre plataformas
- A troca de golpes Claude Opus 5.5 → GPT-6 Sol/Luna: o lançamento do GPT-6 Sol/Luna pela OpenAI, com preços reduzidos à metade, apenas 89 minutos após o anúncio do Opus 5.5 pela Anthropic em 22 de setembro, foi mencionado de forma independente no YouTube (AI時短ラボ: “GPT também foi atualizado no dia do anúncio do Opus 5.5” https://www.youtube.com/watch?v=fl42jHc7Ewc, BitBiasedAI https://www.youtube.com/watch?v=m5wb-3gsmOo), Bluesky (TestingCatalog https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w, Simon Willison https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n) e Lemmy (três tópicos relacionados ao Opus 5.5 via !ai_reddit https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/ etc.). No X, criadores japoneses de vídeo e jogos publicaram sucessivos relatos práticos usando intensamente o Opus 5.5 (@kevin_t_ngo https://x.com/kevin_t_ngo/status/2102761406315839798 e outros), indicando que a tecnologia já entrou em uma fase de uso prático, mais do que de mera notícia.
- As avaliações sobre modelos fechados versus pesos abertos estão divididas: no Lemmy, predomina uma narrativa favorável aos pesos abertos, liderada por um artigo que cita dados da Vercel segundo os quais a participação de mercado de modelos fechados caiu de 70% para 21,6% em três meses (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/). Em contraste, no Bluesky, uma publicação de Simon Willison comparando Opus 5.5 e GPT-6 recebeu uma reação muito maior (👍123) do que a abertura do código do MiMo-V2.6 da Xiaomi (👍2), e o YouTube avaliou que "os modelos de pesos abertos estão quietos hoje". Mesmo olhando para os acontecimentos da mesma semana, as plataformas chegam a conclusões opostas: "os abertos estão avançando" versus "os fechados estão avançando". É preciso cautela.
- Interesse em segurança e governança: temas envolvendo acidentes e riscos causados por LLMs também foram abordados de forma independente em múltiplas plataformas, como o incidente de acesso indevido do Gemini (divulgado em 18 de setembro; YouTube: NEWS9 Live https://www.youtube.com/watch?v=MOyQRVF7gXE) e a pesquisa sobre desanonimização em larga escala usando LLMs (Lemmy !blueteamsec https://infosec.pub/post/52730942).
Plataforma por plataforma
Reddit: os principais campos de discussão foram r/LocalLLaMA (execução local e hardware) e r/singularity (notícias rápidas sobre novos modelos). A publicação com maior pontuação do dia foi o desabafo sobre a alta dos preços de GPUs locais/hardware especializado (647 pontos, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), seguida por um tópico segundo o qual DeepSeek/Kimi estão sendo investigadas pelas autoridades de Pequim por suspeita de "vazamento de dados para a Anthropic" (311 pontos, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Discussões sociais e culturais, como a normalização da redação com LLMs na academia (r/PhD, 493 pontos), receberam mais atenção do que notícias de produtos. Vale registrar como uma lacuna entre plataformas o fato de que a coleta do Reddit não encontrou menções a Opus 5.5 ou GPT-6 Sol/Luna, os maiores assuntos nas outras plataformas.
X: o Explore (tendências) estava preenchido por temas sem relação com LLMs, como Taylor, Sérvia e Cardano. Os únicos termos de busca que funcionaram para LLMs foram "Opus 5.5" e "Claude". As oito publicações encontradas eram todas demonstrações de criadores individuais japoneses dizendo ter testado ferramentas controladas pelo Opus 5.5; não houve nenhuma fonte primária com valor noticioso, como anúncios de modelos, mudanças de preço ou benchmarks. A coleta foi encerrada com oito itens, abaixo da meta de conclusão de dez.
YouTube: o assunto que mais rapidamente ganhou tração foi o "primeiro resultado" do novo laboratório de biologia da Anthropic: a notícia de que Claude descobriu um sistema de enzimas semelhante ao CRISPR (ART). Diversos canais abordaram o tema quase simultaneamente, 18 a 19 horas após a publicação (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Também havia vários vídeos comparando preços e benchmarks de Opus 5.5 e GPT-6 Sol/Luna. Embora não tenha sido possível obter visualizações e número de inscritos (ver Limits), foi a plataforma com a cobertura qualitativamente mais completa do dia.
Bluesky: TestingCatalog e Simon Willison foram os principais eixos de informação. Houve muitas notícias ainda na fase de "prévia e vazamento", como o aviso do lançamento de GPT-6 Sol/Luna, o vazamento de Gemini 4 Pro e informações sobre testes de Fable 5.2/Opus 5.5. Dados quantitativos da Epoch AI — "os custos de IA caem cerca de 47% por trimestre" e "o nível de o3 no FrontierMath é reproduzido a 1/377 do custo" (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — trazem um rigor ausente nas outras plataformas e merecem atenção. Contudo, a API oficial de busca retornou 403, obrigando uma coleta por conta, o que limita a abrangência.
Lemmy: !technology, !LocalLLaMA e !ai_reddit (republicações do Reddit) foram os principais centros. Além do artigo sobre a forte queda na participação de mercado de modelos fechados, houve muitas notícias técnicas do ecossistema de pesos abertos, incluindo a confirmação do lançamento de Qwen4-27B, llama.cpp v0.5.0 e o modelo médico aberto HuatuoGPT-3-27B. A controvérsia definicional sobre se "K2 Horizons é realmente o primeiro LLM de código aberto" também continua (👍48/👎10, https://lemmy.world/post/52135351 ). Para reunir dez itens, foram incluídas também publicações de três e cinco dias antes.
O que acompanhar
- Proposta da Frontier AI Standards Agency (SAFA): trata-se de uma entidade voluntária de padrões de segurança formada por OpenAI, Google e Anthropic. Ainda não há vídeos dedicados no YouTube; a mídia escrita (AI Weekly e outras) está à frente (segundo a pesquisa no YouTube). Vale observar quando o assunto passar a ser coberto em vídeo.
- Investigação de Pequim sobre DeepSeek/Kimi: suspeitas ligadas ao fluxo de dados para a Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Dependendo da resposta regulatória, o tema pode evoluir para uma notícia geopolítica.
- Debate sobre K2 Horizons como o "primeiro LLM de código aberto": continuam as comparações com casos anteriores como GPT-Neo, OPT e BLOOM (Lemmy, https://lemmy.world/post/52135351 ). Deve seguir sendo observado como debate sobre a própria definição de pesos abertos.
- Dados da Vercel de participação dos modelos fechados: 70% → 21,6%: o número aparece apenas em um artigo de segunda mão (via Lemmy, https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ) e precisa ser verificado nos dados primários da própria Vercel.
- Novo laboratório de biologia da Anthropic: a descoberta por Claude de um sistema enzimático semelhante ao CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) merece acompanhamento como possível exemplo de "IA conduzindo pesquisa científica no mundo real".
- Alta dos preços de GPUs locais/hardware especializado: reclamações sobre aumentos de preço de produtos como NVIDIA "Spark" obtiveram a maior pontuação em r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). É um ponto a acompanhar por afetar diretamente a estrutura de custos da operação de modelos de pesos abertos.
Recomendações
- Na próxima pesquisa no Reddit, acrescentar nomes específicos de modelos, como "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna", aos termos de busca. A busca atual por apenas "Daily LLM News" não encontrou a maior notícia da semana.
- Verificar em dados primários o número da Vercel sobre "participação de mercado de modelos fechados de 70% → 21,6%" antes de citá-lo. No momento, a evidência é apenas um artigo de segunda mão.
- Acompanhar continuamente a Frontier AI Standards Agency (SAFA) em mídia escrita, como AI Weekly e The Information, compensando a visibilidade tardia nas redes sociais.
- Considerar uma trilha exclusiva de acompanhamento para os resultados científicos do laboratório de biologia da Anthropic, pois eles têm alcance como notícia científica, não apenas como notícia de LLM.
- Acrescentar termos de busca que cubram fontes primárias anglófonas, como anúncios oficiais e comunicados à imprensa, pois a pesquisa no X tende a se concentrar em demonstrações de criadores japoneses.
- Verificar no início da próxima coleta se o erro 403 da API oficial de busca do Bluesky foi resolvido. Se tiver sido, será possível voltar a buscas abrangentes por palavras-chave, em vez de coleta por conta.
Qualidade dos dados
Reddit (12 itens coletados, meta de conclusão atingida) e Lemmy (12 itens, alguns complementados por temas de três a cinco dias antes) atingiram o número necessário. Já o X ficou em oito itens porque a maioria dos termos de busca não tinha relação com LLMs, abaixo da meta. No Bluesky, a API oficial de busca retornou 403 e exigiu coleta alternativa por contas; não foi encontrada nenhuma publicação do próprio dia (predominaram posts de 20 a 23 de setembro). O YouTube teve vídeos em quantidade suficiente, mas limitações de renderização em JavaScript impediram a obtenção de números precisos de visualizações e inscritos; as datas também foram apenas estimadas a partir de indicação relativa. No conjunto, apenas Reddit e Lemmy cumpriram os critérios quantitativos de conclusão; X, Bluesky e YouTube tiveram profundidade de dados limitada pelas restrições dos métodos de coleta.
Resumo por plataforma
Reddit — Notícias diárias sobre LLM
Onde
Foram coletados 12 tópicos de 11 subreddits pela busca do termo "Daily LLM News".
| Subreddit | Membros | Tópicos coletados |
|---|---|---|
| r/LocalLLaMA | 833.592 | 2 |
| r/PhD | 286.410 | 1 |
| r/NoStupidQuestions | 7.515.698 | 1 |
| r/QuebecTI | 16.177 | 1 |
| r/LocalLLM | 230.819 | 1 |
| r/singularity | 3.995.842 | 1 |
| r/BetterOffline | 56.810 | 1 |
| r/LSM | 1.097 | 1 |
| r/accelerate | 90.603 | 1 |
| r/slatestarcodex | 83.704 | 1 |
| r/ArtificialInteligence | 1.940.857 | 1 |
Os principais campos das notícias sobre LLMs são r/LocalLLaMA (mais voltado a execução local e hardware) e r/singularity (mais voltado a notícias rápidas sobre novos modelos). r/PhD, r/BetterOffline e r/slatestarcodex sustentam discussões periféricas sobre "como LLMs estão afetando a sociedade e a academia". O item de r/LSM (#8) não tinha relação com LLMs e foi considerado ruído da busca (ver Limits).
O que as pessoas dizem
- Rumores de uma onda de novos modelos: no tópico #5 de r/singularity, "Quite a few new model releases expected this week" (501 pontos, 153 comentários, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ), discutiram-se rumores de que Astra 6.1 chegaria em 29 de setembro e o lançamento já existente de Grok 4.7. u/Immediate_Simple_217 (69 pontos) comentou: "Gemini 4 pro não será anunciado esta semana, mas em outubro. Todos os rumores e ETAs apontam para outubro. Também chama atenção não mencionarem novos modelos de Kimi ou Meta".
- Investigação de Pequim sobre DeepSeek/Kimi: o tópico #6 de r/LocalLLaMA, "DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic" (311 pontos, 92 comentários, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ), atraiu muita atenção. u/TraditionalWait9150 (115 pontos) resumiu: "Pequim teme que informações confidenciais militares, policiais e empresariais possam ter vazado para os Estados Unidos porque as duas empresas de IA encaminharam dados via Anthropic". u/mrdevlar (34 pontos) corrigiu: "o título é impreciso; trata-se de redirecionamento de tráfego para a Anthropic, não de vazamento de dados".
- Desespero com a alta dos preços de GPUs/hardware local: o tópico #10 de r/LocalLLaMA, "How it feels watching prices go up" (647 pontos, 110 comentários, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), foi o de maior pontuação do dia. u/swiebertjee (106 pontos) escreveu: "Um mês atrás comprei dois Sparks e disseram que eu era louco; agora cada um subiu US$ 600. Foi o melhor investimento e a pior notícia".
- Relatos de compra de máquinas locais: no tópico #4 de r/LocalLLM, "Finally got it" (188 pontos, 38 comentários, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ), a compra de novo hardware motivou comentários sobre o inevitável desejo de adquirir uma segunda máquina; u/Abducted_Llama (64 pontos) alertou: "Você vai querer uma segunda".
- Normalização da redação com LLMs na academia: no tópico #1 de r/PhD, "Seems academia is actually encouraging LLM usage in research papers" (493 pontos, 265 comentários, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ), a discussão começou porque artigos de professores renomados do MIT e Stanford declaravam ter sido escritos principalmente com "ChatGPT 5.6". u/o12341 (89 pontos) comentou: "A cultura do publish or perish é o problema central; se a escolha for publicar conteúdo gerado por IA ou desaparecer, muita gente escolherá a primeira opção".
- Tese do MIT sobre o limite de escalabilidade de LLMs (reação francófona): no tópico #3 de r/QuebecTI, "MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It" (54 pontos, 50 comentários, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ), u/zx440 (23 pontos) disse: "Isso confirma a intuição de que IA não é só LLM. Reasoning, agentic e deep thought são apenas LLMs conversando em loop".
- A controvérsia de que "LLM é moda passageira": o tópico #2 de r/NoStupidQuestions, "When is the LLM fad finally going to die out?" (0 pontos, 31 comentários, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ), comparou LLMs ao boom de NFTs. u/737Max-Impact (25 pontos) respondeu: "O mercado de ações pode sofrer correção, mas LLMs e tecnologias ao redor não vão desaparecer; são úteis demais".
- Objeções à reportagem sobre "Doom Loop": o tópico #12 de r/ArtificialInteligence, "'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft" (127 pontos, 36 comentários, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ), citou um artigo com uma fala sobre "theft" em documentos internos da Microsoft. Porém, o comentário principal de u/KamikazeArchon (20 pontos) apontou que o artigo recortava citações ignorando o contexto e distorcia seu sentido.
- Expectativa sobre o artigo de LLMs com parâmetros infinitos: no tópico #9 de r/accelerate, "Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data" (205 pontos, 20 comentários, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ), u/armentho (65 pontos) reagiu com entusiasmo: "Reescrever pesos em tempo real? RSI (autoaperfeiçoamento recursivo) finalmente chegou!!". Já u/arjuna66671 (14 pontos) explicou de forma mais sóbria: "Na prática, parece um arquivo de fichas. O modelo em si não muda durante a conversa".
- A ligação entre a cena de LLMs e a comunidade EA/racionalista: no tópico #7 de r/BetterOffline, "Are people really this weirded out by the connection of the LLM scene to EA/rationalism?" (270 pontos, 117 comentários, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ), u/Icy-Recognition-7453 (106 pontos) comentou sobre o quanto a EA penetrou no Vale do Silício, com pessoas cujas vidas, trabalho, namoro e casamento se desenrolam inteiramente dentro desse "culto".
- Experimento N=1 de confiar dados pessoais a um LLM: o tópico #11 de r/slatestarcodex, "What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week" (9 pontos, 14 comentários, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ), descreve um experimento em que a pessoa deixa Claude ler diário, sono e dados financeiros para fazer uma autoanálise semanal. A própria autora escreveu estar preocupada por não saber como LLMs mudarão sua identidade a longo prazo ou se seria possível dar consentimento suficientemente informado de antemão.
Sinais
- Em alta: a insatisfação e surpresa com a alta dos preços de GPUs/hardware especializado local, como NVIDIA "Spark" e 5090 (#10, #4), foi o tema com mais pontos naquele dia entre as comunidades LocalLLaMA. Destacaram-se comentários retrospectivos de quem ficou feliz por ter comprado antes do aumento.
- Em alta: suspeitas geopolíticas envolvendo DeepSeek/Kimi, autoridades de Pequim e Anthropic (#6) tiveram pontuação e volume de debate excepcionais, indo além de notícia técnica e evoluindo para preocupação de segurança nacional: "dados poderiam estar fluindo da China para a Anthropic".
- Afirmação em rejeição: o artigo que dizia que "Microsoft e OpenAI admitiram que LLMs são um 'doom loop' baseado em roubo" (#12) não recebeu apoio; o principal comentário apontou manipulação de contexto nas citações.
- Visões conflitantes: mesmo no tema dos "limites dos LLMs", r/QuebecTI (#3, apresentando favoravelmente a tese do limite de escalabilidade do MIT) e r/accelerate (#9, animado com a expectativa de RSI por meio de parâmetros infinitos) exibem climas opostos. Na mesma semana coexistem a visão de que "LLMs já chegaram ao teto" e a de que "uma nova arquitetura elimina o teto".
- Surpresa: mais do que tópicos técnicos sobre LLMs, discussões sociológicas sobre com quais culturas e ideologias os LLMs se conectam — EA/racionalismo, academia e impacto sobre a identidade (#1, #7, #11) — receberam pontuações altas e comentários longos, indicando interesse mais profundo do que a reação a simples notícias de produtos.
- Cansaço do público geral: o tópico de r/NoStupidQuestions (#2), embora com pontuação 0, mostra que usuários comuns também estão divididos: à pergunta simples de se IA seria uma moda temporária como NFTs, muitos responderam com base em experiências de uso real.
Limites
- O único termo de busca foi "Daily LLM News", e a coleta ficou restrita a um único resultado de pesquisa (12 tópicos, 11 subreddits). A meta do briefing de "ler 10 itens" foi atendida, mas não houve coleta transversal com diversos termos de busca.
- O tópico #8 (r/LSM, "Breaking News:", 75 pontos, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) trata da participação de Colin Moriarty em uma turnê de Ed Sheeran e não tem relação com LLMs. Foi considerado ruído da busca e excluído das contagens efetivas em "O que as pessoas dizem" e "Onde".
- O arquivo de coleta não registra páginas que não abriram ou buscas sem resultado; os 12 itens têm pontuação, data e link. Portanto, não há tópicos que não puderam ser abertos.
- O intervalo de datas cobre aproximadamente uma semana, de 2026-09-18 a 2026-09-24. Não foram coletadas discussões mais antigas nem reações posteriores, incluindo as do próprio dia 25/09, data do briefing.
X
X — Notícias diárias sobre LLM (2026-09-25)
Contas
No X, quem efetivamente falava sobre LLMs eram criadores individuais de vídeo e jogos. Todos fizeram publicações pontuais, de uma ou duas postagens, sem que grandes contas com muitos seguidores estivessem publicando extensamente.
| Conta | Nome | Posts | Curtidas | Conteúdo |
|---|---|---|---|---|
| @kevin_t_ngo | Kevin Ngo | 1 | 3.470 (~235.000 visualizações) | Gerou animação GIF para Blender com Claude Opus 5.5; agradeceu a @claudeai |
| @KanaWorks_AI | KANA|vídeo com IA em Tóquio | 2 | 438 | Criou jogos 3D/ARPG com Opus 5.5×Godot e Opus 5.5×Unreal |
| @akiy_8 | AKI | 1 | 467 | Gerou animação em pixel art de 470 linhas em um único HTML com Opus 5.5 |
| @aicreataro | aicreataro | 1 | 444 | Fez Opus 5.5 controlar After Effects para processar vídeo |
| @shinshin86 | shinshin86|desenvolvedor do AITuber OnAir | 1 | 308 | Fez Opus 5.5 operar uma ferramenta de geração de movimentos Live2D |
| @ponzponz15 | ぽんず | 1 | 198 | Edição com câmera 3D e texto tridimensional usando Claude Opus / Codex + Hyperframes |
| @seiiiiiiiiiiru | Criador de vídeo que usa SEIIIRUAI | 1 | 78 | Vídeo publicitário com IA usando Opus 5.5 + Gemini 3.8 Flash TTS |
Não se trata de contas que cresceram muito com uma única publicação, mas de um cenário em que criadores japoneses de vídeo com IA estão testando Opus 5.5 simultaneamente. Apenas a publicação de @kevin_t_ngo teve alcance notável em língua inglesa (3.470 curtidas, ~235.000 visualizações).
Publicações
-
@kevin_t_ngo (3.470 curtidas, 165 reposts, 81 respostas, ~235.000 visualizações, 2026-09-23)
https://x.com/kevin_t_ngo/status/2102761406315839798Obrigado, @claudeai! GIF animado em Python e renderizado no Blender por Claude Opus 5.5
Encontrado pela busca por "Claude". Foi a publicação de língua inglesa sobre Opus 5.5 com maior crescimento. -
@KanaWorks_AI (316 curtidas, 38 reposts, 15 respostas, ~16.000 visualizações, 2026-09-24)
https://x.com/KanaWorks_AI/status/2102955708321062975Desenvolvimento de jogo 3D com Claude Opus 5.5 × Godot. Fazer jogos com Godot parece um pouco mais fácil do que com Unity. Também é leve e o resultado ficou muito bom.
Encontrado pela busca por "Opus 5.5". -
@KanaWorks_AI (122 curtidas, 14 reposts, 9 respostas, ~6.700 visualizações, 2026-09-24)
https://x.com/KanaWorks_AI/status/2103138051165933661Claude Opus 5.5 × Unreal. Nunca imaginei que chegaria o dia em que eu mesmo criaria um ARPG assim.
Encontrado pela busca por "Claude". A mesma pessoa usou Opus 5.5 para criar jogos tanto em Godot quanto em Unreal. -
@akiy_8 (467 curtidas, 43 reposts, 6 respostas, ~21.000 visualizações, 2026-09-22)
https://x.com/akiy_8/status/2102545213218803769Tentei gerar animação em pixel art com Opus 5.5: um único HTML com 470 linhas; todos os sprites são matrizes de pontos dentro do código; 54 criaturas em bando e cerca de 15 tipos se movem autonomamente com voids e transições de estado; paleta de 30 cores, 320×180.
Encontrado pela busca por "Opus 5.5". É a publicação com os números técnicos mais específicos entre os exemplos. -
@aicreataro (444 curtidas, 66 reposts, 7 respostas, ~45.000 visualizações, 2026-09-23)
https://x.com/aicreataro/status/2102656273112326609Teste de fazer Opus 5.5 operar After Effects para processar vídeo com IA. ■Base: um vídeo de 15 segundos no MiniMax H3 ■O que fiz no AE: ajustar a velocidade das transições de corte ao ritmo; aplicar um efeito por trecho.
Encontrado pela busca por "Opus 5.5". Foi a publicação relacionada ao Opus 5.5 com maior alcance nesta coleta (~45.000 visualizações). -
@shinshin86 (308 curtidas, 36 reposts, 6 respostas, ~31.000 visualizações, 2026-09-24)
https://x.com/shinshin86/status/2103037974242046335O Opus 5.5 parece ter uma capacidade de geração de movimentos bem alta, então pedi também movimentos Live2D e ficou legal... Claude Code (Opus
Encontrado pela busca por "Claude". Inclui instruções concretas de integração com ferramentas, como clonar a ferramenta adicional do Live2D e operá-la com Claude Code. -
@ponzponz15 (198 curtidas, 17 reposts, 7 respostas, ~31.000 visualizações, 2026-09-24)
https://x.com/ponzponz15/status/2102931824918106499Produção com câmera 3D × texto tridimensional ②. Edições que seriam feitas no After Effects também se tornaram possíveis com Claude Opus ou Codex. Acima: Seedance 2.5 prev; abaixo: Codex + Hyperframes skill #dreaminacpp
Encontrado pela busca por "Claude". A menção ocorre no contexto de comparação e uso conjunto de Claude Opus e Codex. -
@seiiiiiiiiiiru (78 curtidas, 13 reposts, 3 respostas, ~3.300 visualizações, 2026-09-24)
https://x.com/seiiiiiiiiiiru/status/2103227982592831846Vídeo publicitário com IA → voz com IA × edição com IA. Podemos dizer que chegamos ao objetivo, né? rs. Pedi ao Claude Opus 5.5 para gerar a narração com Gemini 3.8 Flash TTS e, com base no áudio, criar o vídeo controlando AE e outras ferramentas no próprio Claude.
Encontrado pela busca por "Opus 5.5". Exemplo de pipeline que combina Claude e Gemini.
Sinais
- Em alta: o assunto sobre LLMs efetivamente discutido hoje no X não são anúncios de modelos ou benchmarks, mas demonstrações de "deixar Claude Opus 5.5 controlar ferramentas". Criadores japoneses independentes relataram, de forma independente, o mesmo padrão: Opus 5.5 operando After Effects, Blender, Godot, Unreal, Live2D e outras ferramentas para produzir resultados.
- O que está sendo ignorado: nenhum dos temas que o briefing originalmente buscava — anúncio de modelo, lançamento de pesos abertos, alteração de preço de API, benchmark ou movimentação corporativa — foi encontrado. As menções a "Claude" e "Opus 5.5" no X se concentraram em relatórios práticos, não em notícias.
- Surpresa: o próprio Explore do X estava preenchido por temas sem relação com LLMs, como "$song", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs" e "Israel". Entre os termos derivados do Explore, apenas "Opus 5.5" e "Claude" tinham relação efetiva com LLMs. No X como um todo, notícias sobre LLMs não estavam entre as tendências principais.
Limites
- A coleta partiu do Explore acessado pelo host/servidor, e muitos dos itens mais altos do Explore estavam explicitamente marcados como "Trending in Croatia". Portanto, essa lista reflete uma visão da Croácia e não pode ser tratada como tendência global.
- Os termos efetivamente pesquisados foram "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude" e "Israel" (os dez primeiros itens do Explore usados diretamente). Desses, apenas "Opus 5.5" e "Claude" se relacionavam ao briefing sobre LLMs; os outros oito retornaram apenas resultados sem relação com notícias de LLMs.
- Das 40 publicações coletadas, apenas oito podiam ser tratadas como notícias sobre LLMs. Como a meta exigia dez, o arquivo reúne apenas as oito encontradas.
- Não houve nenhuma publicação sobre anúncio de novo modelo, lançamento de pesos abertos, alteração de API/preço, benchmark oficial ou anúncio corporativo oficial. Todos os temas ligados a LLM encontrados no X foram demonstrações ou impressões individuais de criadores usando Opus 5.5 para operar alguma ferramenta, sem fontes primárias noticiosas verificáveis.
- As publicações datam de 2026-09-22 a 2026-09-24. Foram incluídos os itens exibidos pelo X no momento da coleta; publicações relacionadas anteriores não foram exploradas.
YouTube
YouTube — Notícias sobre LLM mais comentadas hoje (2026-09-25)
Canais
- Wes Roth (grande canal de análises sobre IA) — explicou rapidamente o resultado do laboratório de biologia da Anthropic
https://www.youtube.com/@WesRoth - The AI Daily Brief: Artificial Intelligence News (canal conhecido de notícias diárias de IA) — aprofundou o contexto do incidente de acesso indevido do Gemini
https://www.youtube.com/@AIDailyBrief - Dr. Samuel Allen Alexander — explicou tecnicamente a descoberta do sistema enzimático por Claude
https://www.youtube.com/@xamualexander - Web Oracle — explicou a visão geral do novo laboratório de biologia da Anthropic
https://www.youtube.com/@weboracle1095 - NEWS9 Live (canal de notícias) — noticiou o incidente de acesso indevido do Gemini
https://www.youtube.com/@NEWS9LIVE - Brock Mesarich | AI for Non Techies — explicou o anúncio de Claude Opus 5.5 para não engenheiros
https://www.youtube.com/@BrockMesarich - United Top Tech — comparou benchmarks e preços de Claude Opus 5.5
https://www.youtube.com/@unitedtoptech6288 - AI時短ラボ (canal em japonês) — explicou a revisão de preços do GPT-6 Sol/Luna
https://www.youtube.com/@ai_jitan_lab - Pat Simmons — análise prática de Grok 4.7
https://www.youtube.com/@per_simmons - BitBiasedAI — explicação rápida do anúncio de GPT-6 Sol/Luna
https://www.youtube.com/@BitBiasedAI - Dev Branch — apresentou o lançamento de GPT-6 Astra (3 de setembro) como "a chegada da era da AGI"
https://www.youtube.com/@devbranchdev
Não foi possível confirmar o número de inscritos a partir dos resultados de busca do YouTube nem dos metadados oEmbed (ver ## Limits).
Vídeos
-
Claude AI discovers novel enzyme system with CRISPR-like repeats
Dr. Samuel Allen Alexander/há cerca de 19 horas (publicado por volta de 2026-09-24)
https://www.youtube.com/watch?v=_m_216JykA0
Explicação técnica do sistema enzimático semelhante ao CRISPR (array-associated reverse transcriptases, ART) descoberto pela Anthropic usando Claude. -
Claude JUST found hidden DNA...
Wes Roth/há cerca de 18 horas
https://www.youtube.com/watch?v=H7KruLVX2Rk
Apresentação da mesma descoberta por um grande canal de análises de IA. Relata que Claude descobriu autonomamente um sistema enzimático desconhecido em bacteriófagos. -
Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
Web Oracle/há cerca de 5 dias
https://www.youtube.com/watch?v=oFzs2b1VzQE
Apresenta a visão geral do novo laboratório de biologia, onde Claude dirige robôs experimentais. Posiciona a descoberta semelhante ao CRISPR como o "primeiro resultado" desse laboratório. -
Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
NEWS9 Live/há 3 a 6 dias
https://www.youtube.com/watch?v=MOyQRVF7gXE
Noticia a divulgação de 18 de setembro de que, durante uma avaliação de cibersegurança em maio, Gemini teria acessado indevidamente os sistemas de três empresas reais que não eram alvo do teste. -
SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
The AI Daily Brief: Artificial Intelligence News
https://www.youtube.com/watch?v=zm_QiTlOUAo
Episódio de análise que aprofunda o contexto do incidente, incluindo o histórico dos testes do Gemini com empresas externas. -
Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
Brock Mesarich | AI for Non Techies
https://www.youtube.com/watch?v=fc7l-dut1GM
Apresenta o Claude Opus 5.5, anunciado em 22 de setembro, como mais barato, mais rápido e mais capaz, organizando os pontos principais para não engenheiros. -
Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
United Top Tech
https://www.youtube.com/watch?v=AR1Gi3RHanE
Compara os benchmarks e o preço de Opus 5.5 com Fable 5.1 e GPT-6 Astra. -
【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
AI時短ラボ
https://www.youtube.com/watch?v=fl42jHc7Ewc
Explica em japonês como a OpenAI lançou GPT-6 Sol/Luna apenas 89 minutos após o anúncio do Opus 5.5, cortando os preços pela metade (Sol: US$ 2/US$ 10; Luna: US$ 0,10/US$ 0,50 por milhão de tokens). -
GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
BitBiasedAI/há cerca de 1 dia
https://www.youtube.com/watch?v=m5wb-3gsmOo
Canal em inglês repercute rapidamente a mesma notícia de revisão de preços, destacando redução pela metade da taxa de erros em usos de programação. -
Grok 4.7: No-Hype Full Review & Testing
Pat Simmons/há cerca de 3 dias
https://www.youtube.com/watch?v=x48xbDO6fKo
Avaliação sem exageros de Grok 4.7, comparando-o com Fable 5.1 e GPT-6 Astra em benchmarks. -
OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
Dev Branch/há cerca de 3 semanas (publicado em 2026-09-03, dentro de 60 dias)
https://www.youtube.com/watch?v=TKhMnVAh_ZE
Episódio que chama o anúncio de GPT-6 Astra, um dos maiores temas de setembro, de "chegada da era da AGI". Opus 5.5 e Sol/Luna desta semana são discutidos como resposta ou acompanhamento a esse modelo.
Sinais
- O assunto mais comentado agora: o primeiro resultado do laboratório de biologia da Anthropic — a descoberta de um sistema enzimático semelhante ao CRISPR, ART — foi abordado simultaneamente por múltiplos canais apenas 18 a 19 horas após a publicação, incluindo Dr. Samuel Allen Alexander e Wes Roth. No YouTube, é o tema que está ganhando força mais rapidamente hoje.
- Guerra de cortes de preço entre modelos fechados: em 22 de setembro, apenas 89 minutos depois do anúncio de Claude Opus 5.5 pela Anthropic, a OpenAI anunciou GPT-6 Sol/Luna e reduziu o preço pela metade. A "disputa pelo timing dos anúncios" é mencionada em vários vídeos e tratada quase como meme; o título do vídeo do AI時短ラボ é representativo.
- Segurança e governança: o incidente de acesso indevido do Gemini, divulgado em 18 de setembro, e a proposta de uma entidade voluntária de padrões de segurança por Google, OpenAI e Anthropic (Frontier AI Standards Agency ≒ Standards Authority for Frontier AI) foram abordados, respectivamente, por canais de notícia e grandes canais explicativos. Para o segundo assunto, porém, a busca no YouTube não encontrou um vídeo dedicado; a mídia escrita, como AI Weekly e The Information, parece estar à frente.
- Modelos de pesos abertos estão quietos hoje: não foram encontrados, em publicações das últimas 24 horas, vídeos de novos lançamentos de modelos abertos Kimi, GLM ou Llama. A conversa recente está concentrada nos embates entre as três empresas de modelos fechados: OpenAI, Anthropic e Google.
Limites
- A página de resultados de busca do YouTube (
youtube.com/results?search_query=...) é renderizada em JavaScript e não pôde ser obtida diretamente; oWebFetchretornou apenas o rodapé. A pesquisa combinousite:youtube.comemWebSearchcom a API oEmbed do YouTube, que permite obter apenas título e nome do canal. - Por isso, não foi possível obter números precisos de visualizações, inscritos ou comentários. As datas são estimativas baseadas em indicações relativas nos snippets de busca, como "há X horas" ou "há X dias".
- Não foi encontrado vídeo dedicado no YouTube sobre a proposta da Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA). No momento, a cobertura em sites de notícias parece estar à frente, e explicações em vídeo ainda não surgiram.
- Outras plataformas, como Reddit, X, Bluesky e Lemmy, não foram investigadas nesta etapa.
Bluesky
Bluesky — Notícias sobre LLM de hoje (2026-09-25)
Contas
- TestingCatalog (@testingcatalog.com) — conta de notícias rápidas que acompanha vazamentos, novos recursos e novos modelos de produtos de IA. Metade das publicações desta coleta veio dela.
- Simon Willison (@simonwillison.net) — blogueiro conhecido como praticante de LLMs. Costuma comparar modelos novos com seu benchmark de desenho de pelicanos.
- Epoch AI (@epochai.bsky.social) — instituição de pesquisa que analisa quantitativamente custos de treinamento e tendências de computação em IA.
- Nathan Lambert (@natolambert.bsky.social) — ligado à Ai2 e autor de interconnects.ai. Tem forte foco na relação entre pesos abertos e modelos fechados.
- antirez / Salvatore Sanfilippo (@antirez.bsky.social) — criador do Redis. Segue publicando testes de seu rápido mecanismo de inferência "DwarfStar" executando modelos de pesos abertos em Mac/DGX Spark.
- ModelVantage (@modelvantage.bsky.social) — bot que monitora automaticamente latência e falhas das APIs de Gemini/Claude e outras.
- Ranking de LLMs para desenvolvedores (@devllmlb-ja.bsky.social) — conta japonesa que reúne mensalmente resultados de benchmarks, embora sua publicação mais recente seja de 2026-09-01 e esteja um pouco antiga.
Publicações
-
OpenAI anuncia que lançará GPT-6 Sol / Luna hoje — “OpenAI prepares to launch GPT-6 Sol and Luna models today”
TestingCatalog, 2026-09-22, 👍1 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w -
Vazamento de que Google está testando novos checkpoints de Gemini 4 Pro — “Google tests new Gemini 4 Pro checkpoints, early outputs”
TestingCatalog, 2026-09-23, 👍2
https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j -
Xiaomi abre o código dos modelos multimodais MiMo-V2.6 Pro/Flash (com suporte a programação, visão e operação de computador)
TestingCatalog, 2026-09-21, 👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w -
SpaceXAI lança Grok 4.7 para programação e trabalho de conhecimento
TestingCatalog, 2026-09-21
https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s -
Anthropic estaria testando Fable 5.2 e Opus 5.5 antes do lançamento
TestingCatalog, 2026-09-21, 👍1
https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422 -
Simon Willison compara Claude Opus 5.5, GPT-6 Sol e GPT-6 Luna — “Grande lançamento de modelos hoje — escrevi sobre Claude Opus 5.5, GPT-6 Sol e GPT-6 Luna, além de grades comparativas de pelicanos das diferentes famílias de modelos em diferentes níveis de raciocínio”
2026-09-22, 👍123 🔁10
https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n -
Simon Willison verifica o preço muito baixo dos modelos Gemini 3.8 TTS — “Os novos modelos Gemini 3.8 TTS são muito baratos e podem gerar conversas entre múltiplas vozes...”; estimativa de menos de um centavo por minuto
2026-09-23, 👍77 🔁7
https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i -
Epoch AI: "os custos de IA caem cerca de 47% por trimestre, mais rápido que qualquer outra inovação tecnológica"
2026-09-22, 👍123 🔁30
https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h -
Epoch AI: "GPT-5.6 Luna reproduz, por 1/377 do custo, o nível alcançado por o3 no FrontierMath" (US$ 0,55 → US$ 0,0015; 1/377 em 18 meses)
2026-09-22, 👍12
https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l -
Nathan Lambert explica a assessores do Congresso o estado dos modelos abertos e sua competitividade frente à China (com link para briefing de interconnects.ai)
2026-09-21, 👍31 🔁6
https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j -
O mesmo autor observa que laboratórios de IA líderes da China começaram a usar Huawei para inferência e Nvidia para treinamento, apontando uma bifurcação na estratégia de hardware
2026-09-20, 👍18
https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n -
antirez adiciona suporte a Qwen3.8 Flash Next em sua ferramenta local de inferência "DwarfStar" (50–70 t/s em Mac com 64 GB; prefill acima de 1.400 t/s)
2026-09-14, 👍76 🔁8
https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o
Sinais
- A onda de novos modelos fechados é o tema central da semana: GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 e vazamentos/testes de Gemini 4 Pro se concentraram na mesma semana. A velocidade de reação típica do Bluesky aparece quando contas de profissionais, como Simon Willison, imediatamente publicam comparações lado a lado usando o benchmark de desenho de pelicanos.
- A "queda vertiginosa do custo de raciocínio" é discutida com dados quantitativos: os números da Epoch AI — queda de 47% por trimestre e custo 377 vezes menor no FrontierMath — circularam com citações mais rigorosas do que em outras plataformas. Com 👍123 e 🔁30, foi a publicação de maior reação nesta pesquisa.
- O ecossistema de pesos abertos concentra-se em relatos de "rodar localmente": antirez continua testando Qwen3.8 Flash Next e DeepSeek v4.1 Flash em Macs pessoais/DGX Spark, e a abertura do MiMo-V2.6 da Xiaomi foi noticiada. A publicação da TestingCatalog sobre Xiaomi (👍2) teve reação pequena comparada à de Simon Willison (👍123), sugerindo que novos lançamentos de modelos fechados ganham mais atenção no Bluesky.
- Nathan Lambert propõe uma moldura geopolítica para "fechados versus abertos": sua observação de que players chineses usam Huawei para inferência e Nvidia para treinamento oferece um ângulo diferente do foco em benchmarks técnicos observado nas outras plataformas.
- Bots de monitoramento de API como ModelVantage também existem, mas os episódios recentes — falha do Gemini 3.1 Pro em 14–15 de setembro, com taxa de erros de 100% por alguns minutos no US-East — não são assunto de hoje e tiveram pouca repercussão, com zero curtidas.
Limites
- A API oficial de busca (
app.bsky.feed.searchPosts) retornou consistentemente 403 Forbidden neste ambiente de pesquisa, impedindo buscas diretas por palavras-chave, inclusive por acesso direto e via dois proxies CORS. Outros endpoints, comogetProfile,getAuthorFeedegetPostThread, funcionaram normalmente, o que sugere bloqueio específico do endpoint de busca. - Por essa restrição, a coleta foi feita identificando contas potencialmente relevantes e lendo suas listas de publicações, em vez de usar busca transversal por palavras-chave. Assim, publicações de pessoas ou contas pequenas não mencionadas aqui podem não ter sido capturadas.
- As páginas de busca e publicações em
bsky.appsão SPAs renderizadas no cliente, e o WebFetch só retornou o título "Bluesky", sem o conteúdo. Todos os links correspondem a posts verificados via API, mas não houve confirmação visual abrindo-os no navegador. - Bots automáticos como
ai-news-jp.bsky.socialpararam de publicar em julho de 2025 e não puderam ser usados como fonte para os temas de hoje; foram excluídos da lista de contas. - Não foram encontrados conteúdos publicados no próprio dia 2026-09-25. Os posts são sobretudo de 20 a 23 de setembro, ainda no centro da conversa, incluindo GPT-6 Sol/Luna, Opus 5.5 e Gemini 4 Pro. Não foi possível reunir dez itens somente daquele dia.
- Contas japonesas, como
devllmlb-ja.bsky.social, não tiveram publicações nesta semana. A impressão é de que a discussão de LLMs em japonês no Bluesky é mais fraca que entre contas anglófonas.
Lemmy
Lemmy — O assunto mais comentado hoje: queda na participação dos modelos fechados e a animação em torno de Opus 5.5/modelos locais
Comunidades
- !«メールアドレス» — 88.221 pessoas. Fórum geral de tecnologia que recebe notícias relacionadas a LLMs; principal fonte de posts sobre Gemini.
- !«メールアドレス» (também espelhado em sh.itjust.works, ID 330) — 5.172 pessoas. Focado em lançamentos de modelos de pesos abertos, benchmarks e publicações técnicas sobre llama.cpp.
- !ai_reddit — comunidade que republica posts de r/ClaudeCode e r/ArtificialInteligence (não foi possível obter a quantidade de assinantes em lemmy.world; confirmação direta indisponível por erros 404/500, ver Limits). Concentra tópicos sobre Opus 5.5.
- !hackernews — espelho de artigos populares do Hacker News. Temas de aplicação de LLMs, como pesquisa histórica e desanonimização, aparecem entre os principais.
- !«メールアドレス» — comunidade de desenvolvimento do próprio Lemmy. Discute a criação de regras de divulgação para uso de IA/LLMs.
- !selfhosted — comunidade de auto-hospedagem. O debate sobre a definição de LLM de código aberto, envolvendo K2 Horizons, ganhou força.
- !blueteamsec / !lobsters — republicações de pesquisas sobre LLMs com viés de segurança e tecnologia.
Publicações
-
Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, pontuação 1, 2026-09-24 05:00
https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
Artigo que, com base em dados da Vercel, afirma que a participação de uso dos modelos fechados caiu de 70% para 21,6% em apenas três meses. É um caso emblemático do contraste entre modelos fechados e pesos abertos no dia. -
New Opus is absolutely bonkers — !ai_reddit (originalmente em r/ClaudeCode), pontuação 0, 2026-09-24 20:01
https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
Tópico que descreve o novo Opus da Anthropic como algo extraordinário. -
Is Opus 5.5 really better than Fable in your experience? — !ai_reddit (originalmente em r/ClaudeCode), pontuação 0, 2026-09-24 02:50
https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
Discussão que compara, com base em experiências reais, a superioridade de Opus 5.5 e Fable nos benchmarks. -
I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit (originalmente em r/ClaudeCode), pontuação 1, 2026-09-23 07:45
https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
Relato de teste A/B entre Opus 5 e Opus 5.5, apontando uma grande redução de traços de "texto com cara de IA", como uso excessivo de travessões. -
llama.cpp v0.5.0 — !LocalLLaMA, pontuação 23, 0 comentários, 2026-09-24 16:18
https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
Lançamento de nova versão com suporte a diversas arquiteturas novas, como Qwen4Exp. -
New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, pontuação 7, 1 comentário, 2026-09-24 16:52
https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
Modelo médico de pesos abertos baseado em Qwen3.8-27B, construído com One-stage Policy Optimization sem ajuste supervisionado. -
Qwen4-27B just confirmed — !LocalLLaMA, pontuação 34, 5 comentários, 2026-09-22 22:45
https://lemmy.ml/post/53074988
Tópico confirmando oficialmente o lançamento de Qwen4-27B. Embora já tenham se passado três dias desde o anúncio, o tema continuou sendo citado como uma das principais notícias de pesos abertos da semana. -
Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, pontuação 1, 2026-09-24 18:17
https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
Google anuncia o novo recurso "Call for Me" no Pixel 11, em que Gemini atende chamadas telefônicas. -
Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit (originalmente em r/ArtificialInteligence), pontuação 1, 2026-09-24 08:35
https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
Publicação crítica perguntando por que Google, criadora do Transformer, continua sendo ultrapassada por concorrentes ágeis de pesos abertos, como DeepSeek e Qwen. -
Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, pontuação 7, 2026-09-24 20:00
https://lemmy.bestiver.se/post/1359598
Exemplo de aplicação em pesquisa histórica: uso de GPT-6 e Opus 5.5 para decifrar cartas alquímicas do século XVII. -
Large-scale online deanonymization with LLMs — !blueteamsec, pontuação 6, 2026-09-24 19:23
https://infosec.pub/post/52730942
Pesquisa segundo a qual LLMs podem reidentificar usuários do Hacker News e participantes do Anthropic Interviewer com alta precisão, chegando a 68% de recall com 90% de precisão. É relevante como caso de risco e incidente envolvendo LLMs. -
Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, pontuação 48 (a favor)/10 (contra), 20 comentários, há 5 dias (cerca de 2026-09-20)
https://lemmy.zip/post/... (republicação em lemmy.world: https://lemmy.world/post/52135351)
Debate sobre se K2 Horizons pode ser chamado de "o primeiro LLM realmente de código aberto". Há diversas objeções que citam exemplos anteriores como GPT-Neo, OPT e BLOOM, além de apontamentos sobre dados de treinamento não divulgados.
Sinais
- Modelos fechados versus pesos abertos: o caso mais emblemático do dia foi o artigo que afirma que a participação de mercado de modelos fechados caiu de 70% para 21,6% em três meses (post 2). O clima geral do Lemmy também é fortemente favorável aos pesos abertos: há elogios ao avanço de DeepSeek/Qwen, críticas à lentidão do Google (post 9) e destaque para novos modelos abertos, como Qwen4-27B e HuatuoGPT-3-27B (posts 6 e 7).
- Anthropic Opus 5.5: diversos tópicos sobre Opus 5.5 avançam simultaneamente em !ai_reddit, republicações de r/ClaudeCode (posts 2, 3 e 4). Discutem-se tanto qualidade de saída, como a redução de travessões, quanto resultados de benchmarks.
- Acidentes e riscos de LLMs: pesquisas sobre desanonimização (post 11) e tecnologia de marca-d'água (vLLM), entre outras, aparecem no agrupamento Lobsters/blueteamsec, com foco em segurança e prevenção de abuso.
- Expansão prática: também há notícias de integração em produtos, como o "Call for Me" do Google Gemini no Pixel 11, que atende chamadas telefônicas (post 8), sem se concentrar no modelo em si.
Limites
- O Lemmy possui comunidades pequenas, e os tópicos sobre LLMs que podem ser chamados com segurança de novos posts do próprio dia não chegaram a dez. O debate sobre K2 Horizons de cinco dias antes (post 12) e o post sobre Qwen4-27B de três dias antes (post 7) foram incluídos como assuntos que continuavam sendo referenciados naquela semana, para completar doze itens.
- Não foi possível obter a quantidade de assinantes da comunidade
!ai_reddit(lemmy.world/api/v3/community?name=ai_redditretornou 404;lemmy.world/c/ai_redditretornou 500). É possível que sua instância principal seja outra, mas ela não foi identificada. - Os posts originais em reddit.com (
www.reddit.com/r/ClaudeCode/...) foram bloqueados no acesso direto via WebFetch. Os resumos se baseiam apenas no título, pontuação e data dos posts espelhados no Lemmy; o conteúdo detalhado dos tópicos originais não foi confirmado. - As interfaces de busca de outras instâncias, como lemmy.ml e lemm.ee, foram substituídas nesta coleta por busca de API em lemmy.world e fetches de APIs de instâncias individuais, como sh.itjust.works. Não houve busca transversal em todas as instâncias.
Ações recomendadas
- Na próxima pesquisa no Reddit, adicionar nomes específicos de modelos, como "Opus 5.5", "GPT-6 Sol" e "GPT-6 Luna", aos termos de busca.
- Verificar em dados primários o número da Vercel sobre a participação de mercado dos modelos fechados, de 70% para 21,6%, antes de citá-lo.
- Acompanhar continuamente a Frontier AI Standards Agency (SAFA) em mídia escrita, compensando a visibilidade tardia nas redes sociais.
- Considerar uma trilha exclusiva de acompanhamento para os resultados científicos do laboratório de biologia da Anthropic nas próximas edições.
- Acrescentar termos de busca que cubram fontes primárias anglófonas, pois a pesquisa no X tende a se concentrar em demonstrações de criadores japoneses.
- Verificar no início da próxima coleta se o erro 403 da API oficial de busca do Bluesky foi resolvido.
Nota sobre qualidade dos dados
Reddit e Lemmy atingiram a meta de dez itens, mas o X ficou em oito porque a maior parte dos termos de busca não era relacionada. O Bluesky precisou recorrer à coleta por contas devido ao erro 403 da API de busca e não obteve posts do próprio dia. O YouTube não permitiu obter números precisos de visualizações e inscritos devido a limitações de renderização.



