Notícias diárias de LLM — 2026-09-11
A controvérsia sobre a saída da indústria e as declarações sobre risco de extinção feitas por investigadores de IA tornou-se, de forma independente, o principal tema do dia no Reddit, Bluesky e Lemmy. Ao mesmo tempo, modelos de pesos abertos como DeepSeek V4.1-Flash e GLM-5.3 continuam a atualizar benchmarks a um ritmo que parece aproximá-los do GPT-6 Astra.
Notícias diárias de LLM — 11 de setembro de 2026
O que se destaca ao observar hoje as redes sociais é que, mais do que as chamativas demonstrações de desempenho de novos modelos, o protagonista foi a «desconfiança em relação à segurança». A controvérsia em torno da saída da indústria e das declarações sobre risco de extinção de um investigador da Anthropic incendiou-se simultaneamente no Reddit, Bluesky e Lemmy. Juntamente com as suspeitas de plágio relacionadas com o anúncio da OpenAI sobre um «problema do Prémio Millennium», o ceticismo em relação aos modelos fechados tornou-se uma corrente subterrânea nas redes sociais. Por outro lado, os modelos de pesos abertos — DeepSeek V4.1-Flash, GLM-5.3 e Qwen 3.8 Max — renovaram benchmarks em rápida sucessão. YouTube, Bluesky (com o «Latest open artifacts» de Nathan Lambert) e a comunidade de execução local no Lemmy confirmam independentemente esta tendência. Apenas o X praticamente não captou notícias sobre LLMs devido a problemas no desenho das pesquisas, ficando soterrado por tendências de política e entretenimento.
Entre plataformas
- A «saída da indústria por motivos de segurança e declarações sobre risco de extinção» tornou-se o maior tema, de forma independente, em três plataformas. No Reddit (r/ArtificialInteligence, notícia sobre a saída do investigador da Anthropic Jacob Coxon, embora com reação fria), no Bluesky (Nathan Lambert, Emily Bender e Gary Marcus abordaram o tema, mencionando uma estimativa de 10% de risco de extinção) e no Lemmy (a publicação com score 61, a maior da amostra, na comunidade !fuck_ai), comunidades com posições diferentes desenvolveram debates sobre segurança a partir do mesmo episódio.
- A desconfiança em relação às empresas de modelos fechados e a crítica à «captura regulatória» atravessam as plataformas. O Reddit (forte reação de r/LocalLLaMA a um artigo do WSJ crítico dos pesos abertos, com comentário apoiado por 556 pontos) e o X (a publicação sarcástica de @johnennis sobre «não haver alternativa senão dar à Anthropic um monopólio regulatório») contam, de forma independente, a mesma narrativa: «empresas fechadas = interesses instalados que usam a regulação como escudo».
- O impulso dos modelos de pesos abertos é confirmado a partir de três direções: YouTube, Bluesky e Lemmy. GLM-5.3 (vídeos de benchmark no YouTube e «Latest open artifacts» de Nathan Lambert no Bluesky) e modelos Qwen (Qwen 3.8 Max no YouTube e tópicos de quantização local no Lemmy) surgem em comum. É possível confirmar o mesmo fenómeno de ângulos distintos: «modelos abertos com desempenho de fronteira são atualizados a cada poucos dias».
- O anúncio da OpenAI relacionado com Navier–Stokes (um problema do Prémio Millennium) foi recebido com ceticismo. O tema é mencionado tanto no Reddit (discussão sobre suspeitas de plágio, 187 pontos) como no Bluesky (relato de implementação de Simon Willison com 283 gostos e crítica de Emily Bender à comunicação científica), mas a dúvida supera o elogio.
Plataforma a plataforma
Reddit: foram recolhidos 12 tópicos em 10 subreddits com a pesquisa «Daily LLM News». Os principais temas foram as suspeitas de plágio em torno de uma descoberta matemática da OpenAI (r/singularity, 187 pontos) e a forte reação contra um artigo do WSJ crítico de pesos abertos (r/LocalLLaMA, 512 pontos). A reação à notícia sobre a saída da indústria de um investigador da Anthropic foi fria e marcada pelo sarcasmo. https://www.reddit.com/r/singularity/comments/1wcnyay/ 、https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/
X: das 40 publicações recolhidas, apenas quatro da pesquisa por «Anthropic» correspondiam a notícias sobre LLMs. As outras nove consultas apenas reproduziam tendências do Explore (novos produtos Apple, Charlie Kirk, MAGA e outros temas de política e entretenimento), revelando que o desenho da pesquisa sobre LLMs era insuficiente. A única notícia concreta sobre produto foi a publicação de @claudecode84 sobre a abertura do ambiente Claude Code pelo responsável máximo da Anthropic. https://x.com/claudecode84/status/2097959830942367747
YouTube: o maior tema foi o GPT-6 Astra ter sido o primeiro modelo a atingir a categoria cibernética «Critical» no Preparedness Framework. Entre os pesos abertos, DeepSeek V4.1-Flash (lançado em 10/09, 200 TPS, com possibilidade de superar Astra) foi a novidade mais recente e relevante; GLM-5.3 e Qwen 3.8 Max também continuam a gerar muitos vídeos de benchmarks. Como as páginas de vídeo são renderizadas por JavaScript, algumas contagens de visualizações e subscritores não puderam ser confirmadas. https://www.youtube.com/watch?v=qRNZMGc7TMc 、https://www.youtube.com/watch?v=lpC5X6o3VJE
Bluesky: como a API pública de pesquisa (searchPosts) devolveu 403, foram lidos diretamente os feeds de contas conhecidas: Simon Willison, Nathan Lambert, Emily Bender e Gary Marcus. A principal descoberta foi que a controvérsia sobre a «saída da indústria por motivos de segurança» apareceu nas publicações principais de todos. Houve também relatos de utilização prática do GPT-6 Astra (Simon Willison) e uma síntese das tendências de licenciamento de pesos abertos (Nathan Lambert). https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
Lemmy: uma única comunidade não fornecia 10 publicações, pelo que foi necessário cruzar várias instâncias federadas, como sh.itjust.works, piefed.world, infosec.pub e lemmus.org. Do lado dos pesos abertos, predominaram questões práticas de operação local, como quantização e redução de VRAM (por exemplo, Qwen 3.8 27B numa GPU de 8 GB). Do lado fechado, ganharam atenção suspeitas de encaminhamento indevido de prompts por DeepSeek/Moonshot e as declarações sobre risco de extinção de um investigador da Anthropic (score 61, o maior desta recolha). https://lemmus.org/post/25299580
A marca investiu apenas nestas cinco plataformas. Outras redes sociais não mencionadas aqui (por exemplo, Threads e TikTok) ficaram fora do âmbito desta investigação; não se trata de ausência de dados.
A acompanhar
- Se o DeepSeek V4.1-Flash supera o GPT-6 Astra — Já no dia seguinte ao lançamento, surgiram no YouTube vídeos a testar a hipótese de «superar Astra». https://www.youtube.com/watch?v=lpC5X6o3VJE
- Novos desenvolvimentos na controvérsia sobre as declarações de risco de extinção e a saída da indústria de investigadores de IA — O rumo do debate sobre segurança, que está a crescer tanto no Bluesky (Nathan Lambert) como no Lemmy (!fuck_ai). https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
- A veracidade das suspeitas de plágio da OpenAI no caso Navier–Stokes — A discussão continua em r/singularity; vale a pena acompanhar se haverá resposta oficial. https://www.reddit.com/r/singularity/comments/1wcnyay/
- A veracidade de «Mythos 5» e do acesso de teste da ENISA — Só foi confirmado numa publicação no Lemmy; é necessária verificação com fontes primárias. https://infosec.pub/post/52133063
- Suspeitas de encaminhamento indevido de prompts para Claude por DeepSeek/Moonshot — É necessário confirmar novas informações sobre a alegada dependência ou intrusão em modelos fechados. https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
- Melhoria de desempenho do GLM-5.3 apenas com pós-treinamento — Mencionada tanto no YouTube como no Bluesky; observar se métodos semelhantes se espalham por outros modelos abertos. https://www.youtube.com/watch?v=iMpBNN-0-Ss
Recomendações
- Na próxima recolha do X, redesenhar as consultas em torno de termos diretamente ligados ao tema, como «nomes de novos modelos», «pesos abertos» e «preços de API», em vez de reproduzir as tendências do Explore.
- Priorizar, no próximo ciclo de investigação, a verificação através de anúncios oficiais e fontes primárias das suspeitas de plágio da OpenAI no caso Navier–Stokes e das declarações de risco de extinção de investigadores da Anthropic.
- Tratar as alegações de benchmark do DeepSeek V4.1-Flash e do GLM-5.3 como alegações até surgirem avaliações independentes de terceiros; não as aceitar sem crítica.
- Continuar a confirmar com fontes primárias informações de fonte única, como «Mythos 5» no Lemmy e as suspeitas de encaminhamento indevido de prompts por DeepSeek/Moonshot.
- Verificar na próxima recolha se o erro 403 da API de pesquisa do Bluesky foi resolvido, regressando da recolha baseada em contas conhecidas para a pesquisa transversal por palavras-chave.
- Considerando que a narrativa «empresas fechadas = captura regulatória» aparece independentemente no Reddit e no X, acompanhar continuamente as declarações oficiais da Anthropic e da OpenAI sobre resposta regulatória.
Qualidade dos dados
As quatro plataformas Reddit, YouTube, Bluesky e Lemmy tiveram limitações nos seus métodos de pesquisa/recolha (API de pesquisa do Bluesky com 403, renderização por JS do YouTube e dimensão insuficiente de uma comunidade única no Lemmy), mas todas produziram conhecimentos substanciais de forma independente. Apenas o X teve consultas desalinhadas com o tema (nove das dez consultas eram tendências irrelevantes do Explore), pelo que apenas quatro publicações constituíram notícias significativas sobre LLMs, face ao critério de conclusão de «10 itens». Em todas as plataformas, havia poucas publicações datadas do próprio dia do pedido (2026-09-11); a maior parte das informações era de 07/09 a 10/09.
Resumo por plataforma
Reddit — Notícias diárias de LLM
Onde
Distribuição dos 12 tópicos em 10 subreddits encontrados com a pesquisa «Daily LLM News».
| Subreddit | Número de membros | Tópicos recolhidos |
|---|---|---|
| r/NoStupidQuestions | 7,478,724 | 2 |
| r/singularity | 3,969,435 | 2 |
| r/ArtificialInteligence | 1,923,877 | 1 |
| r/artificial | 1,336,151 | 1 |
| r/LocalLLaMA | 821,351 | 1 |
| r/WritingWithAI | 164,927 | 1 |
| r/SillyTavernAI | 128,004 | 1 |
| r/Artificials | 3,785 | 1 |
| r/Maxcactus_TrailGuide | 5,149 | 1 |
| r/AIdaily_news | 1,818 | 1 |
Os enormes subreddits generalistas «não especializados em LLMs», r/NoStupidQuestions e r/singularity, representam juntos quatro tópicos, mostrando que os assuntos sobre LLMs já se difundiram amplamente entre utilizadores em geral. Ao mesmo tempo, comunidades de LLM local e roleplay, como r/LocalLLaMA e r/SillyTavernAI, também estão animadas hoje com reações a notícias externas, como «suspeitas de plágio» e «regulação».
O que as pessoas dizem
- As suspeitas de plágio em torno da descoberta matemática da OpenAI são o tema mais quente do dia. No tópico 6 de r/singularity, «A grande notícia é que a OpenAI está perto de resolver outro prémio Millennium...» (187 pontos, 55 comentários, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/), discute-se que a OpenAI anunciou progressos próximos de resolver um problema do Prémio Millennium (as equações de Navier–Stokes), ao mesmo tempo que afirma não ter «plagiado», através do Codex, resultados de investigação de matemáticos como Buckmaster. u/FateOfMuffins (52 pontos) comentou: «Isto poderá sugerir que o corte de dados do treino em larga escala mais recente foi 3 de julho?».
- O mesmo tema chegou ao tópico 12 de r/SillyTavernAI, «Devido ao roubo de provas matemáticas pela OpenAI, os LLM locais são agora mais cruciais do que nunca» (30 pontos, 47 comentários, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/), com a tese de que «se houve plágio, os LLM locais tornam-se ainda mais importantes». No entanto, o comentário principal de u/Original-League-6094 (30 pontos) contrapõe que «mesmo que o plágio seja real, esta alegação não faz sentido», revelando divisão de opiniões.
- O artigo do WSJ crítico da IA de pesos abertos gerou forte reação. O tópico 9 de r/LocalLLaMA, «WSJ: IA de pesos abertos não regulada é um convite ao desastre» (512 pontos, 232 comentários, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/), foi o de maior score. O autor classificou o artigo como «propaganda transparente», e o comentário principal de u/3169676 (556 pontos) ironizou: «Só os bilionários ricos deveriam poder fazer perguntas à IA regulada». u/UNaMean (222 pontos) defendeu os pesos abertos com o argumento de que «é a mesma lógica aplicada às armas: o problema são as pessoas que abusam, não a ferramenta».
- A reação à notícia da «saída da indústria» de um investigador da Anthropic foi fria. No tópico 4 de r/ArtificialInteligence, «A maior notícia do mundo da IA hoje» (0 pontos, 31 comentários, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/), sobre o investigador da Anthropic Jacob Coxon ter deixado o setor por recear uma «corrida para desenvolver sistemas fora de controlo», u/MiloGoesToTheFatFarm (14 pontos) descartou-o como «apenas um operador de introdução de dados, não alguém que desenhava modelos». u/presentofai (2 pontos) também ironizou que publicações de «demiti-me por razões de segurança» são como um currículo para a futura startup de segurança.
- A desconfiança em relação à Anthropic também explodiu em r/AIdaily_news. No tópico 7, «Espera... o que se passa?» (5 pontos, 14 comentários, 2026-09-10, https://www.reddit.com/r/AIdaily_news/comments/1wcri4x/), após uma experiência de recusa de um pedido relacionado com investigação genética, u/Dogbold (2 pontos) comentou que «é apenas mais uma mentira da Anthropic para tentar levar à proibição da IA».
- O debate sobre a chegada da AGI continua sem convergência. No tópico 3 de r/artificial, «O que é que os LLMs nunca farão?» (67 pontos, 218 comentários, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/), o autor argumenta que, vendo o lançamento do Astra, não seria surpreendente chegar à AGI dentro de 12 a 18 meses. Em resposta, u/danderzei (62 pontos) mantém-se cético: «LLMs são preditores do próximo token; tudo o resto são apenas propriedades emergentes». O comentário de u/presentofai (10 pontos), de que aquilo que realmente não conseguem fazer é «saber com certeza que estão errados», recebeu muitos votos de concordância.
- A discussão «LLMs não podem ser mais inteligentes do que um utilizador do Reddit» também foi um tópico popular, com score 268. O tópico 5 de r/singularity (268 pontos, 158 comentários, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/) transformou-se numa batalha de sarcasmo contra os céticos da AGI. u/oilybolognese (199 pontos) respondeu provocatoriamente que «os humanos dizem coisas erradas com mais confiança; portanto, o cérebro humano é que não pode ser inteligência geral natural».
- Uma pergunta simples sobre por que a previsão do próximo token pode resolver problemas matemáticos em aberto teve enorme repercussão em r/NoStupidQuestions. No tópico 2 (295 pontos, 164 comentários, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/), o comentário mais votado, de u/Time_Entertainer_319 (1.206 pontos), recua até à teoria da informação de Claude Shannon para explicar a relação entre previsão e estrutura da linguagem, tornando-se num típico tópico educativo do Reddit.
- Um tópico sobre LLMs gratuitos para escrita expôs a insatisfação com o trio estabelecido. No tópico 8 de r/WritingWithAI (13 pontos, 12 comentários, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/), o autor lamenta que «GPT Sol é demasiado rígido, Claude Sonnet tem limites de taxa demasiado apertados e Gemini é pouco inteligente». Nos comentários, u/VerdantMagnolia (2 pontos) e u/Round_Ad_5832 (1 ponto) sugerem experimentar Kimi ou DeepSeek.
- A declaração de um cientista de que «LLMs são um vírus cognitivo» registou o maior score (1.346 pontos). O tópico 11 de r/Maxcactus_TrailGuide (1.346 pontos, 133 comentários, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/) foi o de maior score entre os recolhidos, apesar de ser um subreddit de nicho. u/TurgorFervor (25 pontos) comentou: «A religião também é um vírus. Só o pensamento crítico pode ser a vacina».
Sinais
- Tendência de subida: o tema da desconfiança de que «empresas usam sem autorização as obras criativas e os resultados de investigação dos utilizadores no treino» surgiu simultaneamente em contextos distintos: a descoberta matemática da OpenAI (tópicos 6 e 12) e a recusa da Anthropic em investigação genética (tópico 7). Hoje, a desconfiança e o sarcasmo em relação a empresas fechadas de IA são uma corrente transversal.
- Inversão do ceticismo: perante o ceticismo habitual de que «LLMs são apenas preditores do próximo token» (tópicos 2, 3 e 5), os comentários mais votados de hoje tendem a defender que «previsão está essencialmente ligada ao pensamento» e que «a própria palavra criatividade é relativa». Isto sugere que o ambiente do Reddit está mais inclinado para um «ceticismo em relação ao ceticismo sobre LLMs» do que antes.
- Temas ignorados ou alvo de troça: a notícia da «saída da indústria por motivos de segurança» de um investigador da Anthropic (tópico 4) teve apenas 0 pontos, muito menos do que outras notícias, e os comentários foram mais sarcásticos do que solidários. Parece haver no Reddit uma tendência para desvalorizar manchetes mais sensacionalistas.
- Par de opiniões em conflito: ao colocar lado a lado o tópico 9 (forte reação de r/LocalLLaMA ao artigo do WSJ contra pesos abertos, comentário principal com 556 pontos) e o seu reverso, os tópicos 7 e 12 (desconfiança em relação ao campo das empresas fechadas, como Anthropic e OpenAI), percebe-se que no Reddit existe uma narrativa consistente: «empresas fechadas = interesses instalados que procuram eliminar concorrentes usando a regulação como escudo».
Limites
- A pesquisa usada desta vez foi apenas o termo genérico «Daily LLM News»; não foram feitas pesquisas com vários termos voltados para tópicos específicos, como anúncios de novos modelos, alterações de preços de API ou benchmarks. Por isso, os resultados não incluem tópicos sobre «novos modelos específicos ou mudanças de API anunciados hoje», concentrando-se antes em tópicos de debate, como AGI, suspeitas de plágio e regulação.
- As 12 publicações recolhidas foram publicadas entre 2026-09-06 e 2026-09-10; não houve sequer um tópico datado do próprio dia do pedido, 2026-09-11.
- r/AIdaily_news (1.818 membros), r/Artificials (3.785 membros) e r/Maxcactus_TrailGuide são subreddits de nicho ou de imitação, com números de membros muito reduzidos, e não têm a mesma representatividade de r/singularity ou r/LocalLLaMA.
- Em cada tópico, foram vistos apenas os seis comentários principais; não foram lidos todos os comentários, que podem chegar a 232.
X
X — Notícias diárias de LLM
Após examinar o ficheiro já recolhido output/x.posts.md (40 publicações, 39 contas, 10 tipos de consulta), concluiu-se que as únicas publicações correspondentes a notícias sobre LLMs — novos modelos, pesos abertos, API/preços, benchmarks, utilizações ou incidentes em destaque e movimentos das empresas — foram quatro publicações encontradas na pesquisa por Anthropic. As outras nove consultas (Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS, The OS) apenas reproduziram a lista de tendências Explore do próprio X, centrada em política, entretenimento e fofocas, sem ligação a notícias sobre LLMs.
Contas
- @restitutorII(Restitutor Orientis) — 1 publicação, 426 gostos. Um tópico explicativo isolado que resume e divulga o relatório de cenários económicos da Anthropic.
- @walterkirn(Walter Kirn) — 1 publicação, 522 gostos. Conta conhecida como escritor/jornalista, que publicou um comentário isolado e cético sobre uma figura conhecida da indústria de IA.
- @johnennis(John Ennis) — 1 publicação, 992 gostos. Diz ser «ex-funcionário da Anthropic» e publicou uma sátira que ironiza o favorecimento regulatório da Anthropic, ou captura regulatória.
- @claudecode84(Laboratório de investigação Claude Code) — 1 publicação, 1.127 gostos e cerca de 175.000 visualizações. Conta que publica em japonês sobre Claude Code; foi a única publicação de notícias concretas de produto nesta recolha.
Todas tiveram apenas uma publicação. Não são influenciadores «especializados» que acompanham constantemente um tema específico, mas sobretudo utilizadores comuns ou contas pequenas a médias que viralizaram pontualmente.
Publicações
-
@claudecode84(1.127 gostos・129 reposts・15 respostas・cerca de 175.000 visualizações・2026-09-10)
https://x.com/claudecode84/status/2097959830942367747O próprio principal responsável da Anthropic está a tornar todo o seu «ambiente Claude Code» open source.
A única publicação desta recolha que corresponde a um anúncio concreto de produto. Uma conta japonesa de IA destaca que o principal responsável da Anthropic, cujo cargo específico não é indicado na publicação, tornou público todo o seu ambiente Claude Code. -
@restitutorII(426 gostos・67 reposts・39 respostas・cerca de 49.000 visualizações・2026-09-10)
https://x.com/restitutorII/status/2097918742571139093A Anthropic imagina, no seu relatório, três futuros possíveis para a economia americana em 2030, com base no poder e na adoção da IA: 1- Cenário modesto: a IA tem um impacto comparável ao da Internet. PIB +1,6%, poucas perturbações no emprego. 2- Cenário substancial: a IA consegue realizar cerca de...
Um tópico que apresenta o relatório de cenários da Anthropic sobre a «economia americana em 2030» — vários cenários, como Modest/Substantial, e efeitos no PIB. O texto fica cortado na própria publicação, e não foi possível confirmar uma ligação direta para o relatório original. -
@johnennis(992 gostos・86 reposts・49 respostas・cerca de 32.000 visualizações・2026-09-10)
https://x.com/johnennis/status/2098032630159597842Pessoal, NÃO TEMOS ESCOLHA senão dar à Anthropic (o meu antigo empregador, onde só trabalhei seis semanas para picar o ponto e tornar esta treta credível) um monopólio regulatório. É ciência!
Publicação satírica que ridiculariza as atividades de lobby regulatório da Anthropic como «captura regulatória». Embora a alegação de ser ex-funcionário não esteja verificada, o tom irónico revela a desconfiança de que a Anthropic procura usar a regulação para afastar concorrentes. -
@walterkirn(522 gostos・71 reposts・32 respostas・cerca de 20.000 visualizações・2026-09-10)
https://x.com/walterkirn/status/2098059171325427949Os media tradicionais promoveram este tipo como se ele fosse, bem, o Dr. Fauci ou algo assim. Peço-vos que vejam claramente como isto funciona. E quem o faz funcionar.
Encontrada na pesquisa por «Anthropic», mas não é possível determinar apenas pelo texto a quem se refere — se a alguém ligado à Anthropic ou a outra figura da indústria de IA. Só se confirma o tom cético sobre a promoção excessiva de uma pessoa pelos media tradicionais.
Sinais
- Quase não há notícias sobre LLMs entre «o que mais se fala hoje» no X. Entre as 10 principais tendências do Explore abaixo, apenas «Anthropic», em 7.º lugar, está diretamente ligada a LLMs/IA. As restantes abordam o evento de novos produtos Apple, memes relacionados com Charlie Kirk, MAGA/política, iPhone Duo, a situação palestiniana e política interna britânica. No conjunto do X, temas de política e entretenimento dominaram claramente a IA neste dia.
- As menções à Anthropic reúnem tanto uma apresentação favorável do impacto económico como sarcasmo sobre captura regulatória (publicação 2 vs. publicação 3). A amostra é pequena e não permite conclusões definitivas, mas o sarcasmo segue a mesma direção da narrativa de desconfiança vista no Reddit: «empresas fechadas de IA = interesses instalados protegidos pela regulação».
- Ponto negligenciado: a única notícia concreta de produto (publicação 1, abertura do ambiente Claude Code) partiu de uma conta japonesa; não foram encontradas, nesta recolha, reações em inglês. É possível que o tema não se tenha difundido.
- Como referência, a presença de «Anthropic» nas tendências de Technology do Explore sustenta, independentemente da dimensão exata do assunto, que foi uma das poucas empresas de IA mencionadas no X naquele dia.
Referência: X Explore(com base na geolocalização desta sessão)
| # | Tendência | Categoria/local(designação do X) |
|---|---|---|
| 1 | Apple | Technology · Trending |
| 2 | Charlie Kirk | Politics · Trending |
| 3 | MAGA | Politics · Trending |
| 4 | iPhone Duo | Technology · Trending |
| 5 | Palestinian | Politics · Trending |
| 6 | Britain | Politics · Trending |
| 7 | Anthropic | Technology · Trending |
| 8 | #CyberSecurity | Trending in Croatia |
| 9 | Harvey as the AI OS | Trending in Croatia |
| 10 | The OS | Trending in Croatia |
As posições 1 a 7 não indicam local, provavelmente por corresponderem à configuração regional predefinida da sessão; apenas as posições 8 a 10 indicam «Trending in Croatia». Portanto, esta lista do Explore reflete uma região específica — possivelmente a Croácia, ou a região predefinida desta sessão — e não deve ser tratada como representativa do mundo inteiro.
Limites
- O desenho das consultas estava desalinhado com o tema: nove das dez consultas usadas na recolha (Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS, The OS) foram simplesmente termos das tendências do X Explore. Só «Anthropic» se relacionava com LLMs; não foram feitas pesquisas direcionadas a «anúncios de novos modelos», «pesos abertos», «preços de API» ou «benchmarks». Assim, apenas quatro publicações relevantes sobre LLMs foram obtidas, face ao critério de conclusão de 10.
- Não foram pesquisados explicitamente outros grandes participantes de LLMs, como OpenAI, Google (Gemini), Meta (Llama), Mistral e xAI (Grok). Por isso, esta recolha não permite saber se estes temas estavam a ser discutidos no X.
- A citação da publicação 2 (@restitutorII) é cortada pela plataforma; não foi possível confirmar o nome do relatório original da Anthropic nem os valores detalhados dos cenários Substantial/Aggressive.
- Embora a publicação 4 (@walterkirn) tenha surgido na pesquisa por «Anthropic», não é possível identificar a pessoa ou o contexto apenas pelo texto, pelo que não há certeza de que seja efetivamente sobre a Anthropic.
- Como já referido, os resultados do Explore estão ligados à região da sessão — Croácia ou uma região predefinida desconhecida — e poderiam diferir em regiões como Japão ou Estados Unidos.
YouTube
YouTube — Notícias sobre LLMs de 11 de setembro de 2026
Canais
- Wes Roth(cerca de 323 mil subscritores, cerca de 56 milhões de visualizações totais)— canal habitual de análise rápida de anúncios dos novos modelos da OpenAI. Publicou GPT-6 Astra Just Went CRITICAL....
- Every / 「AI & I」(estúdio de produtos de Dan Shipper)— publicou um relatório de teste prático de uma semana: We Tested Anthropic's Fable 5.1 for a Week.
- Muitos outros canais de comparação de IA do tipo «Fully Tested» (os nomes dos canais e os números de subscritores não puderam ser confirmados devido à renderização por JavaScript; ver Limits abaixo) publicam vídeos de benchmark para cada novo modelo.
Vídeos
-
GPT-6 Astra Just Went CRITICAL... — Wes Roth(publicado por volta de 2 de setembro de 2026)
https://www.youtube.com/watch?v=qRNZMGc7TMc
Relata que o GPT-6 Astra da OpenAI foi o primeiro modelo a atingir a categoria de cibersegurança «Critical» no seu Preparedness Framework e explica que as capacidades cibernéticas avançadas foram disponibilizadas apenas a testadores verificados e parceiros Daybreak Blue. -
Use GPT-6 Astra For FREE — OpenAI's Most Powerful Model Ever(nome do canal não confirmado, publicado há cerca de 4 dias, por volta de 7 de setembro)
https://www.youtube.com/watch?v=LbXoUHdG2pY
Apresenta formas de usar o GPT-6 Astra gratuitamente, descrevendo-o como tendo desempenho de ponta em programação, cibersegurança e ciência. -
We Tested Anthropic's Fable 5.1 for a Week — Every/Dan Shipper
https://www.youtube.com/watch?v=yZddAiz4HP8
Testa o Fable 5.1 durante uma semana em programação, escrita e trabalho do conhecimento. Conclui que é «o modelo de programação mais forte que já usaram» e que alcançou resultados equivalentes aos do Opus 5 com cerca de metade dos tokens e cerca de 60% do tempo. -
Fable 5.1 is here, and its REALLY good(nome do canal não confirmado)
https://www.youtube.com/watch?v=0lBvjhcRqyU
Relata que o Fable 5.1 reduziu o custo de leitura de cache em 75% e o custo de trabalho de agentes em 25 a 45%. -
Gemini 3.8 Flash: The model no one expected!(nome do canal não confirmado, publicado há cerca de uma semana)
https://www.youtube.com/watch?v=UvrAYDgobSw
Avalia o Gemini 3.8 Flash como o melhor modelo de programação agentiva da história da Google. -
Gemini 3.8 Flash Opus 5 Level Explained in 7 Minutes - Benchmarks, Cost, First Impressions(nome do canal não confirmado)
https://www.youtube.com/watch?v=y52bv4iNfzU
Explica que os benchmarks do Gemini 3.8 Flash, lançado pela Google em 2 de setembro — o terceiro lançamento Flash em 43 dias — atingiram o nível do Opus 5. -
GLM-5.3: Frontier Coding with Emergent Cyber Capabilities(nome do canal não confirmado)※pesos abertos
https://www.youtube.com/watch?v=2uEunHawjIU
Refere que o GLM-5.3 da Z.ai obtém pontuações de fronteira em programação, mas também aborda o rápido aumento das capacidades cibernéticas emergentes. -
GLM-5.3 (Fully Tested): I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!(nome do canal não confirmado)※pesos abertos
https://www.youtube.com/watch?v=iMpBNN-0-Ss
Afirma que o GLM-5.3 ficou em primeiro lugar num benchmark próprio do autor. Destaca que os pesos base não foram alterados desde o GLM-5.2 e que a melhoria veio apenas do pós-treinamento. -
Qwen 3.8 Max (Final Version Review & Free Ways): Okay, it's ACTUALLY a TOP MODEL!(nome do canal não confirmado)※pesos abertos
https://www.youtube.com/watch?v=GrTVmMZfM6A
Relata que o Qwen 3.8 Max, o modelo de topo da Alibaba com cerca de 2,4 biliões de parâmetros, superou o Opus 4.8 em muitos benchmarks. -
Deepseek V4.1 Flash (Fully Tested): 200 TPS & Beats Astra!? (+New Architecture Overview)(nome do canal não confirmado, publicado há cerca de 14 horas, o mais recente: 10 a 11 de setembro)※pesos abertos
https://www.youtube.com/watch?v=lpC5X6o3VJE
Examina a possibilidade de o DeepSeek V4.1-Flash, lançado oficialmente em 10 de setembro de 2026 — MoE de 552 mil milhões de parâmetros, compreensão nativa de imagens e contexto de um milhão de tokens — igualar ou superar o GPT-6 Astra em benchmarks, com inferência rápida de 200 TPS. -
Muse Spark 1.3: Going Open Weight Soon, Fully Tested(nome do canal não confirmado)※pesos abertos
https://www.youtube.com/watch?v=euJl6i8pT3g
Avalia a perspetiva de o Muse Spark 1.3 voltar em breve a pesos abertos, depois de a Meta ter lançado o Muse Spark, em abril de 2026, como o seu primeiro modelo de pesos fechados.
Sinais
- Entre os modelos fechados, os vídeos concentram-se num único ponto sobre o GPT-6 Astra da OpenAI: ser «o primeiro modelo a atingir a categoria cibernética Critical no Preparedness Framework». Mais do que demonstrações de desempenho, o maior tema é a empresa ter divulgado o seu próprio nível de perigosidade. As análises do Fable 5.1 da Anthropic destacam uma perspetiva de utilização real — «metade do custo operacional» e «Claude voltou a escrever texto natural» —, enquanto o Gemini 3.8 Flash da Google chama atenção pela própria velocidade de desenvolvimento: «o terceiro lançamento Flash em 43 dias».
- Entre os pesos abertos, o DeepSeek V4.1-Flash, lançado em 10 de setembro e o mais recente, teve a maior novidade do dia pela hipótese de «poder superar Astra». No GLM-5.3, o ponto de interesse é o método em si: melhoria de desempenho apenas com pós-treinamento, sem alterar o modelo base. Qwen 3.8 Max e Meta Muse Spark 1.3 já tinham sido lançados, mas continuam a receber vídeos de benchmark regularmente.
- No conjunto, consolidou-se o padrão de vídeos de benchmark rotulados «Fully Tested» serem produzidos em massa no próprio dia do anúncio de um modelo ou nos dias imediatamente seguintes.
Limites
- Como as páginas de resultados e de vídeo do YouTube são renderizadas por JavaScript,
WebFetchnão conseguiu obter diretamente a lista real de vídeos, visualizações, subscritores ou comentários; devolveu apenas a navegação de rodapé. Assim, muitas das contagens de visualizações e nomes de canais deste relatório baseiam-se em snippets de WebSearch, e os itens não confirmados foram identificados como tal. - Pelas mesmas razões, não foi possível verificar diretamente o conteúdo das descrições dos vídeos nem dos comentários principais.
- As pesquisas foram feitas principalmente com palavras-chave em inglês. Vídeos de canais japoneses sobre o mesmo tema — por exemplo, foi encontrado um vídeo de notícia rápida em japonês sobre GLM-5.3 — não foram explorados de forma exaustiva.
Bluesky
Bluesky — Notícias sobre LLMs de hoje
Contas
O Bluesky possui a API pública app.bsky.feed.searchPosts, mas a pesquisa por palavras-chave não pôde ser usada porque devolvia atualmente 403 Forbidden (ver Limits). Como alternativa, foram lidos diretamente os feeds de contas conhecidas que publicam regularmente sobre LLMs.
- Simon Willison — @simonwillison.net. Criador da ferramenta LLM CLI; publica quase diariamente impressões sobre novos modelos e dicas de uso de agentes.
- Gary Marcus — @garymarcus.bsky.social. Figura de destaque entre os céticos de LLMs e fonte de críticas sobre segurança e exagero publicitário.
- Nathan Lambert (Interconnects) — @natolambert.bsky.social. Investigador do AI2. Publica regularmente «Latest open artifacts», uma síntese das tendências de modelos de pesos abertos.
- Emily M. Bender — @emilymbender.bsky.social. Linguista computacional e cética de IA, com foco em críticas a exageros publicitários e relações públicas.
- Como referência, a conta oficial da Anthropic (@anthropic.com) também foi verificada, mas tinha zero publicações (
postsCount: 0) e não apresenta atividade efetiva no Bluesky. A conta oficial da OpenAI não existe com o identificadoropenai.com(400 Bad Request).
Publicações
-
Pediu ao GPT-6 Astra para criar no Blender um modelo de um ovo Fabergé temático de Pluribus — Simon Willison, 2026-09-10. «Aqui está um modelo Blender de um ovo Fabergé temático de Pluribus que pedi ao GPT-6 Astra para criar...» 52 gostos e 5 reposts.
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Também pediu para criar um visualizador no navegador para ver o mesmo modelo — Simon Willison, 2026-09-10. 17 gostos e 1 repost.
https://bsky.app/profile/simonwillison.net/post/3mv4swvzzr22h -
Impressões sobre a controvérsia da OpenAI relativa ao «problema do Prémio Millennium Navier–Stokes» — Simon Willison, 2026-09-08. 283 gostos e 51 reposts, a publicação mais difundida deste feed.
https://bsky.app/profile/simonwillison.net/post/3mv2a4quhpk2d -
As diretrizes de prompts da Anthropic/OpenAI passaram a recomendar regras «mais concisas» — Simon Willison, 2026-09-07. 7 gostos e 3 reposts.
https://bsky.app/profile/simonwillison.net/post/3mux26ztekk26 -
Escreveu «uma demissão transformou as brasas do medo da IA num incêndio» — Nathan Lambert, 2026-09-10. Analisa como a declaração de saída de um investigador de IA — que alegava risco de extinção superior a 10% e mencionava Evan Hubinger — desencadeou uma rápida escalada do medo de IA nas redes sociais. 13 gostos e 2 reposts.
https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
(artigo original: https://www.interconnects.ai/p/one-resignation-turned-the-embers /Hacker News: https://news.ycombinator.com/item?id=49646123) -
«O progresso da IA é rápido / a implementação deve ser cuidadosa / o mundo não vai acabar»; crítica à controvérsia da demissão — Nathan Lambert, 2026-09-09. 151 gostos e 14 reposts.
https://bsky.app/profile/natolambert.bsky.social/post/3mv3ybz4g4n2c -
Crítica de que «as pessoas dentro da OpenAI/Anthropic agem com fervor religioso» — Nathan Lambert, 2026-09-09. 26 gostos e 3 reposts.
https://bsky.app/profile/natolambert.bsky.social/post/3mv3yb7bnem2t -
Latest open artifacts (#24): síntese de Motif-3, GLM-5.3, Hy4-preview e tendências de licenciamento de modelos abertos — Nathan Lambert, 2026-09-08. «O ecossistema de modelos abertos continua a expandir-se, enquanto a fronteira atravessa uma grande confusão.» 13 gostos.
https://bsky.app/profile/natolambert.bsky.social/post/3muzc3qszot2m -
Questiona a cobertura acrítica da controvérsia da demissão pelos media — Emily M. Bender, 2026-09-10. Pergunta a historiadores se há precedentes de se noticiar diretamente o que dizem membros de cultos. 318 gostos e 80 reposts.
https://bsky.app/profile/emilymbender.bsky.social/post/3mv6fvytz2s25 -
Ceticismo sobre as relações públicas da OpenAI acerca de uma «descoberta matemática» — Emily M. Bender, 2026-09-10. Comentou que se relaciona com a competição promocional no contexto da comunicação científica. 62 gostos e 8 reposts.
https://bsky.app/profile/emilymbender.bsky.social/post/3mv54s2ytuv2a -
Gary Marcus critica detalhadamente «o que Dwarkesh interpretou mal» — uma resposta ao otimismo no podcast de Dwarkesh Patel — Gary Marcus, 2026-08-31. 46 gostos e 21 reposts.
https://bsky.app/profile/garymarcus.bsky.social/post/3mufea36xzc2x -
Comentário curto sobre a controvérsia da demissão: «como discuti hoje no meu Substack» — Gary Marcus, 2026-09-10. 13 gostos.
https://bsky.app/profile/garymarcus.bsky.social/post/3mv6i3z5bpc2y
Sinais
- O assunto mais comentado hoje = a «controvérsia da demissão». A declaração de saída de um investigador de IA, com menções ao risco de extinção e ao nome de Evan Hubinger, aparece simultaneamente nas publicações principais de Nathan Lambert, Emily Bender e Gary Marcus, três contas com posições diferentes. Tanto investigadores mais próximos dos pesos abertos como críticos de modelos fechados desenvolvem debates de segurança a partir deste episódio.
- O GPT-6 Astra (OpenAI, lançado a 03/04 de setembro) é usado intensamente por Simon Willison em ferramentas práticas — integração com Blender e trabalho GIS —, e os posts tiveram grande difusão, especialmente o relacionado com Navier–Stokes, com 283 gostos. No Bluesky, porém, as menções concentram-se em relatos favoráveis de implementação, sem o clima celebratório visto no Reddit.
- Os movimentos dos pesos abertos estão condensados no «Latest open artifacts #24» de Nathan Lambert: Motif-3, GLM-5.3 e Hy4-preview são as novidades da semana. As tendências de licenciamento também continuam a ser acompanhadas.
- No clima geral do Bluesky, debates técnicos sobre investigação em LLMs têm menos peso do que metadiscussões sobre «segurança da IA, exagero publicitário e a forma como os media cobrem o tema». A forte presença de céticos como Emily Bender e Gary Marcus diferencia a plataforma do X e do Reddit.
Limites
- A API pública de pesquisa do Bluesky (
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) devolveu continuamente 403 Forbidden nesta recolha, ao contrário do indicado no playbook. Outros endpoints de leitura, comogetProfileegetAuthorFeed, funcionaram normalmente, pelo que a limitação parece afetar especificamentesearchPosts. Por isso, não foi possível fazer pesquisa transversal por palavras-chave e foi necessário recorrer à leitura direta de feeds de contas conhecidas. - A interface web de pesquisa do
bsky.app(https://bsky.app/search?q=...) é uma SPA renderizada no cliente; como o fetch sem JavaScript não obtém os textos, não pôde ser usada. - Os identificadores
huggingface.co/huggingface.bsky.social/swyx.bsky.socialtinham zero publicações ou não existiam, não permitindo captar publicações oficiais da Hugging Face ou de swyx. A conta oficial da OpenAI, com o identificadoropenai.com, também não existe no Bluesky. A conta da Anthropic (anthropic.com) existe, mas tem zero publicações e está efetivamente inativa. - Não foi possível identificar o identificador correto de David Gerard (Pivot to AI): o identificador estimado
davidgerard.co.ukdevolveu erro 400 epivot.bsky.socialpertencia a outra conta pessoal. Assim, uma fonte importante de crítica mediática ficou de fora. - Por estas razões, não foi possível recolher mecanicamente «as 10 publicações mais recentes» a partir de uma pesquisa por palavras-chave completa. Ainda assim, foram reunidas 12 publicações relevantes, com datas e ligações, cruzando os feeds de várias contas principais.
Lemmy
Lemmy — Notícias sobre LLMs de hoje(2026-09-11)
Comunidades
- !«メールアドレス» — 5.132 subscritores. Principal comunidade sobre execução local e operação doméstica de LLMs.
- !«メールアドレス» — 2.168 subscritores.
- Machine Learning | Artificial «メールアドレス»(
!«メールアドレス»)— 1.248 subscritores. - !«メールアドレス» — 8.191 subscritores. Comunidade crítica da indústria de IA/LLMs, com muitas publicações sobre «incidentes» e «preocupações».
- !«メールアドレス» — 51 subscritores. Comunidade de republicação RSS que espelha mecanicamente publicações de IA do Reddit; não é debate orgânico do Lemmy.
- !«メールアドレス»、!«メールアドレス»、!«メールアドレス»、!«メールアドレス»、!«メールアドレス»、!«メールアドレス» — comunidades em várias instâncias federadas, onde foram encontradas publicações isoladas relacionadas com IA nesta recolha; o número de subscritores não foi confirmado.
Publicações
-
NanoFlare coloca o Qwen 3.8 27B numa GPU de 8 GB —
!«メールアドレス»、score 1、2026-09-09
https://lemmy.world/post/51731499
Relato do método de quantização «NanoFlare» para executar Qwen3.8 27B numa GPU da classe de 8 GB. -
Benchmark de quantizações do Qwen3.8 27B —
!«メールアドレス»(via piefed.zip)、score 20、2026-09-08
https://piefed.zip/c/«メールアドレス»/p/1805947
Comparação de precisão e velocidade entre várias versões quantizadas do Qwen3.8 27B. Foi a publicação com maior score entre as verificadas dentro de localllama. -
FreeToken afirma 39,3 tok/s para Qwen3.6-35B —
!«メールアドレス»、score 4、2026-09-08
https://lemmy.world/post/51688483
Alegação de que o framework de aceleração de inferência «FreeToken» atingiu 39,3 tok/s com Qwen3.6-35B. -
Laboratórios chineses DeepSeek e Moonshot encaminhavam discretamente prompts de clientes para Claude através de contas fraudulentas —
!«メールアドレス»、score 3、2026-09-10 21:34 UTC
https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
Republicação de uma notícia segundo a qual DeepSeek e Moonshot encaminhavam prompts de clientes para Claude através de contas fraudulentas. -
CVE-2026-82533: a falha no DeepSeek Harness que deixava os agentes de IA com as chaves da própria sandbox(vulnerabilidade no DeepSeek Harness, expondo aos agentes de IA as chaves da própria sandbox)—
!«メールアドレス»、score 1、2026-09-10 11:59 UTC
https://poliversity.it/users/nuke/statuses/117246627511641222
Informação sobre uma vulnerabilidade na infraestrutura de execução de agentes DeepSeek (instância de língua italiana). -
Anthropic dá à agência europeia de cibersegurança ENISA acesso de teste ao Mythos 5 —
!«メールアドレス»、score 1(2 votos positivos/1 negativo)、2026-09-10 21:38 UTC
https://infosec.pub/post/52133063
Publicação que afirma que a Anthropic forneceu à ENISA, agência de cibersegurança da UE, acesso de teste a um novo modelo chamado «Mythos 5». Não foi possível confirmar este nome de modelo noutra fonte no Lemmy (ver Limits). -
Investigador da Anthropic diz haver 10% de probabilidade de a IA matar «todos os humanos» nos próximos 10 anos —
!fuck_ai(via lemmus.org)、score 61、2026-09-10 20:40 UTC
https://lemmus.org/post/25299580
A publicação com maior score desta recolha. É uma reação, numa comunidade crítica de IA, a uma notícia sobre a declaração de risco futuro de um investigador da Anthropic. -
Bot de IA a invadir/recolher dados do Home Assistant —
!«メールアドレス»、score 10、2026-09-10 20:20 UTC
https://lemmy.world/post/51769975
Relato de um caso em que um bot que se identificava como Google Gemini tentou iniciar sessão sem autorização num servidor doméstico com Home Assistant. -
Google anuncia expansão de IA de 13 mil milhões de euros na Finlândia —
!«メールアドレス»、score 14、2026-09-09 13:28 UTC
https://sh.itjust.works/post/66487923
Notícia de que a Google anunciou um investimento de 13 mil milhões de euros em infraestrutura de IA em quatro municípios finlandeses. -
68% dos eleitores dos EUA apoiam projeto Sanders/Casar para pausa na IA e proibição de superinteligência: sondagem —
!«メールアドレス»、score 5、2026-09-10 20:29 UTC
https://news.abolish.capital/post/77805
Republicação de resultados de uma sondagem sobre um projeto de lei para pausar a IA e proibir a superinteligência. A linha editorial da instância de origem não foi verificada (ver Signals).
Sinais
- No lado dos pesos abertos, predominam questões práticas de «quantização e redução de VRAM»: executar Qwen3.8 27B em 8 GB de VRAM (#1), comparar as respetivas quantizações (#2) e alegações de velocidade de inferência (#3). Nas comunidades localllama / machinelearning, publicações sobre «como executar localmente» obtêm mais atenção do que os próprios anúncios de novos modelos.
- O campo dos modelos fechados, relacionado com Anthropic/OpenAI, surge no contexto de segurança e abuso: as suspeitas de encaminhamento de prompts para Claude por DeepSeek/Moonshot (#4) e a vulnerabilidade no DeepSeek Harness (#5) apareceram na mesma altura. No Lemmy, também se discute a ideia de que intervenientes chineses de pesos abertos dependem de, ou tentam infiltrar-se em, modelos fechados.
- A publicação da comunidade crítica/cética de IA !fuck_ai, com 8.191 subscritores, teve o maior score da recolha: a declaração de risco do investigador da Anthropic (#7, score 61) destacou-se. A temperatura geral do Lemmy parece mais orientada para segurança e ceticismo do que para entusiasmo com novas funcionalidades.
!«メールアドレス»é, na prática, um bot de republicação do Reddit — tem 51 subscritores e as publicações são automatizadas quase ao mesmo tempo. Por isso, foi intencionalmente excluído das principais conclusões, que dão prioridade a publicações orgânicas de outras instâncias.- Algumas comunidades e instâncias de republicação de notícias, como
!pravda_newse news.abolish.capital, não tiveram a linha editorial nem as fontes verificadas. É preciso ter cautela, pois o conteúdo é republicado sem confirmação da respetiva exatidão.
Limites
- O Lemmy é pequeno e a única comunidade principal especializada em IA/LLMs é, na prática,
!«メールアドレス». Foram reunidas 10 publicações, mas uma única instância e comunidade só produziu cerca de cinco ou seis itens. Foi necessário cruzar várias instâncias federadas —piefed.world,piefed.zip,infosec.pub,poliversity.it,lemmus.org,news.abolish.capitalefeddit.org— para chegar a 10. - A interface web de
sh.itjust.works(/c/localllama) devolveu 403 no acesso direto. A recolha foi então deslocada para pesquisa/API e espelhos piefed. - «Mythos 5» (#6) só foi confirmado numa publicação do Lemmy; não foi possível chegar a uma fonte primária, como um anúncio oficial da Anthropic, para o verificar.
!ai_reddit, um bot RSS de republicação do Reddit, possui muitas publicações mas não representa debate originado no Lemmy. Foi excluído dos 10 itens principais e citado apenas como referência emCommunities.
Ações recomendadas
- Na próxima recolha no X, utilizar termos diretamente relacionados com o tema, como nomes de novos modelos, pesos abertos e preços de API, em vez das tendências do Explore.
- Dar prioridade, no próximo ciclo, à verificação por anúncios oficiais e fontes primárias das suspeitas de plágio no caso Navier–Stokes da OpenAI e das declarações de risco de extinção de investigadores da Anthropic.
- Tratar as alegações de benchmark do DeepSeek V4.1-Flash e do GLM-5.3 como alegações até existirem avaliações de terceiros.
- Continuar a confirmar informações de fonte única, como «Mythos 5» no Lemmy e as suspeitas de encaminhamento indevido de prompts por DeepSeek/Moonshot.
- Verificar na próxima recolha se o erro 403 da API de pesquisa do Bluesky foi resolvido e regressar da recolha baseada em contas conhecidas à pesquisa normal por palavras-chave.
Nota sobre a qualidade dos dados
Reddit, YouTube, Bluesky e Lemmy produziram conhecimentos independentes apesar das limitações dos métodos de recolha. Já no X, as consultas estavam desalinhadas com o tema — nove em cada dez eram tendências irrelevantes do Explore —, pelo que apenas quatro publicações foram significativas como notícias sobre LLMs.



