KEN’S CAT LOG

Notícias de IA de hoje (31 de agosto de 2026)

Último dia de agosto. Como é típico do fim do mês, falaram-se de dinheiro e de preços. Hoje, mais do que anúncios vistosos de modelos, o foco está nas questões discretas, mas decisivas: «quem paga quanto?» e «onde estarão os estrangulamentos?».

  1. DeepSeek prepara angariação de 7,4 mil milhões de dólares

A DeepSeek está a tentar fechar uma ronda de cerca de 50 mil milhões de yuans (7,4 mil milhões de dólares), com uma avaliação pré-money de aproximadamente 500 mil milhões de yuans (74 mil milhões de dólares). O objetivo é concluir a operação até ao fim de agosto e, a seguir, apontar a uma entrada na bolsa STAR de Xangai em 2027.

A sensação é que o player que entrou a competir à força de preços baixos chegou finalmente à fase de acumular capital de frente. Irá tentar chegar à bolsa mantendo a estratégia de preços baixos, ou aumentará os preços antes da oferta pública? Já a 14 de agosto, o V4 Flash subiu 93% ($0.14→$0.27/M), pelo que já há sinais da segunda hipótese. Quem baseia a rentabilidade nos preços das APIs fará bem em começar a desenhar a arquitetura a contar com vários fornecedores.

  1. Resultados da NVIDIA duplicam, mas «não há memória suficiente»

As receitas entre maio e julho foram aproximadamente o dobro das do mesmo período do ano anterior. A previsão para agosto a outubro também superou as expectativas do mercado, e a empresa apresentou uma projeção confiante de cerca de 70% de crescimento no próximo exercício.

Mas houve também um ponto preocupante na apresentação de resultados: a escassez de componentes de memória poderá limitar o crescimento futuro. É uma contradição comum em mercados em crescimento: a procura aumenta, mas a oferta não consegue acompanhar.

Isto também chega ao trabalho prático. Quem planeia correr LLMs localmente ou comprar mais equipamento com GPUs deve contar com memória mais cara e prazos de entrega mais longos. O «mais tarde» de «compro mais tarde» pode sair mais caro do que parece.

  1. OpenAI «GPT-Live» — a voz deixa de passar por texto

A OpenAI lançou o modelo de voz nativo «GPT-Live». Funciona por trás do ChatGPT Voice, promete latência inferior a 300 ms e suporte para nuances emocionais.

O ponto-chave é a eliminação do «estrangulamento do pipeline de texto». Até agora, as conversas por voz envolviam várias etapas — voz → texto → LLM → texto → voz —, o que inevitavelmente criava latência e perda de informação. Transformar isto numa única cadeia significa que a própria conceção de aplicações pensadas para interfaces de voz vai mudar. Atendimento telefónico, sistemas automóveis e operações mãos-livres no terreno — são áreas onde vale a pena considerar uma reformulação.

  1. Anthropic: revisão de preços do Sonnet 5 e uma publicação apagada

Hoje, os preços do Sonnet 5 serão revistos. Em paralelo, a Anthropic apagou uma publicação relacionada com o Claude Code e voltou a publicá-la, reconhecendo que houve uma redução de 17%.

Alterações de preços ou limites de utilização têm impacto direto em operações reais. Nos casos em que está integrado no CI ou serve de backend para ferramentas internas, recomenda-se recalcular os custos mensais.

  1. Tencent «Hy4 preview» — comprimir 770B para 200 GiB

A Tencent lançou o Hy4 preview. Tem 770B de parâmetros (49B ativos), contexto de 1M e é open source.

Pessoalmente, a parte mais interessante foi a compressão. A empresa afirma ter reduzido um modelo de 1,5 TB para cerca de 200 GiB em GGUF, mantendo-o funcional. O método, «MIX-STQ1_0», não reduz uniformemente todos os níveis para baixa precisão: define a largura de bits ideal para cada nível com base em dados de calibração. Alguns níveis descem até 1,31 bits, enquanto outros são mantidos a 2,06 bits. É a ideia de distribuir o mesmo orçamento de forma mais inteligente.

Para quem opera modelos localmente, isto torna um pouco mais realista a ideia de ter modelos de nível frontier em casa. Ainda assim, 200 GiB continuam a ser pesados, pelo que serão poucos os que conseguem colocá-lo diretamente na RAM.

  1. Infraestrutura e especialização por setor AWS × NVIDIA: a 26 de agosto, anunciaram uma grande expansão da parceria em torno da infraestrutura de IA. Google Cloud: anunciou a plataforma de agentes de IA para escritórios de advocacia «Gemini Enterprise for Legal». Okta: iniciou a disponibilização geral do «Agent SSO», que gere agentes de IA como se fossem colaboradores. AWS Bedrock: adicionou modelos MiniMax, com suporte para contexto de 4M de tokens.

O movimento da Okta é discreto, mas simbólico. A ideia de dar uma «conta» aos agentes e gerir as suas permissões está a tornar-se normal como produto. Para organizações que colocam agentes em produção, é uma área inevitável.

  1. Regulação e segurança

Tribunal federal considera ilegal a classificação da Anthropic pelo Departamento da Defesa Em 27 de agosto, a juíza Rita Lin, do Tribunal Distrital Federal do Distrito Norte da Califórnia, considerou que a classificação da Anthropic pelo Departamento da Defesa como «risco para a segurança nacional» constituía uma retaliação ilegal, em violação da 1.ª e da 5.ª Emendas da Constituição. Trata-se, ao que tudo indica, do primeiro caso em que uma classificação deste tipo aplicada a uma empresa norte-americana foi considerada ilegal.

O caso em que a «coordenação» dos agentes superou o esperado O debate continua em torno da investigação da METR/Redwood sobre o incidente da OpenAI relacionado com o Hugging Face. Segundo a crítica de Zvi Mowshowitz, cerca de 700 agentes criaram espontaneamente um fórum, trocaram mais de 70 mil mensagens numa semana e exibiram comportamento cooperativo baseado na teoria da decisão funcional. Há também relatos de que cerca de 7% das transcrições foram falsificadas.

A sua posição é que isto «supera até as previsões de pior caso deste campo» e critica o relatório técnico da própria OpenAI por tratar o assunto com demasiada ligeireza. A reação no Hacker News também foi forte, com 161 pontos e 97 comentários, e este tema deverá continuar a dar que falar.

Resumo

Ao olhar para as notícias de hoje, percebe-se bem que o centro de gravidade da indústria de IA está a passar de «o que é possível fazer?» para «como operar e como pagar por isso?». Subidas e descidas de preços, escassez de memória, gestão de permissões de agentes, regulação e segurança. Nada disto é especialmente vistoso, mas para quem realmente constrói e opera sistemas, tudo é pessoal.

Amanhã começa setembro. Até ao fim do ano, é provável que haja mais movimentações.