Microsoft mantém gastos de capital em IA inalterados em US$ 190 bilhões — primeiro hiperescalador a segurar a linha

Na quarta-feira, a Microsoft manteve sua previsão de capex de IA em US$ 190 bilhões para o ano-calendário (ajustado para US$ 175 bilhões devido a uma mudança contábil), tornando-se o primeiro grande hyperscaler a segurar os gastos. A ação subiu 8% com a notícia.
Contexto: A Farra de Gastos do Setor
Google, Amazon, Microsoft e Meta já haviam planejado gastar mais de US$ 700 bilhões este ano em data centers de IA. A maioria dos concorrentes ainda está aumentando suas previsões:
- Alphabet aumentou o capex em US$ 15 bilhões (ação caiu fortemente).
- Tesla elevou sua projeção (ação caiu).
- Meta reduziu sua faixa, elevando o ponto médio em US$ 2,5 bilhões.
O que está impulsionando os custos?
Os preços crescentes de chips de memória são um fator importante. A memória é um grande componente dos custos de data centers, e preços mais altos tornaram a construção de capacidade de IA mais cara. Uma descoberta de pesquisa: preços mais altos de memória explicam cerca de 45% do crescimento do capex das empresas de nuvem este ano.
A decisão da Microsoft de manter os gastos estáveis pode implicar que ela está, na verdade, reduzindo a construção de nova capacidade, já que o aumento de custos, de outra forma, elevaria o valor em dólares. Para os desenvolvedores, isso pode sinalizar uma estabilização na oferta de computação de IA — ou pelo menos uma pausa na expansão implacável.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Anthropic lança o Claude Code Remote Control para desenvolvimento móvel
A Anthropic lançou o Remote Control, um recurso que permite aos usuários do Claude Code controlar suas sessões de desenvolvimento local a partir de dispositivos móveis. Disponível inicialmente para assinantes do Claude Max, requer a versão 2.1.52 e usa um código QR para sincronizar sessões.

Analisando a Queima de Tokens da Janela de Contexto de 1M do Claude: Dados Mostram Crescimento Ilimitado e Acúmulo de Falhas de Cache
Análise da janela de contexto de 1 milhão do Claude revela dois fatores combinados que causam consumo rápido de tokens: crescimento ilimitado do contexto sem compactação automática e falhas caras de cache em tamanhos de contexto maiores. O autor fornece um script Python para analisar o uso pessoal de tokens a partir de arquivos de sessão JSONL.

Memória de Agente Não é um Problema de Armazenamento: É um Problema de Autoridade
Um desenvolvedor argumenta que a memória do agente falha não por erros de recuperação, mas porque todas as anotações retornam com igual autoridade. A solução: um grafo com funções, expiração e campos de ativação.

A pesquisa mostra que os usuários de IA frequentemente aceitam as respostas de LLMs sem verificação.
Pesquisa da Universidade da Pensilvânia descobriu que usuários de IA se envolvem em 'rendição cognitiva', aceitando respostas de LLMs com escrutínio mínimo. Em experimentos, usuários aceitaram respostas corretas da IA 93% das vezes e respostas incorretas 80% das vezes, mesmo quando a IA estava errada metade do tempo.