Microsoft mantém gastos de capital em IA inalterados em US$ 190 bilhões — primeiro hiperescalador a segurar a linha

Na quarta-feira, a Microsoft manteve sua previsão de capex de IA em US$ 190 bilhões para o ano-calendário (ajustado para US$ 175 bilhões devido a uma mudança contábil), tornando-se o primeiro grande hyperscaler a segurar os gastos. A ação subiu 8% com a notícia.
Contexto: A Farra de Gastos do Setor
Google, Amazon, Microsoft e Meta já haviam planejado gastar mais de US$ 700 bilhões este ano em data centers de IA. A maioria dos concorrentes ainda está aumentando suas previsões:
- Alphabet aumentou o capex em US$ 15 bilhões (ação caiu fortemente).
- Tesla elevou sua projeção (ação caiu).
- Meta reduziu sua faixa, elevando o ponto médio em US$ 2,5 bilhões.
O que está impulsionando os custos?
Os preços crescentes de chips de memória são um fator importante. A memória é um grande componente dos custos de data centers, e preços mais altos tornaram a construção de capacidade de IA mais cara. Uma descoberta de pesquisa: preços mais altos de memória explicam cerca de 45% do crescimento do capex das empresas de nuvem este ano.
A decisão da Microsoft de manter os gastos estáveis pode implicar que ela está, na verdade, reduzindo a construção de nova capacidade, já que o aumento de custos, de outra forma, elevaria o valor em dólares. Para os desenvolvedores, isso pode sinalizar uma estabilização na oferta de computação de IA — ou pelo menos uma pausa na expansão implacável.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

A Anthropic lança o programa Embaixadores da Comunidade Claude
A Anthropic lançou o programa Claude Community Ambassadors, que fornece recursos para organizar encontros locais de desenvolvedores e conectar construtores em todo o mundo. O programa está aberto a participantes de qualquer formação e localização.

Usuário do Reddit relata 18,8 tok/s em inferência com CPU usando Qwen 3 30B Q4 em Zen 4
Um usuário no r/LocalLLaMA testou o Qwen 3 30B Q4 em CPU e alcançou 18,8 tokens por segundo com um processador Zen 4 e memória DDR5, superando significativamente as expectativas de 3-5 tok/s.

Arquitetura de IA Híbrida: Componentes de Código Aberto com Modelos de Raciocínio Proprietários
Uma arquitetura híbrida prática de IA está surgindo, onde 89% das organizações usam componentes de código aberto para reduzir custos em mais de 50%, enquanto modelos proprietários lidam com tarefas complexas de raciocínio. Os frameworks de código aberto oferecem transparência e capacidades de ajuste fino sem negociações de licenciamento.

Resultados da Avaliação Cega de Gemma 4 vs Qwen 3.5 com Claude Opus como Juiz
Uma avaliação cega de 30 perguntas comparou o Gemma 4 31B, o Gemma 4 26B-A4B e o Qwen 3.5 27B usando o Claude Opus 4.6 como juiz. O Qwen 3.5 27B venceu 46,7% dos confrontos, mas teve pontuações médias mais baixas devido a três respostas com pontuação zero.