Microsoft cancela licenças do Claude Code — Agentes de IA são caros demais para escalar

A Microsoft está cancelando a maioria das licenças diretas do Claude Code para uso interno, realocando engenheiros de volta para o GitHub Copilot CLI, segundo The Verge. A reversão ocorre seis meses após a empresa abrir acesso ao Claude Code, incentivando milhares de desenvolvedores, gerentes de produto e designers a experimentar a ferramenta de codificação agente. Ela se tornou popular demais — e cara demais.
Detalhes Principais
- O acordo Foundry da Microsoft com a Anthropic (investimento de US$ 5 bilhões, compromisso de computação Azure de US$ 30 bilhões) não é afetado. Apenas as licenças diretas internas do Claude Code estão sendo cortadas.
- O CTO da Uber, Praveen Neppalli Naga, disse ao The Information em abril que a empresa já havia queimado todo o seu orçamento de ferramentas de codificação de IA de 2026 em apenas quatro meses, após incentivar a adoção por meio de rankings internos.
- A Meta possui um ranking chamado "Claudeonomics" que monitora o uso de tokens de IA por funcionário. A Amazon promove "toxenmaxx" — maximizar o consumo de tokens.
- O Goldman Sachs prevê que a IA agente pode impulsionar um aumento de 24 vezes no consumo de tokens até 2030, chegando a 120 quatrilhões de tokens por mês.
- A Gartner prevê que o custo de inferência para um LLM de 1 trilhão de parâmetros cairá cerca de 90% até 2030 em comparação com 2025, mas o gasto total das empresas com IA ainda aumentará porque os modelos agentes exigem muito mais tokens por tarefa, e os provedores de IA não repassarão totalmente a redução de custos aos clientes.
O vice-presidente da Nvidia, Bryan Catanzaro, resumiu: "Para minha equipe, o custo da computação é muito superior aos custos dos funcionários."
Conclusão
A economia dos agentes de IA está invertida: tokens mais baratos não significam contas mais baratas. Como a Microsoft e a Uber estão descobrindo, o consumo de tokens supera as quedas de preço quando os agentes são implantados em escala. Se você está fazendo orçamento para ferramentas de IA em 2026, planeje custos 3 a 5 vezes maiores que a linha de base — a menos que os provedores mudem para planos de preço fixo ou com limite de uso.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Claude.ai está enfrentando erros elevados e problemas de login
O Claude.ai está relatando erros elevados que afetam a plataforma, incluindo problemas de login especificamente para o Claude Code. O incidente foi oficialmente publicado em 11 de março de 2026 às 17:19:35 UTC.

A IA Já Matou a Academia Como a Conhecemos — Por Dentro do Jogo de Volume
Um professor titular explica como a IA torna o volume acadêmico infinito: redações de alunos indetectáveis, produção de um artigo por dia e fluxos de submissão de bolsas que manipulam o sistema. O jogo não faz mais sentido.

RTX 5080 16GB: Qwen3.6 35B MoE em Contexto de 128k — 56 tok/s, e Por Que o MTP Não Ajuda
Novos benchmarks mostram que o Qwen3.6 35B MoE na RTX 5080 16GB atinge 56 tok/s de geração com contexto de 128k. O MTP (Multi-Token Prediction) torna-o 23% mais lento devido à pressão de VRAM que empurra camadas de especialistas para a CPU.

Bram Cohen critica o 'vibe coding' e as práticas de desenvolvimento assistidas por IA
Bram Cohen argumenta que a 'programação por vibração' — onde desenvolvedores evitam olhar para o código enquanto usam assistentes de IA — leva a uma baixa qualidade de software, usando o vazamento do código-fonte do Claude como exemplo dos problemas do dogfooding excessivo.