Microsoft annule les licences de Claude Code — les agents IA trop coûteux à déployer

Microsoft annule la plupart des licences directes Claude Code pour usage interne, redirigeant ses ingénieurs vers GitHub Copilot CLI, selon The Verge. Ce revient intervient six mois après que l'entreprise a ouvert l'accès à Claude Code, encourageant des milliers de développeurs, chefs de produit et designers à expérimenter cet outil de codage agentique. Il est devenu trop populaire – et trop cher.
Points clés
- L'accord Foundry de Microsoft avec Anthropic (investissement de 5 milliards $, engagement Azure de 30 milliards $) n'est pas concerné. Seules les licences directes internes Claude Code sont supprimées.
- Le CTO d'Uber, Praveen Neppalli Naga, a déclaré à The Information en avril que l'entreprise avait déjà épuisé l'intégralité de son budget 2026 pour les outils de codage IA en seulement quatre mois, après avoir encouragé l'adoption via des classements internes.
- Meta dispose d'un classement appelé « Claudeonomics » qui suit l'utilisation des tokens IA par employé. Amazon pousse au « toxenmaxx » – maximiser la consommation de tokens.
- Goldman Sachs prévoit que l'IA agentique pourrait entraîner une multiplication par 24 de la consommation de tokens d'ici 2030, jusqu'à 120 quadrillions de tokens par mois.
- Gartner prédit que le coût d'inférence pour un LLM de 1 billion de paramètres baissera d'environ 90 % d'ici 2030 par rapport à 2025, mais les dépenses totales des entreprises en IA continueront d'augmenter car les modèles agentiques nécessitent bien plus de tokens par tâche, et les fournisseurs d'IA ne répercuteront pas entièrement les économies sur les clients.
Bryan Catanzaro, VP chez Nvidia, résume : « Pour mon équipe, le coût du calcul dépasse de loin celui des employés. »
En résumé
L'économie des agents IA est inversée : des tokens moins chers ne signifient pas des factures moins élevées. Comme le découvrent Microsoft et Uber, la consommation de tokens dépasse les baisses de prix lorsque les agents sont déployés à grande échelle. Si vous budgétisez pour des outils IA en 2026, prévoyez des coûts 3 à 5 fois supérieurs à la base – à moins que les fournisseurs ne passent à des forfaits à prix fixe ou à usage plafonné.
📖 Lire la source complète : HN AI Agents
👀 See Also

Palantir IA à intégrer dans l'ensemble de l'armée américaine selon un rapport
Un rapport indique que l'armée américaine prévoit d'intégrer la technologie d'IA de Palantir dans toutes ses branches. L'article a généré 37 points et 24 commentaires sur Hacker News.

Apple offre son service Private Cloud Compute gratuit aux développeurs indépendants de moins de 2 millions de téléchargements
Apple a annoncé à la WWDC 2026 que les développeurs avec moins de 2 millions de premiers téléchargements sur l'App Store peuvent utiliser ses Foundation Models dans Private Cloud Compute sans coût d'API cloud. Le framework gagne également l'entrée d'image et le support des modèles serveur.

Les tests comparatifs montrent que les modèles distillés égalent les LLM de pointe sur les tâches structurées, pour un coût 10 fois inférieur.
Une comparaison exhaustive des petits modèles Qwen3 distillés (0,6B à 8B) face aux LLM de pointe montre que les modèles distillés égalent ou surpassent les modèles de pointe de niveau intermédiaire sur 6 tâches sur 9, à un coût considérablement inférieur, avec Text2SQL atteignant 98,0 % de précision à 3 $/M de requêtes contre 378 $ pour Claude Haiku.

Le modèle d'IA Claude Mythos d'Anthropic révélé dans une fuite de données, décrit comme un "changement d'étape" dans les capacités
Anthropic teste un nouveau modèle d'IA appelé Claude Mythos (également désigné sous le nom de Capybara) qui représente un 'changement d'étape' en termes de performances, avec des scores nettement supérieurs sur les tests de codage logiciel, de raisonnement académique et de cybersécurité par rapport à Claude Opus 4.6. L'existence du modèle a été révélée par une fuite de données provenant d'un cache de données non sécurisé et accessible au public, contenant environ 3 000 ressources non publiées.