Mémoire représente maintenant 63% du coût des puces IA : les dépenses HBM atteignent 32 milliards de dollars

La dernière analyse d'Epoch AI révèle que la mémoire à large bande passante (HBM) représente désormais près des deux tiers du coût des composants des puces IA. Entre le T1 2024 et le T4 2025, la part de HBM est passée de 52 % à 63 % sur les puces conçues par Nvidia, AMD, Google et Amazon, pondérées par le volume de production. La dépense totale en composants pour les puces IA est passée de 22 milliards de dollars en 2024 à 52 milliards de dollars en 2025, HBM contribuant à elle seule à 20 milliards de cette augmentation.
Chiffres clés
- Mémoire (HBM) : part de 52 % → 63 %. Dépense absolue passée d'environ 12 milliards de dollars (2024) à 32 milliards (2025).
- Puces logiques : part quasi stable, autour de 13–14 %.
- Packaging avancé (CoWoS) : part passée de 19 % à 15 %.
- Composants auxiliaires : part passée de 15 % à 9 %.
Pourquoi c'est important
La mémoire est désormais le principal facteur de coût dans les accélérateurs IA. Epoch modélise les coûts par puce à partir de rapports financiers, de déclarations de fournisseurs et d'analyses sectorielles dans quatre catégories : les piles HBM (HBM3, HBM3e), les puces logiques sur nœud avancé (3–5 nm), le packaging CoWoS de TSMC et les composants auxiliaires (substrat, alimentation). Ce changement est dû à une offre de mémoire tendue et à la hausse des prix HBM. Les hyperscalers intègrent déjà cela dans leurs prévisions de dépenses d'investissement : Microsoft prévoit 190 milliards de dollars pour l'exercice 2026, dont environ 25 milliards liés à la hausse des prix des composants ; Meta a relevé de 10 milliards de dollars sa fourchette de dépenses d'investissement 2026 pour la même raison.
Plages d'incertitude
Epoch fournit des intervalles de confiance à 90 % et deux métriques limites :
- Fourchette basée uniquement sur le coût de la mémoire : 60–67 % au T4 2025.
- Fourchette avec tous les composants aux extrêmes : 54–73 % au T4 2025.
La tendance suggère que la part de la mémoire continuera de croître en 2026, car l'offre de HBM reste limitée.
📖 Lire la source complète : HN AI Agents
👀 See Also

Granite 4.1 : Le modèle dense 8B d'IBM égale le MoE 32B dans les benchmarks
Le modèle dense Granite 4.1 8B d'IBM correspond ou surpasse le précédent modèle MoE 32B sur ArenaHard, BFCL V3, GSM8K et d'autres benchmarks, grâce à une meilleure qualité des données d'entraînement.

L'UE oblige Meta à autoriser gratuitement les chatbots IA concurrents sur WhatsApp
Les régulateurs européens ont ordonné à Meta de permettre aux chatbots IA concurrents d'accéder gratuitement aux données de WhatsApp pour intégration, à partir de juin 2026.

Titre de l'article : Le mythe de Claude d'Anthropic : marketing de la peur ou risque réel ?
Anthropic affirme que son modèle Claude Mythos excelle dans la recherche de bugs de cybersécurité, mais les critiques soutiennent que les mises en garde de l'entreprise contre une catastrophe sont un stratagème marketing pour détourner l'attention des préjudices actuels et influencer les régulateurs.

Quand demander à Claude à propos des regex mène à une plongée nocturne dans la conception de compilateurs
Un utilisateur de Reddit a demandé à Claude d'expliquer une regex et s'est retrouvé dans une conversation de 45 minutes sur les analyseurs syntaxiques, la conception de compilateurs et la théorie des langages, remettant en question sa carrière.