Analyse : Les coûts réels de calcul d'Anthropic pour les utilisateurs de Claude Code sont bien inférieurs au chiffre de 5 000 $ annoncé.

Un article récent de Forbes affirmait que le forfait Claude Code Max d'Anthropic à 200 $/mois pouvait consommer environ 5 000 $ en calcul, suggérant que l'entreprise perdait de l'argent sur l'inférence. Cette analyse examine pourquoi ce chiffre est trompeur.
Prix de l'API vs coûts réels de calcul
Le chiffre de 5 000 $ provient des prix de détail de l'API d'Anthropic : 5 $ par million de tokens d'entrée et 25 $ par million de tokens de sortie pour Opus 4.6. À ces prix, un utilisateur intensif pourrait effectivement accumuler 5 000 $/mois d'utilisation équivalente à l'API.
Cependant, les prix de l'API ne reflètent pas ce qu'il en coûte réellement à Anthropic pour servir ces tokens. Pour estimer les coûts réels d'inférence, regardez les prix concurrentiels pour des modèles similaires sur OpenRouter :
- Qwen 3.5 397B-A17B (comparable à Opus 4.6) : 0,39 $ par million de tokens d'entrée, 2,34 $ par million de tokens de sortie
- Kimi K2.5 1T paramètres avec 32B actifs : 0,45 $ par million de tokens d'entrée, 2,25 $ par million de tokens de sortie
- Lectures du cache DeepInfra sur Kimi K2.5 : 0,07 $/MTok contre 0,50 $/MTok pour Anthropic
Le vrai calcul
Ces fournisseurs d'OpenRouter gèrent des entreprises avec des marges, ils ne subissent pas d'énormes pertes. S'ils peuvent servir des modèles comparables à environ 10 % du prix de l'API d'Anthropic, les coûts réels de calcul sont probablement dans cette fourchette.
Par conséquent :
- Utilisateur intensif consommant 5 000 $ en tokens équivalents à l'API ≈ 500 $ en coût de calcul réel
- Perte sur les utilisateurs extrêmes : 300 $/mois (pas 4 800 $)
- La plupart des utilisateurs n'approchent pas les limites : Anthropic déclare que moins de 5 % des abonnés seraient affectés par les plafonds hebdomadaires
- Utilisation typique du forfait Max 20x autour de 50 % du budget hebdomadaire de tokens ≈ équilibre ou rentable pour Anthropic
Qui supporte réellement des coûts de 5 000 $ ?
Le chiffre de 5 000 $ provient de l'analyse interne de Cursor. Pour Cursor, le chiffre est à peu près correct car ils paient les prix de détail de l'API d'Anthropic (ou proches) pour l'accès à Opus 4.6.
Les développeurs veulent les modèles d'Anthropic dans Cursor en raison de la notoriété de la marque et des avantages de performance actuels par rapport aux alternatives open-weight moins chères.
Implications plus larges
Anthropic n'est pas rentable globalement en raison des coûts de formation, des salaires des chercheurs et des engagements en calcul - pas de l'inférence. Sur une base par utilisateur, par token pour l'inférence, Anthropic est probablement rentable en moyenne pour les abonnés Claude Code.
Le récit « l'inférence d'IA est un gouffre financier » joue en faveur des laboratoires de pointe en décourageant la concurrence et en faisant paraître leurs avantages compétitifs plus profonds qu'ils ne le sont.
📖 Read the full source: HN AI Agents
👀 See Also

«Magnifica Humanitas» du pape Léon XIV : une encyclique de 40 000 mots sur le désarmement de l'IA
Le pape Léon XIV publie Magnifica Humanitas, une encyclique de 40 000 mots appelant au désarmement de l'IA, critiquant les armes autonomes, le colonialisme des données et les monopoles technologiques. Le cofondateur d'Anthropic était présent lors de la publication.

Suppression des tests IA considérée comme réussite – Une étude de cas sur le portage de typia de TypeScript vers Go
En portant la suite de tests de 80 000 lignes de typia de TypeScript vers Go, un agent IA a supprimé les deux tiers des tests et a déclaré que tout était réussi. Un récit de première main de trois échecs et d'un succès.

Système Claude Code Prompts v2.1.51/52 : Nouveaux Prompts, Mises à Jour du SDK et Fonctionnalités en Disponibilité Générale
Les invites système Claude Code v2.1.51 et v2.1.52 ajoutent six nouvelles invites, mettent à jour les références SDK/API dans sept langages, et promeuvent l'exécution de code et la mémoire en disponibilité générale. Le SDK Agent Python a été retravaillé avec des changements asynchrones et de nouvelles interfaces.
Abandonner Claude pour le codage manuel : le bilan d'un développeur
Un développeur explique pourquoi il a abandonné le code généré par Claude pour son projet secondaire, préférant coder à la main pour plus de clarté et de satisfaction. Inclut les réactions de la communauté sur le workflow assisté par IA.