Anomalie de facturation de l'API Anthropic : Le modèle Sonnet facturé aux tarifs Opus

Détails du Bug
Un écart de facturation significatif a été identifié dans l'API Anthropic pour le modèle claude-sonnet-4-6. Bien que l'API rapporte correctement le modèle comme Sonnet dans la réponse, le calcul de facturation réel utilise les tarifs d'Opus, entraînant des charges plus élevées que prévu.
Preuves des Données d'Événements Brutes
Le bug a été découvert par l'analyse d'une requête à haut nombre de jetons avec une mise en cache importante de l'invite. Les points de données spécifiques des événements bruts sont :
- Modèle Rapporté : claude-sonnet-4-6
- Jetons d'Entrée : 6
- Jetons de Sortie : 4 034
- Création de Cache (Écriture) : 61 920 jetons
- Lecture de Cache : 171 391 jetons
- Coût Total Facturé (totalCostUsd) : 0,5735755 $
L'utilisateur a noté que ce coût total correspond exactement à ce qui serait attendu pour les tarifs d'Opus, et non pour ceux de Sonnet, créant une différence de coût significative pour les utilisateurs de l'API.
Impact et Contexte
Ce bug affecte les développeurs utilisant l'API Claude d'Anthropic avec le modèle Sonnet. Étant donné qu'Opus est le niveau de modèle le plus cher d'Anthropic, cet écart pourrait entraîner des coûts substantiellement plus élevés que prévu. Le bug semble se situer dans la logique de calcul de facturation plutôt que dans la sélection du modèle elle-même, car l'API identifie correctement le modèle comme Sonnet dans les réponses.
Pour les développeurs surveillant les coûts de l'API, cela signifie que les rapports de facturation actuels peuvent être inexacts pour l'utilisation de Sonnet. Le problème a été signalé sur le subreddit ClaudeAI où les utilisateurs discutent des solutions de contournement potentielles et surveillent une correction officielle d'Anthropic.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Anthropic suspend la modification du crédit pour Claude Code – L’Agent SDK reste sur abonnement
Anthropic suspend le transfert prévu de l'Agent SDK, claude -p et des applications tierces vers un crédit mensuel dédié. L'utilisation continue sous les limites d'abonnement existantes.

Opus 4.6 Moyen vs Faible : Différences de Performance et Tarification
Opus 4.6 moyen coûte environ 50 % de plus que la version basse, mais résout d'importants problèmes de paresse observés dans le modèle peu puissant. La version moyenne se situe entre les versions basse et haute dans les benchmarks de performance.

Utilisateurs d'OpenClaw Docker : mise à jour 2026.3.13 - balises Docker manquantes
La version 2026.3.13 d'OpenClaw a été publiée, mais les utilisateurs de Docker devraient éviter de mettre à jour car l'image Docker ne possède ni les étiquettes 'latest' ni '2026.3.13'. Les utilisateurs exécutant depuis npm ou git ne sont pas affectés.

Porte d'Attention : Le Défi de l'Oubli Sélectif dans les Systèmes de Mémoire IA
Un développeur construisant un système de mémoire à cinq couches pour un bot OpenClaw identifie une limitation clé : les approches actuelles se concentrent sur le rappel mais manquent de mécanismes pour supprimer les informations non pertinentes pendant les tâches ciblées, similaire au filtrage attentionnel humain.