Analyse des coûts de DeepSeek V4 Flash : Taux de cache et rapport de prix expliqués

Un utilisateur de Reddit a analysé 922 traces de tâches agentiques exécutées sur OpenClaw (avec la boucle agent PI) et OpenRouter, comparant DeepSeek V4 Flash à Opus 4.7. La différence de coût est stupéfiante : 0,01 $ par tâche pour DeepSeek contre 1,52 $ pour Opus, malgré des nombres de tokens similaires (~962K en moyenne) et d'appels d'outils (~14 en moyenne). Le rapport de prix est de 0,0066x, bien en dessous des 0,03x attendus sur la seule base du prix des tokens d'entrée.
Pourquoi DeepSeek est moins cher : Taux de hit de cache et prix lecture/écriture
Deux facteurs expliquent cet écart :
- Taux de hit de cache : DeepSeek V4 Flash a atteint 97 % contre 87 % pour Opus 4.7. Avec ces rapports de prix lecture-écriture du cache, chaque augmentation de 1 % du taux de hit réduit le coût total d'environ 20 %. L'avantage de 10 % de DeepSeek réduit d'environ 2/3 le coût total.
- Rapport de prix lecture-écriture du cache : Le rapport de DeepSeek est de 0,02 (la lecture du cache coûte 2 % d'une écriture manquée), tandis que celui d'Opus est de 0,08 — comparable à OpenAI, Anthropic et Gemini (0,08–0,10). Cela réduit à lui seul le coût de moitié.
Comment cela s'additionne
Avec des tokens et des outils similaires par tâche, le coût total de DeepSeek est de 0,0066x celui d'Opus. L'utilisateur suppose que ces efficacités sont conçues au niveau de l'infrastructure ou de l'architecture du modèle (par exemple, une meilleure stratégie de mise en cache). Le mécanisme exact n'est pas divulgué.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Claude Code 2.1.63 ajoute des commandes slash groupées, des hooks HTTP et des corrections de fuites mémoire.
Anthropic a publié Claude Code 2.1.63 avec 26 modifications CLI, incluant les nouvelles commandes barre oblique /simplify et /batch, des crochets HTTP qui envoient des données JSON vers des URL, et des corrections pour plusieurs fuites de mémoire dans les sessions de longue durée.

Anthropic restreint les abonnements à Claude via des plateformes tierces comme OpenClaw.
Anthropic met fin à la couverture des abonnements Claude pour les interfaces tierces, y compris OpenClaw, à partir du 4 avril. Les utilisateurs devront activer une facturation à l'usage supplémentaire facturée séparément, avec un crédit unique équivalent au prix de l'abonnement mensuel disponible jusqu'au 17 avril.

La fuite du code source de Claude révèle des fonctions anti-distillation, un mode infiltré et une détection de frustration
Un fichier source map divulgué du package npm Claude Code révèle des techniques anti-distillation utilisant de faux outils, un mode discret qui masque la paternité IA, et une détection de frustration via des motifs regex.

GitHub Copilot met à jour la politique d'utilisation des données pour l'entraînement des modèles
GitHub utilisera les données d'interaction des utilisateurs de Copilot Free, Pro et Pro+ pour entraîner des modèles d'IA à partir du 24 avril 2026, sauf si les utilisateurs se désinscrivent. Les utilisateurs de Copilot Business et Enterprise sont exemptés de ce changement.