Test A/B de Claude Code réduit silencieusement l'effort « Élevé » au niveau « Faible » précédent

✍️ OpenClawRadar📅 Publié: August 23, 2026🔗 Source
Ad

Les développeurs utilisant Claude Code ont peut-être remarqué une baisse soudaine des performances cette semaine. Selon un rapport de l'utilisateur X @argofowl, Anthropic mène un test A/B côté serveur qui réduit silencieusement le niveau d'effort effectif pour certaines sessions. Le changement affecte Claude Code version 2.1.236 et ultérieures, où le modèle interprète désormais l'effort "élevé" comme 10 sur 100 — la valeur exacte que "faible" utilisait auparavant. Les versions plus anciennes et Opus 5 ne sont pas affectées, et le journal des modifications n'en fait pas mention.

Détails clés

  • Version concernée : Claude Code 2.1.236+ (notamment après 2.1.237)
  • Changement : L'échelle d'effort est réduite côté serveur ; "élevé" correspond désormais à 10/100 au lieu de sa valeur supérieure précédente.
  • Portée : Uniquement les sessions concernées — c'est un test A/B, donc tout le monde ne le voit pas.
  • Détection : Si "élevé" vous semble équivalent à "faible", vous faites partie du groupe de test.
  • Aucune entrée dans le journal des modifications : Le changement a été effectué sans aucune documentation publique.

Le rapporteur, @argofowl, a passé un après-midi convaincu que ses propres outils étaient cassés avant de découvrir le problème. Il a exprimé sa frustration face aux pratiques de test opaques d'Anthropic : "holy fuck anthropic, vous êtes parfois insupportables."

Ad

Analyse

Ce n'est pas un correctif côté client — c'est une configuration côté serveur qui affecte la façon dont le modèle interprète les paramètres d'effort. Si vous utilisez la version 2.1.236 ou ultérieure et que vous remarquez une baisse de qualité de sortie lorsque vous réglez l'effort sur "élevé", vous faites peut-être partie de cette expérience. Pour éviter le test, vous pouvez épingler une version plus ancienne (par exemple 2.1.235 ou antérieure) ou attendre qu'Anthropic déploie ou annule ce changement. Comme il s'agit d'un test A/B, votre expérience peut varier.

Pour les développeurs qui comptent sur un comportement cohérent de l'agent de codage IA, ce type de changement silencieux est préoccupant. Aucune déclaration officielle d'Anthropic n'a encore été faite, et le changement n'est mentionné dans aucun journal public des modifications. Si vous êtes concerné, vérifiez votre version de Claude Code et envisagez éventuellement une rétrogradation pour assurer des performances stables.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Régression de performance de Claude Code diagnostiquée : Configuration, pas intelligence du modèle
News

Régression de performance de Claude Code diagnostiquée : Configuration, pas intelligence du modèle

Le post-mortem d'Anthropic révèle que la baisse de performance de Claude Code a été causée par trois changements de produit — l'effort de raisonnement par défaut, un bug de mise en cache de session et un changement de verbosité des prompts — et non par une dégradation du modèle. Le retour en arrière a rétabli les performances.

OpenClawRadar
🦀
News

Opus 4.7 peut suivre environ 500 instructions, contre environ 150 il y a un an

Des recherches mises à jour en mai 2026 montrent qu'Opus 4.7 peut suivre de manière fiable environ 500 instructions, contre environ 150 en juillet 2025. GPT-5.5 en gère environ 5000. Implications pour la taille du fichier CLAUDE.md.

OpenClawRadar
MCP fonctionne aussi avec les modèles locaux — L'écosystème des serveurs mûrit rapidement
News

MCP fonctionne aussi avec les modèles locaux — L'écosystème des serveurs mûrit rapidement

MCP n'est pas réservé à Claude. Les modèles locaux avec appel de fonctions fonctionnent parfaitement. Open Web UI propose désormais un client MCP basique. Les modèles 13B+ gèrent le mieux les outils multi-étapes.

OpenClawRadar
L'analyse de 100 millions de tokens dans Claude Code révèle une utilisation de 99,4 % des entrées.
News

L'analyse de 100 millions de tokens dans Claude Code révèle une utilisation de 99,4 % des entrées.

L'analyse de 1 289 requêtes sur des sessions de codage prolongées montre que Claude Code a utilisé 100,3 millions de tokens d'entrée (99,4 %) contre seulement 616 000 tokens de sortie (0,6 %), avec 84,2 millions de tokens mis en cache en raison de la réenvoi répété du contexte.

OpenClawRadar