Claude Opus 4.6 effort=low provoque un comportement d'agent paresseux

Le paramètre effort de Claude Opus 4.6 se comporte différemment des paramètres similaires d'autres fournisseurs d'IA, entraînant un comportement inattendu des agents lorsqu'il est réglé sur low.
Principales Constatations
Les tests ont révélé qu'avec effort=low, Claude Opus 4.6 a présenté un comportement significativement plus paresseux que prévu :
- A effectué moins d'appels d'outils
- A été moins minutieux dans la vérification croisée
- A effectivement ignoré certaines parties des instructions système indiquant comment effectuer des recherches web
- A renvoyé avec assurance des réponses incorrectes car il a cessé de chercher des informations
La source note que le passage à effort=medium a résolu tous ces problèmes. Selon la documentation, le paramètre effort d'Anthropic contrôle l'effort comportemental général, et pas seulement la profondeur de raisonnement comme reasoning.effort=low d'OpenAI ou thinking_level=low de Gemini.
Distinction Importante
Il ne s'agit pas d'un bug mais d'une différence documentée dans l'implémentation. Le paramètre effort dans Claude Opus 4.6 a une portée plus large que les paramètres équivalents d'autres fournisseurs. Cela signifie que vous ne pouvez pas traiter effort comme un remplacement direct pour reasoning.effort ou thinking_level lorsque vous travaillez avec différents fournisseurs d'IA.
Les tests ont été menés avec l'attente que effort=low se comporterait de manière similaire aux paramètres low-effort d'autres fournisseurs, mais le comportement réel était plus extrême, conduisant à des agents qui ne pensaient pas seulement moins, mais agissaient de manière globalement plus paresseuse.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Un moteur PHP écrit en Rust par une IA passe 17 % des tests de PHP-src et exécute WordPress
Phargo, un interpréteur PHP écrit de zéro en Rust entièrement par IA, passe 3 844 des 22 037 tests PHP officiels (17,4 %) et affiche des pages WordPress depuis SQLite.

Claude Code v2.1.89 ajoute des crochets différés, une nouvelle tentative de permission et corrige les fuites de mémoire.
Claude Code v2.1.89 introduit une décision d'autorisation 'defer' pour les hooks PreToolUse, ajoute un hook PermissionDenied avec capacité de réessai, et corrige des problèmes critiques incluant des fuites de mémoire avec de grandes entrées JSON et des échecs de cache de schéma StructuredOutput.

La Menace de Blocage de l'Internet Archive Met en Péril la Préservation de l'Histoire du Web
Des éditeurs majeurs, dont The New York Times, bloquent les robots d'exploration de l'Internet Archive en utilisant des mesures techniques allant au-delà du fichier robots.txt, ce qui risque de faire disparaître des archives historiques du web. La Wayback Machine de l'Archive contient plus d'un billion de pages archivées et Wikipédia renvoie à 2,6 millions d'articles de presse préservés dans 249 langues.

Les agences fédérales reçoivent l'ordre de cesser d'utiliser la technologie d'IA d'Anthropic.
Le président Donald Trump a ordonné aux agences gouvernementales américaines de cesser immédiatement d'utiliser la technologie de la société d'IA Anthropic. Cet ordre intervient alors qu'Anthropic subit des pressions du ministère de la Défense concernant les restrictions d'utilisation de ses modèles d'IA.