Claude Code v2.1.201 abandonne le rôle système en milieu de conversation pour les sessions Sonnet 5

Anthropic a publié Claude Code v2.1.201 le 3 juillet, avec un changement unique mais significatif : les sessions Claude Sonnet 5 n'injectent plus de rappels de harnais via le rôle système en milieu de conversation.
Ce qui a changé
Auparavant, lors d'une session Sonnet 5, le harnais (l'infrastructure d'appel d'outils) réinsérait périodiquement des rappels au niveau du système concernant les outils disponibles, les permissions et les règles de contexte dans la conversation. Cela consommait des jetons et pouvait encombrer l'historique du chat. La version v2.1.201 supprime complètement ce comportement pour les sessions Sonnet 5.
Le changement est spécifique à Claude Sonnet 5 — les autres modèles ne sont pas affectés. Le commit exact est c489eb2.
Pourquoi c'est important
Pour les développeurs effectuant de longues sessions de codage avec Claude Code, le rôle système en milieu de conversation signifiait que chaque tour avait un surcoût caché en nombre de jetons et en clarté du prompt. Le supprimer devrait réduire la dépense de jetons et rendre le fil de conversation plus propre, en particulier pour les tâches itératives comme le débogage ou la génération de code où le contexte du harnais n'a pas besoin d'être réexpliqué.
Si vous utilisez Claude Code avec Sonnet 5, mettez à jour vers cette version pour éviter les insertions inutiles du rôle système. Les agents qui comptaient sur ces rappels pour rester sur la bonne voie (peu probable, car les rappels sont pour le harnais, pas pour le raisonnement du modèle) doivent vérifier le comportement après la mise à jour.
📖 Lire la source complète : GitHub Claude-Code
👀 See Also

Qwen 3 8B surpasse des modèles plus volumineux lors d'évaluations en aveugle par les pairs sur des tâches difficiles.
Lors d'une évaluation en aveugle par les pairs de 10 petits modèles de langage sur 13 tâches difficiles de niveau frontière, Qwen 3 8B a remporté 6 évaluations et s'est classé dans le top 3 dans 12 des 13 tâches, surpassant des modèles ayant jusqu'à 4 fois plus de paramètres. L'évaluation couvrait le débogage de verrous distribués, les bogues de concurrence en Go, l'optimisation SQL, le diagnostic médical bayésien, le paradoxe de Simpson, le théorème de vote d'Arrow et l'analyse du biais du survivant.

Apple utilise l'accès à Google Gemini pour la distillation de modèles d'IA sur l'appareil
Apple a un accès complet au modèle Gemini de Google pour la distillation, créant ainsi des modèles d'IA plus petits et embarqués pour Siri et d'autres fonctionnalités dans iOS 27 sans nécessiter de connexion internet.

inclusionAI dévoile Ling-2.6-1T : modèle à trillion de paramètres en architecture hybride avec attention éparse et pensée rapide
Ling-2.6-1T est un nouveau modèle open-source de mille milliards de paramètres qui combine MLA et Attention Linéaire pour une efficacité en contexte long, en utilisant la Suppression de Redondance de Processus Contextuel pour réduire les chaînes de pensée verbeuses. Il atteint un SOTA open-source sur AIME26, SWE-bench Verified, BFCL-V4, TAU2-Bench et IFBench.
L'IA résout les défis CTF en quelques minutes — ce que cela signifie pour la formation en cybersécurité
Au BSidesSF 2026, un agent autonome a résolu les 52 défis du CTF en quelques minutes, remportant la première place. Cela force à repenser la manière dont les compétences en cybersécurité sont mesurées et entraînées.