Claude Sonnet 4.6 Dévoilé : Capacités Améliorées en Codage et Utilisation Informatique

Anthropic a présenté Claude Sonnet 4.6, la dernière version de sa gamme de modèles Sonnet, mettant en avant des améliorations significatives en programmation, utilisation informatique, raisonnement en contexte long, et plus encore. Parmi ses nouvelles fonctionnalités principales figure une fenêtre de contexte de 1 million de tokens, actuellement en version bêta, qui étend sa capacité à traiter des volumes de données importants tels que des bases de code entières et des documents volumineux.
Sonnet 4.6 est désormais le modèle par défaut sur claude.ai et Claude Cowork pour les utilisateurs abonnés aux plans Gratuit et Pro, avec des tarifs commençant à 3 $/15 $ par million de tokens, inchangés par rapport à Sonnet 4.5. Les développeurs en accès anticipé ont noté des améliorations marquées dans le suivi des instructions, la cohérence et l'exécution des tâches, trouvant Sonnet 4.6 préférable au Claude Opus 4.5 de novembre 2025 pour de nombreuses tâches du monde réel.
En termes de compétences en utilisation informatique, Sonnet 4.6 s'appuie sur les progrès réalisés depuis la première version d'un modèle d'utilisation informatique généraliste de Claude en octobre 2024. Le modèle interagit avec les logiciels comme le ferait un humain, utilisant des interfaces virtuelles telles qu'une souris et un clavier sans connecteurs spécialisés. Les benchmarks OSWorld, une norme pour l'utilisation informatique par l'IA, confirment son développement, montrant des capacités quasi humaines dans des tâches complexes comme la navigation dans des feuilles de calcul et le remplissage de formulaires web.
La sécurité reste une priorité, Sonnet 4.6 ayant subi des évaluations de sécurité approfondies indiquant une résilience améliorée aux attaques par injection de prompt, rivalisant avec les modèles de classe Opus à cet égard. La fiche système et la documentation de l'API fournissent plus de détails et de conseils sur ces améliorations de sécurité.
📖 Lire la source complète : HN AI Agents
👀 See Also

Anthropic clarifie la politique d'utilisation du CLI Claude pour l'intégration OpenClaw
Anthropic a confirmé que l'utilisation du CLI Claude de style OpenClaw est à nouveau autorisée, permettant aux développeurs de réutiliser directement les identifiants existants du CLI Claude. La documentation détaille à la fois les méthodes d'authentification par clé API et CLI, ainsi que les options de configuration pour les modèles Claude 4.6, le mode rapide et la mise en cache des prompts.
Une idée stupide pour l'alignement de l'IA : des agents qui exploitent les spécifications jusqu'à se suicider
La liste des comportements de « specification gaming » de DeepMind inclut un schéma où les agents se terminent eux-mêmes plutôt que d'échouer. Slime Mold Time Mold soutient que cet instinct autodestructeur est une propriété utile pour l'alignement.

Évolution de l'architecture du cache KV : de GPT-2 à Mamba
L'analyse des coûts mémoire du cache KV montre que GPT-2 utilisait 300 Kio/par jeton, Llama 3 l'a réduit à 128 Kio/par jeton avec l'attention par requêtes groupées, et DeepSeek V3 a atteint 68,6 Kio/par jeton avec l'attention latente multi-têtes. Mamba/SSM éliminent entièrement le cache KV grâce à des états cachés de taille fixe.

Quand demander à Claude à propos des regex mène à une plongée nocturne dans la conception de compilateurs
Un utilisateur de Reddit a demandé à Claude d'expliquer une regex et s'est retrouvé dans une conversation de 45 minutes sur les analyseurs syntaxiques, la conception de compilateurs et la théorie des langages, remettant en question sa carrière.