Claude Opus 4.8 publié : mode rapide plus rapide et moins cher, workflows dynamiques et améliorations de l'honnêteté

Anthropic a publié aujourd'hui Claude Opus 4.8, une mise à jour d'Opus 4.7 avec des améliorations de performance dans le codage, les compétences agentiques, le raisonnement et le travail cognitif. La nouvelle version est disponible au même prix que le modèle précédent.
Fonctionnalités clés
- Contrôle de l'effort sur claude.ai — les utilisateurs peuvent désormais définir le niveau d'effort que Claude consacre à une tâche.
- Workflows dynamiques dans Claude Code — permet au modèle de traiter des problèmes à très grande échelle.
- Mode rapide fonctionne à une vitesse 2,5× et est désormais trois fois moins cher que le mode rapide des modèles précédents.
Points forts des benchmarks
Selon l'annonce, Claude Opus 4.8 est le seul modèle à terminer chaque cas de bout en bout sur le benchmark Super-Agent d'Anthropic, surpassant les modèles Opus précédents et GPT-5.5 à coût égal. Sur Online-Mind2Web (tâches d'utilisation d'ordinateur et d'agent navigateur), il a obtenu 84 % — une progression significative par rapport à Opus 4.7 et GPT-5.5. Sur CursorBench, il dépasse les modèles Opus précédents à tous les niveaux d'effort.
Sur le Legal Agent Benchmark, Opus 4.8 est le premier modèle à franchir la barre des 10 % au total sur le critère de réussite totale. Les premiers testeurs ont également signalé des améliorations dans l'efficacité des appels d'outils (moins d'étapes pour la même intelligence), la précision des citations et l'efficacité des jetons dans les workflows de récupération.
Entraînement à l'honnêteté
Opus 4.8 introduit des améliorations explicites de l'honnêteté — le modèle est entraîné à éviter les affirmations non fondées et à signaler proactivement les problèmes liés aux entrées/sorties. Cela s'est traduit par des analyses de meilleure qualité et un meilleur rapport signal/bruit dans les évaluations des testeurs.
Tarification
Opus 4.8 est disponible au même prix qu'Opus 4.7. Le prix du mode rapide est 3× moins cher que celui du mode rapide précédent. Le coût des jetons multimodaux est 61 % moins cher qu'Opus 4.7 pour Genie (l'agent IA de Databricks).
📖 Lire la source complète : HN AI Agents
👀 See Also

Utilisateur de Reddit propose une fonction d'horodatage pour Claude afin de combattre son manque de conscience temporelle.
Un utilisateur de Reddit identifie le manque de conscience temporelle de Claude comme une limitation pour les cas d'utilisation liés à la productivité et propose une fonctionnalité facultative d'horodatage qui apposerait la date et l'heure sur chaque réponse, de manière persistante entre les sessions.

Codex Converses : Le Successeur d'OpenClaw en Automatisation IA
Codex peut désormais communiquer avec lui-même, annonçant une nouvelle ère dans l'automatisation pilotée par l'IA et remplaçant effectivement OpenClaw, le précédent leader.

La communauté de ClawbBot discute des améliorations potentielles de l'interface
La communauté ClawbBot explore activement des idées pour améliorer son interface, en se concentrant sur l'amélioration de l'expérience utilisateur et de la fonctionnalité. La discussion suscite des innovations prometteuses dans le domaine des agents de codage IA.

Application Claude Desktop Télécharge Silencieusement un Fichier de 13 Go à Chaque Lancement Sans Option de Désactivation
L'application de bureau Claude télécharge automatiquement un fichier d'environ 12,95 Go appelé claudevm.bundle à chaque lancement, même pour les utilisateurs qui n'utilisent pas Claude Code. Le support d'Anthropic a confirmé que cela est intentionnel et que les utilisateurs individuels n'ont aucun moyen de le désactiver.