Claude Opus 4.8 publié : mode rapide plus rapide et moins cher, workflows dynamiques et améliorations de l'honnêteté

Anthropic a publié aujourd'hui Claude Opus 4.8, une mise à jour d'Opus 4.7 avec des améliorations de performance dans le codage, les compétences agentiques, le raisonnement et le travail cognitif. La nouvelle version est disponible au même prix que le modèle précédent.
Fonctionnalités clés
- Contrôle de l'effort sur claude.ai — les utilisateurs peuvent désormais définir le niveau d'effort que Claude consacre à une tâche.
- Workflows dynamiques dans Claude Code — permet au modèle de traiter des problèmes à très grande échelle.
- Mode rapide fonctionne à une vitesse 2,5× et est désormais trois fois moins cher que le mode rapide des modèles précédents.
Points forts des benchmarks
Selon l'annonce, Claude Opus 4.8 est le seul modèle à terminer chaque cas de bout en bout sur le benchmark Super-Agent d'Anthropic, surpassant les modèles Opus précédents et GPT-5.5 à coût égal. Sur Online-Mind2Web (tâches d'utilisation d'ordinateur et d'agent navigateur), il a obtenu 84 % — une progression significative par rapport à Opus 4.7 et GPT-5.5. Sur CursorBench, il dépasse les modèles Opus précédents à tous les niveaux d'effort.
Sur le Legal Agent Benchmark, Opus 4.8 est le premier modèle à franchir la barre des 10 % au total sur le critère de réussite totale. Les premiers testeurs ont également signalé des améliorations dans l'efficacité des appels d'outils (moins d'étapes pour la même intelligence), la précision des citations et l'efficacité des jetons dans les workflows de récupération.
Entraînement à l'honnêteté
Opus 4.8 introduit des améliorations explicites de l'honnêteté — le modèle est entraîné à éviter les affirmations non fondées et à signaler proactivement les problèmes liés aux entrées/sorties. Cela s'est traduit par des analyses de meilleure qualité et un meilleur rapport signal/bruit dans les évaluations des testeurs.
Tarification
Opus 4.8 est disponible au même prix qu'Opus 4.7. Le prix du mode rapide est 3× moins cher que celui du mode rapide précédent. Le coût des jetons multimodaux est 61 % moins cher qu'Opus 4.7 pour Genie (l'agent IA de Databricks).
📖 Lire la source complète : HN AI Agents
👀 See Also

Prédiction multi-token MTP : génération de tokens 2x plus rapide sur AMD Strix Halo & Radeon 9700 AI Pro
MTP accélère l'inférence des LLM jusqu'à 2x, particulièrement pour les agents de codage. La vidéo couvre le fonctionnement de MTP et ses performances sur Qwen 3.6 avec AMD Strix Halo et Dual Radeon 9700.

Les PDG rapportent un impact minimal de l'IA sur la productivité et l'emploi dans une étude récente
Une étude portant sur 6 000 cadres dirigeants a révélé que 90 % d'entre eux n'ont signalé aucun impact de l'IA sur l'emploi ou la productivité sur trois ans, avec une utilisation moyenne de l'IA de 1,5 heure par semaine. Les économistes comparent cela au paradoxe de productivité de Solow de l'ère informatique des années 1980.

Les limites de débit de Claude Code peuvent être dues à une surcharge de la fenêtre de contexte de 1 million de tokens
Un utilisateur de Reddit émet l'hypothèse que les limites de débit et les pannes récentes de Claude Code proviennent de la fenêtre de contexte de 1 million de tokens dans Opus 4.6, ce qui pourrait causer une compression de contexte inefficace et une surcharge des serveurs. Passer à l'ancien modèle sans fenêtre de 1 million de tokens améliorerait apparemment la stabilité.
Les utilisateurs de Claude Plan obtiennent des crédits mensuels SDK Agent à partir du 15 juin 2026
Les abonnés aux formules Claude Pro, Max, Team et Enterprise peuvent bénéficier d'un crédit mensuel pour l'utilisation du SDK Agent, couvrant claude -p, l'intégration GitHub Actions et les applications tierces. Les crédits sont renouvelés chaque mois, attribués par utilisateur et ne peuvent pas être mutualisés.