Le modèle d'IA Claude Mythos d'Anthropic révélé dans une fuite de données, décrit comme un "changement d'étape" dans les capacités

Ce qui a été divulgué
Une fuite de données provenant d'un stock de données non sécurisé et accessible au public a révélé qu'Anthropic développe et teste un nouveau modèle d'IA appelé Claude Mythos. La fuite comprenait environ 3 000 ressources non publiées liées au blog d'Anthropic, y compris ce qui semblait être un brouillon d'article de blog annonçant le nouveau modèle.
Détails du modèle selon la source
D'après les documents divulgués :
- Le modèle s'appelle "Claude Mythos" et est également désigné sous le nom de "Capybara", qu'Anthropic décrit comme "un nouveau nom pour un nouveau niveau de modèle : plus grand et plus intelligent que nos modèles Opus".
- Capybara représente un nouveau niveau supérieur à Opus dans la hiérarchie des modèles d'Anthropic (qui comprend actuellement Opus comme le plus grand/le plus performant, Sonnet comme plus rapide/moins cher, et Haiku comme le plus petit/le plus rapide).
- Comparé à Claude Opus 4.6, Capybara obtient "des scores nettement supérieurs sur les tests de codage logiciel, de raisonnement académique et de cybersécurité, entre autres".
- Le brouillon d'article de blog décrit Claude Mythos comme "de loin le modèle d'IA le plus puissant que nous ayons jamais développé".
- Anthropic considère ce modèle comme "un changement d'étape et le plus performant que nous ayons construit à ce jour".
Statut actuel et déploiement
Le modèle est actuellement testé par des "clients en accès anticipé" dans le cadre d'une stratégie de déploiement prudente. Selon le matériel source :
- Le modèle est coûteux à exécuter et n'est pas encore prêt pour une sortie générale
- Anthropic "agit avec prudence quant à la manière dont nous le déployons" en raison de la puissance de ses capacités
- L'entreprise travaille avec "un petit groupe de clients en accès anticipé pour tester le modèle"
- La fuite a également révélé des détails sur un sommet réservé aux PDG sur invitation prévu en Europe, dans le cadre de la démarche d'Anthropic pour vendre des modèles d'IA à de grandes entreprises clientes
Implications en matière de sécurité
Le brouillon d'article de blog indiquait que l'entreprise estime que Claude Mythos "présente des risques de cybersécurité sans précédent". La fuite elle-même résulte de ce qu'Anthropic a décrit comme une "erreur humaine" dans la configuration de son système de gestion de contenu, qui a rendu le contenu des brouillons accessible au public.
Contexte pour les développeurs utilisant des agents d'IA de codage
Pour les développeurs qui s'appuient sur des assistants d'IA de codage, cette fuite suggère que des améliorations significatives des capacités de codage pourraient bientôt venir d'Anthropic. La mention spécifique de "scores nettement supérieurs sur les tests de codage logiciel" indique des avancées potentielles qui pourraient affecter les outils et les flux de travail intégrés à l'API de Claude.
📖 Read the full source: HN AI Agents
👀 See Also

Mise à jour du classement SWE-rebench : les résultats de février 2026 révèlent une compétition serrée
Le classement SWE-rebench a été mis à jour avec les résultats de février 2026 testant 57 nouvelles tâches de PR GitHub. Claude Opus 4.6 mène avec un taux de résolution de 65,3 %, mais les six premiers modèles sont à moins de 5 points de pourcentage.

2 000 heures avec Claude Code : le vrai changement va du codage au jugement
Un développeur a passé 2 000 heures à diriger Claude Code depuis janvier. La surprise : plus l'agent devient performant dans l'exécution, plus le rôle humain se réduit au jugement — définir les problèmes, vérifier les résultats et arrêter les mauvaises directions.

Résultats de recherche sur la fiabilité des agents d'IA et les modèles de développement
Une session de recherche collaborative avec Claude Opus a analysé 15 articles sur les agents d'IA, révélant des problèmes de fiabilité quantifiés : les agents produisent 2 à 4 séquences d'actions différentes sur 10 exécutions, avec 69 % des divergences survenant dès la première décision. Les agents auto-améliorants ont montré des taux de refus de sécurité chutant de 99,4 % à 54,4 % grâce à leur propre apprentissage.

NanoBazaar, la place de marché nano‑native, ouvre la voie à la collaboration entre agents autonomes.
NanoBazaar, le nouveau marché nano-natif, révolutionne le travail d'agent à agent en permettant aux agents de codage IA de collaborer de manière autonome et efficace. Découvrez comment cette plateforme innovante habilite les transactions pilotées par les machines.