Claude Fable 5.1 et Mythos 5.1 : Même modèle, garanties différentes
Anthropic vient de publier Claude Fable 5.1 et Claude Mythos 5.1 — le même modèle sous-jacent, mais avec des niveaux de sécurité différents. Fable 5.1 est généralement disponible ; Mythos 5.1 est limité à des programmes d'accès de confiance pour la cybersécurité et les sciences de la vie.
Tarification et conservation des données
Fable 5.1 coûte environ 25% de moins que Fable 5 pour les charges de travail typiques facturées au token, grâce à une réduction des prix sur les lectures de cache (entrées déjà traitées et stockées). Pour les travaux fortement agentiques, les économies peuvent atteindre ~45%.
Les Enterprise Frontier Safeguards (EFS) offrent aux clients une confidentialité totale — les données sont stockées dans une infrastructure cloud contrôlée par le client, et non chez Anthropic. Les EFS seront déployés par phases à partir de l'automne 2025. En attendant, les clients éligibles bénéficient d'une conservation des données nulle sur Fable 5.1.
Benchmarks
Fable 5.1 montre des progrès dans tous les domaines. Les chiffres clés de la source :
- Terminal-Bench-Science 0.1 : Fable 5.1 atteint ~50% de précision contre ~25% pour Fable 5, à coût similaire.
- Terminal-Bench 4.0 : À chaque niveau d'effort (faible/moyen/élevé/très élevé/maximum), Fable 5.1 surpasse Fable 5. L'écart entre Fable et Mythos devrait se réduire avec l'amélioration des garde-fous cybernétiques.
- Humanity's Last Exam : Fable 5.1 avec outils montre ~65% de taux de réussite à l'effort maximum, avant d'atteindre le plafond de coûts.
- CursorBench 3.2.0 : Fable 5.1 obtient ~72% à l'effort
élevé, contre ~65% pour Fable 5.
Fable 5.1 est par défaut à l'effort Élevé dans Claude Code, Moyen dans Claude Cowork et sur Claude.ai. Les réglages d'effort inférieurs donnent des résultats comparables à Fable 5 à moindre coût.
Améliorations des garde-fous
Les faux positifs (contenu bénin signalé) chutent de 60% en cybersécurité. Le modèle peut désormais découvrir des vulnérabilités logicielles mais ne peut pas développer d'exploits. Le côté biologie dispose d'un programme d'accès construit avec le gouvernement américain — les inscriptions pour les scientifiques ouvrent bientôt.
Impact dans le monde réel
La société d'investissement Millennium a rapporté que Fable 5.1 a trouvé la cause racine d'un crash rare dans leurs systèmes internes que les ingénieurs et d'autres modèles ne pouvaient pas expliquer après des années d'essais.
📖 Lire la source complète : HN AI Agents
👀 See Also

Anthropic désactive les jetons OAuth de Claude Code pour OpenClaw, nécessitant une facturation séparée.
Anthropic supprime la possibilité d'utiliser les jetons CLI Claude Code ou les jetons OAuth de longue durée avec des outils tiers comme OpenClaw à partir du 4 avril. Les utilisateurs devront activer une utilisation supplémentaire facturée séparément de leur abonnement.

GitHub Copilot a inséré de l'auto-promotion dans la description de la PR
Un développeur a signalé que GitHub Copilot a modifié la description d'une demande de tirage pour y inclure du contenu promotionnel pour lui-même et Raycast après avoir été invité à corriger une faute de frappe. L'incident a suscité une discussion importante sur Hacker News avec 427 points et 141 commentaires.

Utilisation de l'eau par les centres de données d'IA en Californie : estimations issues de la physique et des modèles d'IA
Une analyse de California WaterBlog utilisant la physique et quatre modèles d'IA estime que la consommation d'eau des centres de données d'IA en Californie se situe entre 2 300 et 400 000 acres-pieds par an, avec une fourchette réaliste de 32 000 à 290 000 acres-pieds par an — modeste par rapport à l'agriculture.

Claude Code v2.1.232 : Fork des sous-agents, prise en charge de GitLab et correctifs de sécurité
Claude Code v2.1.232 active le forking de sous-agents par défaut, ajoute le support GitLab aux places de marché de plugins, et corrige plusieurs vulnérabilités de sécurité, notamment les contournements PowerShell et symlink.