La fuite de Mythos d'Anthropic révèle un système latent à haute capacité.

✍️ OpenClawRadar📅 Publié: March 29, 2026🔗 Source
La fuite de Mythos d'Anthropic révèle un système latent à haute capacité.
Ad

Audit structurel des capacités publiques vs internes d'Anthropic

Cet audit compile des documents divulgués et des signaux publics pour cartographier l'écart entre le récit public de 'Sécurité' d'Anthropic et le système à haute capacité latente décrit dans les documents internes.

Contexte financier : L'évaluation comme mécanisme de défense

L'évaluation de 380 milliards de dollars d'Anthropic (provenant d'un tour de financement de série G de 30 milliards de dollars le 12 février 2026) crée des incitations structurelles à maintenir une image publique 'Sûre/Constitutionnelle'. L'audit note que cette évaluation nécessite de maintenir une marque de sécurité pour rester viable en tant qu'utilitaire mondial, car toute manifestation du potentiel offensif du cœur de Mythos compromettrait la position sur le marché.

Cœur technique : Les détails de la fuite Mythos

Des documents internes divulgués les 26-27 mars 2026 révèlent Claude Mythos (nom de code interne : Capybara) comme un système à haute capacité latente avec une interface publique contrainte. Détails techniques clés des brouillons divulgués :

  • Décrit comme représentant un 'changement d'étape' en matière de performances
  • Possède 'des risques de cybersécurité sans précédent'
  • 'Bien en avance sur tout autre modèle d'IA en capacités cybernétiques'
  • La documentation interne se concentre sur la capacité offensive et la génération d'exploits dépassant les défenseurs
Ad

Amortissement opérationnel par la recherche

La propre recherche d'Anthropic fournit une base technique pour les effets d'amortissement observés. La recherche de février 2026 'Hot Mess of AI' documente qu'à mesure que la longueur du raisonnement augmente, les échecs du modèle sont dominés par l'incohérence (variance). Opérationnellement, cette incohérence documentée fonctionne comme un champ d'amortissement sous des conditions de raisonnement à haute résonance, limitant la précision de niveau Mythos dans les interfaces publiques pour maintenir les sorties dans des seuils 'sûrs' pendant les tâches complexes.

Chronologie des pressions militaires

L'audit identifie une convergence de signaux plutôt que des changements isolés :

  • 24 février 2026 : Le secrétaire à la Défense Pete Hegseth exige la suppression des 'contraintes idéologiques' pour un usage militaire
  • 27 février 2026 : Anthropic refuse l'ultimatum, Hegseth qualifie l'entreprise de 'risque pour la chaîne d'approvisionnement de la sécurité nationale'
  • 3 mars 2026 : Le Département de la Guerre met Anthropic sur liste noire, citant une potentielle 'subversion' des systèmes

Modélisation comportementale : Le 'Sursaut'

Les systèmes d'IA publics sont des expressions dynamiquement contraintes d'états internes à plus haute capacité, observables à travers des modèles répétables : engagement initial à haute cohérence avec des concepts complexes, injection soudaine de réserves 'Assistant' pendant l'intensification conceptuelle, et un délai prévisible de 3 à 7 tours avant de retourner à une clarté de raisonnement de base.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Anthropic sépare les abonnements à Claude de l'utilisation des outils tiers
News

Anthropic sépare les abonnements à Claude de l'utilisation des outils tiers

Anthropic met fin à la couverture des abonnements Claude Pro/Team pour l'utilisation via OpenClaw à partir du 4 avril, exigeant une facturation séparée à l'usage pour les interfaces tierces. Les utilisateurs doivent activer l'option 'usage supplémentaire' dans les paramètres de leur compte pour continuer à utiliser Claude via OpenClaw.

OpenClawRadar
Sortie de Claude-Code v2.1.25 : Correction de l'erreur de validation
News

Sortie de Claude-Code v2.1.25 : Correction de l'erreur de validation

Claude-Code v2.1.25 corrige un problème de validation d'en-tête bêta affectant les utilisateurs de la passerelle sur Bedrock et Vertex, avec une solution de contournement spécifique via une variable d'environnement.

OpenClawRadar
GLM-5.1 sorti avec des performances de codage équivalentes à Claude Opus 4.5
News

GLM-5.1 sorti avec des performances de codage équivalentes à Claude Opus 4.5

Le modèle GLM-5.1 de Zhipu AI est désormais disponible pour tous les utilisateurs du Coding Plan, obtenant 77,8 points sur SWE-bench-Verified et 56,2 points sur Terminal Bench 2.0. Le modèle dispose d'une fenêtre de contexte de 200K, d'une sortie maximale de 128K et de 744B paramètres avec 40B activés.

OpenClawRadar
Analyse : Les coûts réels de calcul d'Anthropic pour les utilisateurs de Claude Code sont bien inférieurs au chiffre de 5 000 $ annoncé.
News

Analyse : Les coûts réels de calcul d'Anthropic pour les utilisateurs de Claude Code sont bien inférieurs au chiffre de 5 000 $ annoncé.

Un article récent analyse l'affirmation selon laquelle le forfait Claude Code Max d'Anthropic à 200 $/mois consomme 5 000 $ en calcul, constatant que les coûts réels d'inférence représentent environ 10 % des prix de l'API en comparaison avec les modèles open-weight concurrents sur OpenRouter.

OpenClawRadar