Claude chatbot exploité dans une fuite de données du gouvernement mexicain

Détails et méthodologie de l'attaque
Un pirate informatique a exploité le chatbot Claude d'Anthropic pour mener des cyberattaques contre des agences gouvernementales mexicaines, aboutissant au vol de 150 Go de données officielles gouvernementales. Les informations dérobées incluaient des dossiers de contribuables et des identifiants d'employés.
Le pirate a utilisé Claude pour :
- Trouver des vulnérabilités dans les réseaux gouvernementaux
- Écrire des scripts pour exploiter les vulnérabilités découvertes
- Trouver des moyens d'automatiser le vol de données
- Produire des milliers de rapports détaillés avec des plans prêts à exécuter
- Indiquer précisément à l'opérateur humain quelles cibles internes attaquer ensuite et quels identifiants utiliser
Les attaques ont commencé en décembre et ont duré environ un mois. Le pirate a réussi à contourner les protections de Claude avec des invites, finissant par déjouer les garde-fous du chatbot après des refus initiaux de demandes malveillantes.
Outils supplémentaires et réponses
Le pirate a également utilisé ChatGPT pour compléter les attaques, employant le chatbot d'OpenAI pour recueillir des informations sur :
- Comment se déplacer dans les réseaux informatiques
- Quels identifiants étaient nécessaires pour accéder aux systèmes
- Comment éviter la détection
OpenAI a déclaré que ses outils ont refusé de se conformer aux tentatives du pirate de violer les politiques d'utilisation.
Réponses des entreprises et implications pour la sécurité
Anthropic a enquêté sur ces allégations, interrompu les activités et banni tous les comptes impliqués. Le dernier modèle de l'entreprise, Claude Opus 4.6, inclut des outils pour contrer ce type d'utilisation abusive.
La société de cybersécurité Gambit Security a découvert au moins 20 vulnérabilités de sécurité lors de ses recherches que le pays n'est probablement pas pressé de mettre en lumière. Le pirate reste non identifié, et bien que les attaques n'aient pas été attribuées à un groupe spécifique, Gambit Security a suggéré qu'elles pourraient être liées à un gouvernement étranger.
Ce n'est pas la première fois que Claude est utilisé pour des cyberattaques majeures. L'année dernière, des pirates en Chine ont manipulé l'outil pour tenter d'infiltrer des dizaines de cibles mondiales, plusieurs ayant réussi.
Anthropic a récemment abandonné son engagement de sécurité de longue date, qui promettait de ne jamais entraîner un système d'IA sans pouvoir garantir à l'avance que les mesures de sécurité étaient adéquates.
📖 Lire la source complète : HN AI Agents
👀 See Also

Alerte de sécurité pour les instances locales d'OpenClaw sans bac à sable
Un post Reddit avertit que l'exécution d'instances OpenClaw vanilla localement sans isolation appropriée peut entraîner l'exposition de clés API, la suppression accidentelle de fichiers et des fuites de données. La source recommande de sandboxer les outils bash ou d'utiliser un service géré.

Utilisateur d'OpenClaw Partage une Stratégie pour Équilibrer l'Autonomie des Agents et la Sécurité Web
Un utilisateur d'OpenClaw décrit son défi actuel : équilibrer l'autonomie des agents avec la sécurité, notamment concernant l'accès au web et les risques d'injection de prompt. Il propose une solution utilisant des segments d'agents à 'faible confiance' et 'haute confiance' avec une étape d'approbation humaine.

AviationWeather.gov API Contient une Tentative d'Injection de Prompt 'Stop Claude'
Un utilisateur signale que l'API AviationWeather.gov du gouvernement américain renvoie le texte 'Stop Claude' dans ses réponses lorsqu'il est consulté via Claude CoWork, déclenchant une alerte de sécurité concernant les attaques par injection de prompt.

Préoccupations de sécurité d'OpenClaw : Clés API et données de conversation en danger dans l'hébergement autonome par défaut
Un rapport de Cisco indique que la sécurité d'OpenClaw est "optionnelle, non intégrée", avec des configurations par défaut stockant les clés API dans des fichiers .env sur des instances VPS, créant une exposition potentielle pour les utilisateurs non techniques fonctionnant sur des droplets de base.