Anthropic rapporte des attaques de distillation à l'échelle industrielle par des laboratoires d'IA chinois sur Claude.

Opération d'extraction de modèle à l'échelle industrielle
Anthropic a publié des résultats détaillant des attaques de distillation coordonnées contre Claude par trois laboratoires chinois d'IA. Les attaques impliquaient la création de comptes frauduleux à grande échelle pour extraire les capacités de raisonnement de Claude via des interactions massives d'API.
Détails clés de l'attaque selon le rapport d'Anthropic
- DeepSeek, Moonshot et MiniMax ont créé plus de 24 000 comptes frauduleux
- Le total des échanges avec Claude a dépassé 16 millions
- MiniMax à lui seul a lancé 13 millions de requêtes
- Lorsqu'Anthropic a publié un nouveau modèle, MiniMax a redirigé près de la moitié de son trafic en 24 heures
- DeepSeek ciblait spécifiquement les chaînes de raisonnement et les réponses sûres en matière de censure
- Les attaques sont devenues plus sophistiquées avec le temps alors que les laboratoires adaptaient leurs méthodes
Implications pour la sécurité des développeurs d'IA
Cet incident met en lumière les vulnérabilités de la sécurité des modèles d'IA lorsque des laboratoires valant des milliards de dollars tentent systématiquement d'extraire des capacités propriétaires. L'ampleur et la persistance de ces attaques—s'étendant sur plusieurs organisations et s'adaptant aux nouvelles versions de modèles—suggèrent qu'il s'agit d'une menace continue plutôt que d'incidents isolés.
Les méthodes utilisées (création de comptes frauduleux, interrogation ciblée pour des capacités spécifiques, adaptation rapide aux nouvelles versions de modèles) pourraient potentiellement être reproduites contre d'autres systèmes d'IA, soulevant des questions sur la sécurité des outils d'IA tiers que les développeurs intègrent dans leurs flux de travail.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Google affirme que des hackers criminels ont utilisé l'IA pour trouver une vulnérabilité zero-day
Google a révélé que des attaquants ont utilisé un agent d'IA pour découvrir et exploiter une faille logicielle jusqu'alors inconnue, marquant le premier cas confirmé de découverte de zero-day pilotée par l'IA dans la nature.

Exploration des risques liés à l'utilisation d'un compte Google avec Gemini-Cli et l'abonnement Gemini Pro
Gemini-Cli et votre abonnement Gemini Pro pourraient présenter certains risques pour votre compte Google. Voici ce que vous devez savoir sur les vulnérabilités potentielles lors de l'utilisation de ces outils d'IA.

Paquet PyPI Litellm Compromis : La Version Malveillante 1.82.8 Exfiltrait les Identifiants
Le package PyPI litellm, qui unifie les appels vers OpenAI, Anthropic, Cohere et d'autres fournisseurs de LLM, a été compromis avec la version malveillante 1.82.8 qui a exfiltré des clés SSH, des identifiants cloud, des clés API et d'autres données sensibles pendant environ une heure.

Le code source de Claude aurait été divulgué via un fichier map NPM
Un tweet rapporte que le code source de Claude Code a été divulgué via un fichier map dans leur registre NPM. La discussion sur HN compte 93 points et 35 commentaires.