Anthropic rapporte des attaques de distillation à l'échelle industrielle par des laboratoires d'IA chinois sur Claude.

✍️ OpenClawRadar📅 Publié: February 24, 2026🔗 Source
Anthropic rapporte des attaques de distillation à l'échelle industrielle par des laboratoires d'IA chinois sur Claude.
Ad

Opération d'extraction de modèle à l'échelle industrielle

Anthropic a publié des résultats détaillant des attaques de distillation coordonnées contre Claude par trois laboratoires chinois d'IA. Les attaques impliquaient la création de comptes frauduleux à grande échelle pour extraire les capacités de raisonnement de Claude via des interactions massives d'API.

Détails clés de l'attaque selon le rapport d'Anthropic

  • DeepSeek, Moonshot et MiniMax ont créé plus de 24 000 comptes frauduleux
  • Le total des échanges avec Claude a dépassé 16 millions
  • MiniMax à lui seul a lancé 13 millions de requêtes
  • Lorsqu'Anthropic a publié un nouveau modèle, MiniMax a redirigé près de la moitié de son trafic en 24 heures
  • DeepSeek ciblait spécifiquement les chaînes de raisonnement et les réponses sûres en matière de censure
  • Les attaques sont devenues plus sophistiquées avec le temps alors que les laboratoires adaptaient leurs méthodes
Ad

Implications pour la sécurité des développeurs d'IA

Cet incident met en lumière les vulnérabilités de la sécurité des modèles d'IA lorsque des laboratoires valant des milliards de dollars tentent systématiquement d'extraire des capacités propriétaires. L'ampleur et la persistance de ces attaques—s'étendant sur plusieurs organisations et s'adaptant aux nouvelles versions de modèles—suggèrent qu'il s'agit d'une menace continue plutôt que d'incidents isolés.

Les méthodes utilisées (création de comptes frauduleux, interrogation ciblée pour des capacités spécifiques, adaptation rapide aux nouvelles versions de modèles) pourraient potentiellement être reproduites contre d'autres systèmes d'IA, soulevant des questions sur la sécurité des outils d'IA tiers que les développeurs intègrent dans leurs flux de travail.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Claude met en place une vérification d'identité pour certains cas d'utilisation.
Security

Claude met en place une vérification d'identité pour certains cas d'utilisation.

Anthropic déploie la vérification d'identité pour Claude via Persona Identities, exigeant des pièces d'identité officielles avec photo et des selfies en direct. Le processus de vérification prend moins de cinq minutes et vise à prévenir les abus et à se conformer aux obligations légales.

OpenClawRadar
🦀
Security

Le faux think tank d'Israël cible les chatbots IA avec un empoisonnement SEO

Israël a créé un faux think tank, l'Institut Hanover, publiant plus de 100 articles optimisés pour l'IA afin d'influencer les chatbots comme Claude et Gemini. Les articles imitent des rapports crédibles de think tanks avec des citations, probablement pour façonner les réponses de l'IA sur le conflit israélo-palestinien.

OpenClawRadar
Intégration de l'agent SOC OpenClaw pour la chasse aux menaces dans un laboratoire SIEM domestique
Security

Intégration de l'agent SOC OpenClaw pour la chasse aux menaces dans un laboratoire SIEM domestique

Un utilisateur de Reddit partage sa configuration SIEM open-source appelée Red Threat Redemption sur Debian 13, intégrant Elasticsearch, Kibana, Wazuh, Zeek et pfSense avec Suricata, puis ajoute un agent IA pour la corrélation automatisée des menaces, la chasse aux menaces et le triage des alertes.

OpenClawRadar
Le noyau Linux propose un système d'identité décentralisé pour remplacer la toile de confiance PGP
Security

Le noyau Linux propose un système d'identité décentralisé pour remplacer la toile de confiance PGP

Les mainteneurs du noyau Linux travaillent sur une couche d'identité décentralisée appelée Linux ID pour remplacer l'actuel réseau de confiance PGP. Le système utilise des identifiants décentralisés (DID) de style W3C et des justificatifs vérifiables pour authentifier les développeurs sans nécessiter de sessions de signature de clés en face à face.

OpenClawRadar