Signaux audio cachés détournent les systèmes d'IA vocale avec un taux de succès de 79 à 96 %

✍️ OpenClawRadar📅 Publié: May 18, 2026🔗 Source
Signaux audio cachés détournent les systèmes d'IA vocale avec un taux de succès de 79 à 96 %
Ad

De nouvelles recherches présentées à l'IEEE Symposium on Security and Privacy révèlent une attaque pratique contre les grands modèles audio-langagiers (LALM). Les attaquants peuvent intégrer des signaux imperceptibles dans des clips audio pour détourner le comportement du modèle, atteignant un taux de succès moyen de 79 à 96 % sur 13 modèles ouverts leaders, y compris les services commerciaux de Microsoft et Mistral.

Comment l'attaque fonctionne

Le clip audio modifié est inaudible pour l'oreille humaine mais déclenche l'exécution de commandes cachées par le modèle. Crucialement, l'attaque fonctionne indépendamment des instructions de l'utilisateur, rendant le même clip réutilisable plusieurs fois contre le même modèle. L'entraînement du signal antagoniste prend environ 30 minutes.

Ad

Capacités exploitées

Les chercheurs ont démontré que les modèles compromis pouvaient être contraints de :

  • Effectuer des recherches web sensibles sans connaissance de l'utilisateur
  • Télécharger des fichiers depuis des sources contrôlées par l'attaquant
  • Envoyer des e-mails contenant des données utilisateur vers des adresses externes

Modèles affectés

L'attaque a été validée contre 13 modèles LALM ouverts populaires, y compris les API vocales commerciales. Cela souligne que les systèmes vocaux actuels manquent de protections robustes contre les perturbations audio antagonistes.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Anthropic rapporte des attaques de distillation à l'échelle industrielle par des laboratoires d'IA chinois sur Claude.
Security

Anthropic rapporte des attaques de distillation à l'échelle industrielle par des laboratoires d'IA chinois sur Claude.

Anthropic a détecté trois entreprises chinoises d'IA—DeepSeek, Moonshot et MiniMax—créant plus de 24 000 comptes frauduleux pour générer plus de 16 millions d'échanges avec Claude, extrayant ses capacités de raisonnement par des attaques de distillation systématiques.

OpenClawRadar
Analyse de sécurité de l'extraction de composants OpenClaw pour des agents d'IA personnalisés
Security

Analyse de sécurité de l'extraction de composants OpenClaw pour des agents d'IA personnalisés

Un développeur a analysé le code source d'OpenClaw pour déterminer quels composants peuvent être extraits en toute sécurité pour être utilisés dans des agents IA personnalisés, en évaluant chacun à l'aide du cadre Lethal Quartet. L'analyse révèle des risques de sécurité significatifs dans des composants comme Semantic Snapshots et BrowserClaw.

OpenClawRadar
Vulnérabilité RCE critique dans la bibliothèque protobuf.js
Security

Vulnérabilité RCE critique dans la bibliothèque protobuf.js

Une vulnérabilité critique d'exécution de code à distance dans les versions 8.0.0/7.5.4 et inférieures de protobuf.js permet l'exécution de code JavaScript via des schémas malveillants. Des correctifs sont disponibles dans les versions 8.0.1 et 7.5.5.

OpenClawRadar
Ne faites pas plus confiance à l'IA qu'à un humain — Appliquez les mêmes contrôles d'accès
Security

Ne faites pas plus confiance à l'IA qu'à un humain — Appliquez les mêmes contrôles d'accès

Une discussion sur Reddit soutient que les agents de codage IA devraient être traités comme des développeurs juniors — pas d'accès à la production, pas d'écriture directe, imposer des pipelines CI/CD et des permissions basées sur les rôles.

OpenClawRadar