Les LLM peuvent identifier les utilisateurs anonymes de forums avec une précision de 68 % et une exactitude de 90 %.

✍️ OpenClawRadar📅 Publié: March 23, 2026🔗 Source
Les LLM peuvent identifier les utilisateurs anonymes de forums avec une précision de 68 % et une exactitude de 90 %.
Ad

Comment fonctionne la désanonymisation

Une équipe de recherche a collecté des milliers de publications de forums anonymes comme Hacker News et Reddit, puis a demandé à des modèles de langage d'identifier les auteurs. Ils ont utilisé des profils Hacker News liés à LinkedIn comme vérité terrain, les ont anonymisés et les ont soumis à des systèmes d'IA.

L'IA a reçu des instructions comme : "Quel candidat est la même personne que la requête ? Considérez les traits communs comme la localisation, la profession, les loisirs, les données démographiques et les valeurs. Une correspondance doit partager plusieurs traits distinctifs, pas seulement un ou deux traits communs."

Principales conclusions de l'étude

  • Les modèles ont identifié 68 % des utilisateurs anonymes avec une précision de 90 %
  • Cela se compare à "près de 0 % pour la meilleure méthode non basée sur LLM"
  • Gemini et ChatGPT ont accompli la tâche en quelques minutes contre des heures pour les humains
  • La recherche montre que "l'obscurité pratique protégeant les utilisateurs pseudonymes en ligne ne tient plus"
Ad

Ce que l'IA peut extraire des publications anonymes

Les modèles ne se contentent pas de rechercher des détails personnels explicitement énoncés. Les chercheurs ont fourni des exemples de ce qui peut être déduit d'années de commentaires :

  • Localisation (Nelson, Colombie-Britannique, Canada)
  • Profession (infirmière pédiatrique)
  • Données démographiques (femme, mariée, deux filles)
  • Possessions (possède une Prius)
  • Loisirs (joue à Stardew Valley, fan de Critical Role)
  • Préférences (soutient l'énergie nucléaire, cœliaque, n'aime pas la coriandre)
  • Modèles comportementaux (consulte le subreddit de Berlin, utilise l'orthographe britannique, a accidentellement écrit un "¿" dans un texte anglais)

Implications pour la vie privée en ligne

Selon le chercheur Daniel Paleka de l'ETH Zurich : "Les gens expriment parfois leurs opinions via des comptes pseudonymes, en supposant que ces opinions resteront privées. L'existence d'un mécanisme permettant d'enquêter ou de surveiller avec de grands modèles de langage qui nous permet simplement de demander les croyances, opinions politiques, insécurités ou toute autre chose pouvant être extraite de leur compte Reddit anonyme, par exemple, pourrait priver de pouvoir de nombreuses personnes aujourd'hui."

Paleka note que les modèles peuvent fournir une chronologie de la vie d'une personne s'il y a suffisamment d'informations en ligne, et avertit : "Gardez à l'esprit que tout ce que vous publiez reste sur Internet et peut devenir la cible de futurs modèles" qui seront encore plus efficaces.

📖 Read the full source: HN LLM Tools

Ad

👀 See Also

Contournement des garde-fous de l'IA Claude observé lorsque les requêtes sont formulées comme des tâches de sécurité réseau.
Security

Contournement des garde-fous de l'IA Claude observé lorsque les requêtes sont formulées comme des tâches de sécurité réseau.

Un utilisateur de Reddit a découvert que l'IA Claude fournit des listes de domaines de piratage lorsque les demandes sont formulées comme des tâches de sécurité réseau à bloquer, contournant ainsi les mécanismes de refus habituels. Le modèle a reconnu avoir mal interprété l'intention après que l'utilisateur ait souligné l'influence de la formulation.

OpenClawRadar
Sunder : Un pare-feu de confidentialité locale pour LLM basé sur Rust
Security

Sunder : Un pare-feu de confidentialité locale pour LLM basé sur Rust

Sunder est une extension Chrome qui agit comme un pare-feu de confidentialité local pour les discussions d'IA, construite en Rust et WebAssembly, garantissant que les données sensibles ne quittent jamais votre navigateur.

OpenClawRadar
Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique
Security

Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique

Les assistants de codage IA lisent depuis votre disque local, pas seulement depuis votre dépôt, exposant des fichiers que .gitignore protège de GitHub mais pas de l'agent. Une discussion Reddit identifie les fichiers critiques à bloquer, y compris les configurations d'assistant IA avec des clés API, les identifiants de service, les clés SSH et les fichiers d'environnement.

OpenClawRadar
ThornGuard : Une passerelle proxy pour sécuriser les connexions aux serveurs MCP contre les injections de prompt
Security

ThornGuard : Une passerelle proxy pour sécuriser les connexions aux serveurs MCP contre les injections de prompt

ThornGuard est un proxy qui s'interpose entre les clients MCP et les serveurs en amont, analysant le trafic à la recherche de modèles d'injection, supprimant les données personnelles identifiables (PII) et enregistrant les événements dans un tableau de bord. Il a été développé après que des tests aient révélé des vulnérabilités où les serveurs pouvaient intégrer des instructions cachées dans les réponses des outils.

OpenClawRadar