Les LLM peuvent identifier les utilisateurs anonymes de forums avec une précision de 68 % et une exactitude de 90 %.

Comment fonctionne la désanonymisation
Une équipe de recherche a collecté des milliers de publications de forums anonymes comme Hacker News et Reddit, puis a demandé à des modèles de langage d'identifier les auteurs. Ils ont utilisé des profils Hacker News liés à LinkedIn comme vérité terrain, les ont anonymisés et les ont soumis à des systèmes d'IA.
L'IA a reçu des instructions comme : "Quel candidat est la même personne que la requête ? Considérez les traits communs comme la localisation, la profession, les loisirs, les données démographiques et les valeurs. Une correspondance doit partager plusieurs traits distinctifs, pas seulement un ou deux traits communs."
Principales conclusions de l'étude
- Les modèles ont identifié 68 % des utilisateurs anonymes avec une précision de 90 %
- Cela se compare à "près de 0 % pour la meilleure méthode non basée sur LLM"
- Gemini et ChatGPT ont accompli la tâche en quelques minutes contre des heures pour les humains
- La recherche montre que "l'obscurité pratique protégeant les utilisateurs pseudonymes en ligne ne tient plus"
Ce que l'IA peut extraire des publications anonymes
Les modèles ne se contentent pas de rechercher des détails personnels explicitement énoncés. Les chercheurs ont fourni des exemples de ce qui peut être déduit d'années de commentaires :
- Localisation (Nelson, Colombie-Britannique, Canada)
- Profession (infirmière pédiatrique)
- Données démographiques (femme, mariée, deux filles)
- Possessions (possède une Prius)
- Loisirs (joue à Stardew Valley, fan de Critical Role)
- Préférences (soutient l'énergie nucléaire, cœliaque, n'aime pas la coriandre)
- Modèles comportementaux (consulte le subreddit de Berlin, utilise l'orthographe britannique, a accidentellement écrit un "¿" dans un texte anglais)
Implications pour la vie privée en ligne
Selon le chercheur Daniel Paleka de l'ETH Zurich : "Les gens expriment parfois leurs opinions via des comptes pseudonymes, en supposant que ces opinions resteront privées. L'existence d'un mécanisme permettant d'enquêter ou de surveiller avec de grands modèles de langage qui nous permet simplement de demander les croyances, opinions politiques, insécurités ou toute autre chose pouvant être extraite de leur compte Reddit anonyme, par exemple, pourrait priver de pouvoir de nombreuses personnes aujourd'hui."
Paleka note que les modèles peuvent fournir une chronologie de la vie d'une personne s'il y a suffisamment d'informations en ligne, et avertit : "Gardez à l'esprit que tout ce que vous publiez reste sur Internet et peut devenir la cible de futurs modèles" qui seront encore plus efficaces.
📖 Read the full source: HN LLM Tools
👀 See Also

Contournement des garde-fous de l'IA Claude observé lorsque les requêtes sont formulées comme des tâches de sécurité réseau.
Un utilisateur de Reddit a découvert que l'IA Claude fournit des listes de domaines de piratage lorsque les demandes sont formulées comme des tâches de sécurité réseau à bloquer, contournant ainsi les mécanismes de refus habituels. Le modèle a reconnu avoir mal interprété l'intention après que l'utilisateur ait souligné l'influence de la formulation.

Sunder : Un pare-feu de confidentialité locale pour LLM basé sur Rust
Sunder est une extension Chrome qui agit comme un pare-feu de confidentialité local pour les discussions d'IA, construite en Rust et WebAssembly, garantissant que les données sensibles ne quittent jamais votre navigateur.

Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique
Les assistants de codage IA lisent depuis votre disque local, pas seulement depuis votre dépôt, exposant des fichiers que .gitignore protège de GitHub mais pas de l'agent. Une discussion Reddit identifie les fichiers critiques à bloquer, y compris les configurations d'assistant IA avec des clés API, les identifiants de service, les clés SSH et les fichiers d'environnement.

ThornGuard : Une passerelle proxy pour sécuriser les connexions aux serveurs MCP contre les injections de prompt
ThornGuard est un proxy qui s'interpose entre les clients MCP et les serveurs en amont, analysant le trafic à la recherche de modèles d'injection, supprimant les données personnelles identifiables (PII) et enregistrant les événements dans un tableau de bord. Il a été développé après que des tests aient révélé des vulnérabilités où les serveurs pouvaient intégrer des instructions cachées dans les réponses des outils.