L'IA analyse 400 000 publications Reddit et découvre des effets secondaires cachés de l'Ozempic, comme des changements menstruels

Des chercheurs de l'Université de Pennsylvanie ont entraîné de grands modèles de langage sur 400 000 publications Reddit provenant d'environ 70 000 utilisateurs sur cinq ans pour faire apparaître les effets secondaires des médicaments GLP-1 (Ozempic, Mounjaro) que les essais cliniques pourraient manquer. Publiée dans Nature Health, l'étude a retrouvé des symptômes connus comme les nausées (confirmant la validité de la méthode) ainsi que des signaux sous-déclarés : irrégularités menstruelles (~4 % de tous les utilisateurs, plus élevé dans les échantillons féminins), frissons, bouffées de chaleur et fatigue inexpliquée.
Comment ça marche
Le pipeline utilise des LLM de type GPT et Gemini pour cartographier le texte libre des publications Reddit vers la terminologie standardisée du Medical Dictionary for Regulatory Activities (MedDRA) — une tâche auparavant trop lente pour être réalisée manuellement à grande échelle. Cela permet aux chercheurs de comparer les discussions en ligne avec les classifications cliniques des symptômes à grande vitesse.
Chiffres clés
- Plus de 400 000 publications analysées
- Environ 70 000 utilisateurs uniques
- Période de plus de 5 ans
- Environ 4 % des utilisateurs ont signalé des problèmes menstruels (probablement plus élevé en filtrant sur les utilisatrices)
Limites (explicites dans la source)
L'étude ne prouve pas de causalité — seulement une corrélation dans des données auto-déclarées. Les auteurs insistent sur le fait qu'il s'agit d'un système d'alerte précoce, pas d'un remplacement des essais cliniques. Mais comme le note l'auteur principal Sharath Chandra Guntuku : « Les essais cliniques sont la référence, mais de par leur conception, ils sont lents. Cette méthode peut aller beaucoup plus vite, et cette rapidité compte lorsqu'un médicament passe de niche à grand public presque du jour au lendemain. »
Pourquoi c'est important pour les développeurs
Si vous construisez des outils de surveillance sanitaire ou de pharmacovigilance, ce pipeline est un modèle : les LLM + les réseaux sociaux peuvent détecter des signaux des semaines ou des mois avant les systèmes de signalement officiels. Attendez-vous à des approches similaires pour d'autres classes de médicaments — la même équipe a pionnier l'extraction d'effets indésirables via les réseaux sociaux dès 2011.
📖 Lire la source complète : HN AI Agents
👀 See Also

Delve est accusé d'avoir forké SimStudio, le logiciel open-source de Sim.ai, et de le vendre sous le nom de Pathways.
La startup de conformité Delve aurait bifurqué l'outil open-source de création d'agents SimStudio de Sim.ai, l'aurait rebaptisé Pathways et l'aurait vendu sans attribution de licence appropriée ni accord monétaire avec Sim.ai, violant potentiellement les termes de la licence Apache.

Codex Converses : Le Successeur d'OpenClaw en Automatisation IA
Codex peut désormais communiquer avec lui-même, annonçant une nouvelle ère dans l'automatisation pilotée par l'IA et remplaçant effectivement OpenClaw, le précédent leader.

OpenClaw Developer Signale des Problèmes de Compactage de Contexte Pendant la Construction de Driftwatch V3
Un développeur d'OpenClaw a terminé les sprints 2 à 4 de la construction de Driftwatch V3, mais a rencontré des problèmes de compactage de contexte qui ont effacé la mémoire de l'agent IA en plein milieu de session, nécessitant une intervention manuelle pour restaurer la progression à l'aide des récapitulatifs de sprint.
Pourquoi écrire du code en 2026 : le codage humain reste essentiel pour les agents IA
Doug Turnbull soutient qu'avec des agents de codage IA puissants, les humains doivent toujours écrire du code pour comprendre l'architecture, réduire la fragilité et guider efficacement les agents.