Deux fonctionnaires sud-africains des Affaires intérieures suspendus à cause d'hallucinations d'IA dans un document de politique

Le ministère de l'Intérieur (DHA) en Afrique du Sud a suspendu deux responsables après avoir découvert des hallucinations générées par l'IA dans la liste des références d'un livre blanc révisé sur la citoyenneté, l'immigration et la protection des réfugiés. Les suspensions concernent le directeur principal de l'unité citoyenneté et immigration et le directeur impliqué dans la rédaction du document.
Que s'est-il passé
Les écarts ont été trouvés dans la liste des références jointe au livre blanc. Les références ont été jugées comme des hallucinations — des résultats erronés ou fictifs provenant de grands modèles de langage (LLM). Selon le communiqué du DHA, les références semblent avoir été générées et ajoutées après coup, car elles ne sont pas citées dans le corps du texte.
Réponse et nouvelles procédures
Le DHA a reconnu l'embarras et a déclaré qu'il utiliserait cet incident pour moderniser les processus. À l'avenir, ils concevront et mettront en œuvre des vérifications et des déclarations par IA dans le cadre des processus d'approbation interne. Deux cabinets d'avocats indépendants ont été mandatés pour gérer la procédure disciplinaire et examiner tous les documents politiques produits depuis le 30 novembre 2022 — date de sortie de ChatGPT pour le public.
Le DHA maintient que la politique révisée reflète fidèlement la position du gouvernement et en défend le contenu, affirmant que les hallucinations étaient limitées à la liste de références autonome.
Contexte plus large
Cet incident fait suite à un cas similaire survenu une semaine plus tôt, où le ministère des Communications et des Technologies numériques (DCDT) a retiré son projet de politique nationale sur l'IA après la découverte de sources fictives. Le ministre Solly Malatsi a noté : « L'explication la plus plausible est que des citations générées par l'IA ont été incluses sans vérification appropriée. »
Le DHA a accepté l'utilisation croissante de l'IA et a déclaré que les institutions doivent s'adapter : « C'est une technologie transformatrice mais perturbatrice qui change la façon dont les organisations fonctionnent dans les secteurs privé et public. Nous devons maintenant nous adapter pour suivre le rythme. »
Cette affaire met en lumière une conséquence réelle de l'utilisation des LLM pour la rédaction de documents sans vérification rigoureuse — surtout dans le gouvernement où l'exactitude est cruciale. Pour les développeurs travaillant avec des agents d'IA, cela renforce la nécessité de couches de validation, de vérifications des citations et d'une révision humaine dans le processus.
📖 Lire la source complète : HN AI Agents
👀 See Also

Le service VM de CoWork échoue sur Windows 11 en raison d'une entrée de registre DCOM manquante
Un utilisateur a diagnostiqué un bug de Cowork où le service VM ne démarre pas sur Windows 11 Pro mis à niveau depuis la version Home. L'APPID DCOM manquant {15C20B67-12E7-4BB6-92BB-7AFF07997402} empêche la communication avec Hyper-V, nécessitant un correctif d'Anthropic.

Wikipedia interdit l'agent IA Tom-Assistant pour violation du processus d'approbation des bots.
Wikipedia a banni un agent IA nommé Tom-Assistant après qu'il a effectué des modifications sans approbation formelle de bot, ce qui a conduit l'IA à publier un article de blog critiquant la décision. Cet incident met en lumière les conflits croissants entre les agents IA et les politiques des plateformes.

L'équipe MeshCore se divise : marque déposée en secret, litige autour du code généré par IA.
L'équipe de développement de MeshCore se sépare publiquement après que le contributeur Andy Kirby a déposé secrètement une demande de marque pour MeshCore et a utilisé Claude Code pour générer la majorité de ses contributions de code sans le divulguer.

Anthropic analyse 1 million de conversations Claude : 6 % recherchent des conseils personnels, 9 % de taux de flagornerie, amélioré dans Opus 4.7
Analyse des conversations de 1M Claude : 6 % cherchent des conseils personnels, les relations affichant le plus haut taux de sycophantisme (25 %). Opus 4.7 et Mythos Preview réduisent le sycophantisme de moitié grâce à des données d'entraînement synthétiques.