Chercheur développe une compétence de vérification de véracité pour le code Claude, découvre des hallucinations dans sa propre documentation.
Architecture de la Compétence de Vérification de Véracité
Un chercheur spécialisé en science du sommeil de l'Université de Miami a créé une compétence Claude Code appelée /veracity-tweaked-555 qui décompose les documents en affirmations atomiques et vérifie chacune via une recherche web. L'outil utilise 16 agents parallèles sur 4 vagues par exécution et a été développé en collaboration avec Claude Code (Opus 4.6), où Claude a rédigé le code tandis que le chercheur a conçu la méthodologie.
Résultats de l'Auto-Audit et Modèles d'Erreur
Lorsque le chercheur a exécuté le vérificateur de véracité sur sa propre documentation SKILL.md, il a obtenu 62 sur 100. La compétence conçue pour détecter les hallucinations avait inventé des faits dans sa propre documentation, notamment :
- Fabrication d'une statistique de performance ("3x plus précis" pour SAFE, ce que l'article ne prétend jamais)
- Exagération d'une revendication d'amélioration d'un article ("+35,5%" était en réalité +5,5% par rapport à l'état de l'art)
- Fabrication d'une expansion d'acronyme pour une technique réelle
Après des corrections initiales, le score a atteint 80, puis 84 après une troisième exécution. Une semaine plus tard, après une boucle de convergence plus rigoureuse avec 6 exécutions, 19 agents et 35 corrections supplémentaires, il s'est stabilisé à 96,5/100. Cependant, l'audit v3 est tombé à 74 car les corrections v1 avaient introduit de nouvelles erreurs (un coût en tokens sous-estimé et une liste d'outils incomplète).
Les erreurs suivent des modèles cohérents : exagération d'attribution (langage légèrement plus fort que ne le justifie la source), identifiants plausibles mais fabriqués (PMID, arXiv ID qui semblent réels mais pointent vers d'autres articles), et statistiques obsolètes présentées comme actuelles.
Défi de l'Ingénierie du Contexte
Une seule exécution d'audit génère environ 917K tokens sur 16 agents, dépassant la fenêtre de contexte de 200K de Claude Code. Lorsque Claude Code compacte les conversations pour rester dans les limites, il effectue une compression avec perte. Après quelques compactages, l'agent perd la trace de la relation entre les découvertes — quelle correction a causé quelle régression, quelle affirmation contredit quelle autre. Les faits individuels (noms, chiffres, signatures de fonction) survivent mieux que les connexions entre eux.
Le diagnostic de Claude était que les informations relationnelles — chaînes causales, références croisées, dépendances multi-étapes — sont plus difficiles à préserver dans un résumé que les faits isolés.
Solution et Audits Supplémentaires de Compétences
Le chercheur a résolu cela en créant une compétence complémentaire appelée /context-engineer qui prédit le dépassement avant qu'il ne se produise et externalise l'état relationnel vers des fichiers JSON sur disque. Le test de conception : si vous pouvez /clear toute votre conversation et reprendre uniquement à partir du fichier d'état, l'architecture est correcte.
L'exécution de vérifications de véracité sur d'autres compétences Claude Code a révélé :
- Une compétence avait un titre d'article fabriqué dans sa section d'attribution — la citation semblait parfaite (auteurs, lieu) mais le titre était inventé et l'année était erronée
- La même compétence a mal attribué un cadre d'audit au mauvais organisme de normalisation, apparaissant à plusieurs endroits
- La compétence
/context-engineeravait des incohérences internes — le texte disait "5-10K tokens" tandis qu'un tableau indiquait "5-15K tokens" pour la même métrique
12 corrections au total étaient nécessaires sur toutes les compétences. Toutes ont réussi avec 95+ sur 3 exécutions consécutives après corrections.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Combler les angles morts d'OpenClaw : Créer un sitemap pour récupérer tous les blogs d'Anthropic
L'outil navigateur d'OpenClaw ne découvre pas tous les blogs d'Anthropic car ils sont hébergés sur plusieurs URL. Un utilisateur a résolu ce problème en fournissant un sitemap généré, puis a transformé la solution en compétence partageable.

Layerkit : Éditeur d'Images IA avec Calques Modifiables Développé avec Claude Code
Un développeur a créé Layerkit, un éditeur d'images basé sur le navigateur qui génère des scènes avec des calques modifiables pour éviter de constamment reformuler les prompts. L'outil utilise un pipeline d'IA multi-étapes où un LLM planifie la composition, un modèle d'image génère la scène, et un autre LLM analyse l'image réelle pour placer un texte lisible.
Netlify teste 11 modèles d'IA pour le codage : quel est le meilleur ?
Netlify a exécuté des invites de codage identiques sur 11 modèles d'IA, révélant de grandes différences dans les résultats et les coûts en crédits. Découvrez ce qu'ils ont trouvé avant de choisir votre prochain agent de codage.

Memora v0.2.25 Serveur MCP : Écritures 5 fois plus rapides sur la base de données D1
Memora v0.2.25, un serveur MCP pour la mémoire persistante de Claude, atteint des écritures 5 fois plus rapides sur Cloudflare D1, avec memory_create passant de plus de 10s à ~1,8s et memory_update de plus de 10s à ~1,1s par appel.