Vérificateur de hallucination structurelle open-source pour les pipelines d'agents IA

Ce qu'il fait
Un vérificateur d'hallucinations structurelles spécialement conçu pour les pipelines d'agents IA. Contrairement à la vérification de la véracité, cet outil se concentre sur la détection des défaillances structurelles qui perturbent les outils en aval.
Problème qu'il résout
La plupart des problèmes des agents ne sont pas des erreurs factuelles mais des problèmes structurels comme :
- Le modèle invente un champ dans une réponse d'outil JSON
- Citer une source qui ne faisait pas partie de l'ensemble récupéré
- Une injection de prompt cachée dans le contenu récupéré
- Prétendre qu'un outil a retourné quelque chose qu'il n'a pas retourné
Quatre suppresseurs
L'outil comprend quatre suppresseurs intégrés en Claude Code qui s'exécutent en une seule étape avant que la sortie de l'agent n'atteigne les utilisateurs :
grounding_enforcer- vérifie si la sortie du modèle est effectivement étayée par les sources que vous avez transmisesprompt_suppressor- détecte les tentatives d'injection dans le contenu récupéré et les résultats des outilsjson_suppressor- valide les réponses structurées des outils par rapport aux schémas attendustool_response_suppressor- signale quand la sortie revendiquée par un outil ne correspond pas à ce qu'il a réellement retourné
Disponibilité
L'outil est disponible en deux formats :
- Une API REST
- Un serveur MCP (fonctionne avec Claude Desktop, Cursor, Windsurf, etc.)
Le niveau gratuit offre 500 requêtes/mois sans carte de crédit requise.
Source et documentation
Dépôt GitHub : https://github.com/steveswain14/mcp-hallucination-suite
API et documentation : https://certifai.dev
📖 Read the full source: r/ClaudeAI
👀 See Also

Le moteur de RPG solo open-source utilise trois instances Claude pour l'analyse, la narration et la direction.
EdgeTales est un moteur de jeu de rôle solo open-source basé sur du texte où la mécanique des dés détermine les résultats et l'IA Claude génère une prose atmosphérique. Le système utilise trois instances Claude en pipeline : Cerveau (Haiku) pour analyser l'entrée en JSON, Narrateur (Sonnet) pour écrire la prose, et Directeur (Haiku) pour l'analyse asynchrone des scènes.

OpenMind ajoute une interface de carte mentale visuelle aux installations OpenClaw.
OpenMind est un outil open-source qui transforme les installations OpenClaw en cartes mentales interactives et modifiables en direct, avec visualisation de la mémoire en temps réel, logique interchangeable à chaud et recherche en texte intégral sur tous les nœuds.

Système d'Anticorps : Surveillance Hors-Bande pour les Agents OpenClaw
Le Système Anticorps est un système de surveillance open source qui s'exécute sur une machine séparée et surveille les agents OpenClaw via SSH, mettant en œuvre des réponses graduées de la détection à la récupération des services. Il est conçu pour survivre aux défaillances qui affectent l'agent principal.

Portage de l'Autoresearch de Karpathy sur le Neural Engine d'Apple pour une meilleure efficacité énergétique par watt
Un prototype combine le projet autoresearch d'Andrej Karpathy avec les performances rétro-ingéniérées du Neural Engine d'Apple, visant un meilleur débit par watt par rapport aux API officielles. Le projet est construit sur des dépôts GitHub existants et reconnaît les contributions de plusieurs développeurs.