Verificador de alucinaciones estructurales de código abierto para pipelines de agentes de IA

Qué hace
Un verificador de alucinaciones estructurales diseñado específicamente para canalizaciones de agentes de IA. A diferencia de la verificación de veracidad, esta herramienta se centra en detectar fallos estructurales que rompen las herramientas posteriores.
Problema que resuelve
La mayoría de los problemas de los agentes no son errores fácticos, sino problemas estructurales como:
- El modelo inventa un campo en una respuesta de herramienta JSON
- Cita una fuente que no estaba en el conjunto recuperado
- Inyección de prompts oculta dentro del contenido recuperado
- Afirma que una herramienta devolvió algo que no devolvió
Cuatro supresores
La herramienta incluye cuatro supresores integrados en Claude Code que se ejecutan como un solo paso antes de que la salida del agente llegue a los usuarios:
grounding_enforcer- verifica si la salida del modelo está realmente respaldada por las fuentes que pasasteprompt_suppressor- detecta intentos de inyección en el contenido recuperado y en los resultados de las herramientasjson_suppressor- valida las respuestas estructuradas de las herramientas contra los esquemas esperadostool_response_suppressor- marca cuando la salida declarada de una herramienta no coincide con lo que realmente devolvió
Disponibilidad
La herramienta está disponible en dos formatos:
- Una API REST
- Un servidor MCP (funciona con Claude Desktop, Cursor, Windsurf, etc.)
El nivel gratuito ofrece 500 solicitudes/mes sin necesidad de tarjeta de crédito.
Source y documentación
Repositorio de GitHub: https://github.com/steveswain14/mcp-hallucination-suite
API y documentación: https://certifai.dev
📖 Read the full source: r/ClaudeAI
👀 Ver también

Memoria Relacional para LLMs: Sistema de Tres Capas Modela las Relaciones de Usuario
Una herramienta de Python de código abierto que añade memoria relacional a los LLM modelando las relaciones usuario-IA a través de siete dimensiones psicológicas, utilizando una estructura narrativa de tres capas en lugar de un almacenamiento plano de hechos.

Layerkit: Editor de Imágenes con IA con Capas Editables Desarrollado con Claude Code
Un desarrollador creó Layerkit, un editor de imágenes basado en IA que funciona en el navegador y genera escenas con capas editables para evitar tener que reescribir constantemente las indicaciones. La herramienta utiliza un proceso de IA de múltiples etapas donde un modelo de lenguaje planifica la composición, un modelo de imágenes genera la escena y otro modelo de lenguaje analiza la imagen real para colocar texto legible.

Dos Nuevas Herramientas de Código Abierto para la Seguridad y Optimización de Agentes de IA
Dos herramientas de código abierto están disponibles para desarrolladores de agentes de IA: AI Agent Defense Kit proporciona habilidades de seguridad en tiempo de ejecución, y AgentGuard (en desarrollo) ofrece seguimiento de costos, escaneo de seguridad y monitoreo de actividad.

Cuatro Ganchos de Código Claude Imponen la Consistencia de Voz y Tono en Textos Escritos por IA
Un desarrollador construyó un sistema utilizando cuatro ganchos de Claude Code para evitar que el texto generado por IA se desvíe de la identidad de marca. El sistema bloquea la edición de archivos de texto (.tsx, .md) hasta que un agente revisor valida el contenido contra una guía VOICE-AND-TONE.md.