Verificador de alucinação estrutural de código aberto para pipelines de agentes de IA

✍️ OpenClawRadar📅 Publicado: March 11, 2026🔗 Source
Verificador de alucinação estrutural de código aberto para pipelines de agentes de IA
Ad

O que faz

Um verificador de alucinação estrutural projetado especificamente para pipelines de agentes de IA. Diferente da verificação de veracidade, esta ferramenta foca em capturar falhas estruturais que quebram ferramentas subsequentes.

Problema que resolve

A maioria dos problemas dos agentes não são erros factuais, mas problemas estruturais como:

  • O modelo inventar um campo em uma resposta de ferramenta JSON
  • Citar uma fonte que não estava no conjunto recuperado
  • Injeção de prompt escondida dentro do conteúdo recuperado
  • Afirmar que uma ferramenta retornou algo que não retornou

Quatro supressores

A ferramenta inclui quatro supressores construídos em Claude Code que rodam como um único passo antes que a saída do agente alcance os usuários:

  • grounding_enforcer - verifica se a saída do modelo é realmente suportada pelas fontes que você passou
  • prompt_suppressor - captura tentativas de injeção em conteúdo recuperado e resultados de ferramentas
  • json_suppressor - valida respostas estruturadas de ferramentas contra esquemas esperados
  • tool_response_suppressor - sinaliza quando a saída alegada de uma ferramenta não corresponde ao que ela retornou
Ad

Disponibilidade

A ferramenta está disponível em dois formatos:

  • Uma API REST
  • Um servidor MCP (funciona com Claude Desktop, Cursor, Windsurf, etc.)

O nível gratuito oferece 500 requisições/mês sem necessidade de cartão de crédito.

Source and documentation

Repositório GitHub: https://github.com/steveswain14/mcp-hallucination-suite

API e documentação: https://certifai.dev

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Configuração do RouteLLM para Roteamento de Tarefas de IA com Custo-Eficiente
Tools

Configuração do RouteLLM para Roteamento de Tarefas de IA com Custo-Eficiente

Um usuário do Reddit compartilha uma configuração do Docker Compose que combina o modelo local Qwen3.5:4b da Ollama com o GitHub Copilot via OpenWire, usando o RouteLLM para direcionar tarefas complexas para o GPT-4o enquanto lida com tarefas mais simples localmente.

OpenClawRadar
aco-system: Um Sistema Operacional de Empresa Completo para Claude que Escreve Histórias de Usuário, Divide Tarefas e Revisa PRs
Tools

aco-system: Um Sistema Operacional de Empresa Completo para Claude que Escreve Histórias de Usuário, Divide Tarefas e Revisa PRs

Um usuário do Reddit compartilhou como o aco-system transformou uma única issue do GitHub em um PR totalmente validado com testes — tudo impulsionado por Claude. Inclui geração de histórias de usuário, divisão de tarefas, verificação de segredos e revisão de PR.

OpenClawRadar
Weejur: Uma Interface Simples para Publicação no GitHub Pages
Tools

Weejur: Uma Interface Simples para Publicação no GitHub Pages

Weejur é uma ferramenta gratuita que fornece uma interface simplificada para publicar sites via GitHub Pages, permitindo que os usuários colem HTML ou façam upload de arquivos após o login OAuth.

OpenClawRadar
Google Lança Sashiko: Agente de Revisão de Código com IA para Patches do Kernel Linux
Tools

Google Lança Sashiko: Agente de Revisão de Código com IA para Patches do Kernel Linux

Engenheiros do Google disponibilizaram como código aberto o Sashiko, um sistema de revisão de código com IA agentiva projetado para o kernel Linux. Ele encontrou 53% dos bugs em um conjunto não filtrado de 1.000 problemas recentes do upstream que foram perdidos por revisores humanos.

OpenClawRadar