Проверка структурных галлюцинаций с открытым исходным кодом для конвейеров ИИ-агентов

Что он делает
Проверка структурных галлюцинаций, специально разработанная для конвейеров ИИ-агентов. В отличие от проверки фактов, этот инструмент фокусируется на обнаружении структурных сбоев, которые нарушают работу последующих инструментов.
Какую проблему решает
Большинство проблем агентов связаны не с фактическими ошибками, а со структурными проблемами, такими как:
- Модель придумывает поле в JSON-ответе инструмента
- Ссылка на источник, которого нет в полученном наборе
- Инъекция промпта, скрытая внутри полученного контента
- Утверждение, что инструмент вернул что-то, чего он не возвращал
Четыре супрессора
Инструмент включает четыре встроенных супрессора, работающих на Claude Code, которые выполняются как единый шаг перед тем, как вывод агента достигнет пользователей:
grounding_enforcer- проверяет, действительно ли вывод модели поддерживается переданными источникамиprompt_suppressor- обнаруживает попытки инъекций в полученном контенте и результатах инструментовjson_suppressor- проверяет структурированные ответы инструментов на соответствие ожидаемым схемамtool_response_suppressor- помечает случаи, когда заявленный вывод инструмента не соответствует фактическому результату
Доступность
Инструмент доступен в двух форматах:
- REST API
- MCP-сервер (работает с Claude Desktop, Cursor, Windsurf и др.)
Бесплатный тариф предлагает 500 запросов/месяц без необходимости предоставления данных кредитной карты.
Источник и документация
Репозиторий GitHub: https://github.com/steveswain14/mcp-hallucination-suite
API и документация: https://certifai.dev
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Claude Code молча завершается с ошибкой, когда ANTHROPIC_API_KEY установлен в облачных средах
Установка ANTHROPIC_API_KEY в облачных средах приводит к неисправности Claude Code и может повлечь неожиданные расходы на API. Пользователи сообщают о дополнительном использовании и неотзывчивом поведении.

Многомодельный рабочий процесс проверки кода, упакованный как переиспользуемый навык
Многоразовый навык, который координирует несколько ИИ-моделей для проверки кода в PR и не-PR режимах, протестированный с OpenClaw и моделями, такими как GPT-5.5, DeepSeek V4 Pro, Kimi K2.6, Qwen 3.6 Plus и GLM-5.1.

Разработчик достиг задержки менее секунды для STT/TTS с локальными серверами Whisper и Coqui-TTS.
Разработчик опубликовал в открытом доступе реализации локальных серверов для Whisper STT и Coqui TTS, которые обеспечивают задержку ~0,2 секунды при преобразовании речи в текст и ~250 мс при преобразовании текста в речь, что позволяет создавать разговорные ИИ-агенты без зависимости от облачных сервисов.

Создание CLI для AI-агентов: принципы дизайна на примере Google's gws CLI
Интерфейс командной строки gws от Google демонстрирует, как проектировать интерфейсы командной строки специально для ИИ-агентов, отдавая приоритет необработанным JSON-полезным нагрузкам вместо удобных для человека флагов и внедряя защитные механизмы против галлюцинаций.