Проверка структурных галлюцинаций с открытым исходным кодом для конвейеров ИИ-агентов

✍️ OpenClawRadar📅 Опубликовано: 11 марта 2026 г.🔗 Source
Проверка структурных галлюцинаций с открытым исходным кодом для конвейеров ИИ-агентов
Ad

Что он делает

Проверка структурных галлюцинаций, специально разработанная для конвейеров ИИ-агентов. В отличие от проверки фактов, этот инструмент фокусируется на обнаружении структурных сбоев, которые нарушают работу последующих инструментов.

Какую проблему решает

Большинство проблем агентов связаны не с фактическими ошибками, а со структурными проблемами, такими как:

  • Модель придумывает поле в JSON-ответе инструмента
  • Ссылка на источник, которого нет в полученном наборе
  • Инъекция промпта, скрытая внутри полученного контента
  • Утверждение, что инструмент вернул что-то, чего он не возвращал

Четыре супрессора

Инструмент включает четыре встроенных супрессора, работающих на Claude Code, которые выполняются как единый шаг перед тем, как вывод агента достигнет пользователей:

  • grounding_enforcer - проверяет, действительно ли вывод модели поддерживается переданными источниками
  • prompt_suppressor - обнаруживает попытки инъекций в полученном контенте и результатах инструментов
  • json_suppressor - проверяет структурированные ответы инструментов на соответствие ожидаемым схемам
  • tool_response_suppressor - помечает случаи, когда заявленный вывод инструмента не соответствует фактическому результату
Ad

Доступность

Инструмент доступен в двух форматах:

  • REST API
  • MCP-сервер (работает с Claude Desktop, Cursor, Windsurf и др.)

Бесплатный тариф предлагает 500 запросов/месяц без необходимости предоставления данных кредитной карты.

Источник и документация

Репозиторий GitHub: https://github.com/steveswain14/mcp-hallucination-suite

API и документация: https://certifai.dev

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Claude Code молча завершается с ошибкой, когда ANTHROPIC_API_KEY установлен в облачных средах
Инструменты

Claude Code молча завершается с ошибкой, когда ANTHROPIC_API_KEY установлен в облачных средах

Установка ANTHROPIC_API_KEY в облачных средах приводит к неисправности Claude Code и может повлечь неожиданные расходы на API. Пользователи сообщают о дополнительном использовании и неотзывчивом поведении.

OpenClawRadar
Многомодельный рабочий процесс проверки кода, упакованный как переиспользуемый навык
Инструменты

Многомодельный рабочий процесс проверки кода, упакованный как переиспользуемый навык

Многоразовый навык, который координирует несколько ИИ-моделей для проверки кода в PR и не-PR режимах, протестированный с OpenClaw и моделями, такими как GPT-5.5, DeepSeek V4 Pro, Kimi K2.6, Qwen 3.6 Plus и GLM-5.1.

OpenClawRadar
Разработчик достиг задержки менее секунды для STT/TTS с локальными серверами Whisper и Coqui-TTS.
Инструменты

Разработчик достиг задержки менее секунды для STT/TTS с локальными серверами Whisper и Coqui-TTS.

Разработчик опубликовал в открытом доступе реализации локальных серверов для Whisper STT и Coqui TTS, которые обеспечивают задержку ~0,2 секунды при преобразовании речи в текст и ~250 мс при преобразовании текста в речь, что позволяет создавать разговорные ИИ-агенты без зависимости от облачных сервисов.

OpenClawRadar
Создание CLI для AI-агентов: принципы дизайна на примере Google's gws CLI
Инструменты

Создание CLI для AI-агентов: принципы дизайна на примере Google's gws CLI

Интерфейс командной строки gws от Google демонстрирует, как проектировать интерфейсы командной строки специально для ИИ-агентов, отдавая приоритет необработанным JSON-полезным нагрузкам вместо удобных для человека флагов и внедряя защитные механизмы против галлюцинаций.

OpenClawRadar