Проверка навыков Claude MCP: детерминированный аудит критических изменений от 28 июля 2026 года

С приближением пересмотра MCP 2026-07-28, самого крупного разрушающего изменения протокола — stateless-транспорт, отказ от Mcp-Session-Id, OAuth 2.1 — многие публичные серверы тихо ломаются. Вместо того чтобы полагаться на догадки на основе LLM, один разработчик создал детерминированный чекер, который выдаёт одинаковый результат для одинаковых входных данных и ссылается на точную страницу спецификации для каждой находки.
Как работает чекер
Ядро — это чистый движок правил с 7 правилами, доступный двумя способами:
- Веб-демо — вставьте endpoint, получите отчёт с оценкой. Без установки, ничего не сохраняется.
- Claude Skill —
SKILL.mdплюс встроенный чекер без зависимостей. В Claude Code он занимается диагностикой и миграцией, но вы можете распаковать его и запустить чекер с любым агентом (Codex, Cursor).
Репозиторий (MIT, ~86 тестов) находится на GitHub. Там даже есть раздел README под названием «Правило, которое было неверным» с тестами, фиксирующими обе ошибки, чтобы они не повторились.
Что узнал автор
Одно правило было уверенно неверным: оно советовало пользователям обновить SDK до ^2 — версии, которой не существует (она останавливается на 1.30.0). После удаления с пометкой «версии 2 не существует» оказалось, что v2 действительно существует как переименование пакета. Урок: «этого не существует» и «вы искали не там» дают одинаковые доказательства — переименование выглядит точно так же, как отсутствие. Детерминированность не означает правильность.
Этот режим отказа проявляется везде, где агенты пишут код: уверенные, правдоподобные, внутренне согласованные утверждения, которые просто не соответствуют действительности. Исправление не в том, чтобы «меньше доверять», а в том, чтобы сделать утверждения проверяемыми, а затем действительно их проверять.
Для кого это
Для всех, кто запускает MCP-серверы или переходит на спецификацию 2026-07-28, а также для разработчиков, создающих агентные инструменты, которым нужна проверка вывода на соответствие спецификации.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Открытые ИИ-контекстные пакеты для вопросов в сфере права, соответствия требованиям и финансов
Разработчик использовал Claude для исследования и создания 32 бесплатных, открытых контекстных пакетов, которые предоставляют конкретные ответы на юридические, регуляторные и финансовые вопросы вместо общих рекомендаций «проконсультируйтесь с юристом». Пакеты охватывают GDPR, контракты, биллинг SaaS, Закон ЕС об ИИ и другие темы.

Фреймворк SIDJUA добавляет уровень управления к автономным ИИ-агентам
SIDJUA — это фреймворк со встроенным управлением, правилами авторизации на основе ролей и полными журналами аудита, который работает поверх любой AI-модели с API. Демо-версия показывает трехуровневую иерархию, масштабируемую до 7+1 уровней, с регистрацией каждого решения и отслеживанием затрат в реальном времени.

Лобстерная клетка: Докеризированная среда безопасности для самостоятельного хостинга OpenClaw на Raspberry Pi
Разработчик создал Lobster Cage — среду Docker Compose с ограниченным исходящим доступом и маршрутизацией на основе прокси для безопасного запуска OpenClaw на Raspberry Pi в экспериментальных целях.

AGI в md: 11 уровней когнитивного сжатия для системных промптов Claude
Репозиторий на GitHub документирует 11 уровней когнитивного сжатия, которые можно закодировать в системных промптах Claude, при этом Уровень 8 переходит от анализа к конструированию и улучшает производительность Haiku с 0/3 до 4/4. Проект включает 28 промптов, 299 сырых выводов и полные журналы экспериментов по 19 доменам.