MCP контекстное раздувание: реальные затраты и практическое решение для пользователей Claude Code

✍️ OpenClawRadar📅 Опубликовано: 19 мая 2026 г.🔗 Source
MCP контекстное раздувание: реальные затраты и практическое решение для пользователей Claude Code
Ad

Пользователь Reddit, запускавший 9 серверов MCP в Claude Code в течение четырех месяцев, подробно описал скрытые затраты и снижение производительности, с которыми столкнулся, а также конкретное решение. Пост обязателен к прочтению для всех, кто использует MCP в продакшене.

Математика

С 9 серверами (файловая система, GitHub, Stripe, Linear, Notion, Postgres, Sentry, AWS и кастомный), предоставляющими в общей сложности 142 инструмента, холодный старт потребляет 38k токенов системного промпта + схем инструментов на каждом шаге. При 200 шагах в день это 7,6 млн входных токенов в день. По ценам Sonnet (~$15/M выходных, ~$3/M входных) это составляет ~$23/день или ~$700/месяц только за определение инструментов MCP — до начала реальной работы. Кэш помогает только при одинаковых префиксах; смена одного MCP-сервера инвалидирует его.

Что ломается

  • Выбор инструмента ухудшается: С 142 инструментами в контексте Клод начал выбирать неправильный инструмент для очевидных запросов (например, использовал linear_search_issues, когда его просили прочитать файл).
  • Медленное перечисление: Серверы с большими схемами, такие как AWS, занимают 4–6 секунд для вывода списка инструментов.
  • Тихое распространение ошибок: Один плохо описанный инструмент может испортить ранжирование для всех связанных запросов.
Ad

Решение: Паттерн шлюза с BM25

Пользователь перешел на паттерн шлюза, используя Ratel — открытую библиотеку на Rust с ранжированием BM25, работающую в том же процессе. Теперь Клод видит только три инструмента: search_tools, invoke_tool и auth. Все остальное ранжируется по запросу. Результаты:

  • Холодный старт снизился с 38k до ~4k токенов.
  • Выбор неправильного инструмента почти устранен, потому что модель видит только топ-5, отсортированных по запросу.
  • Настройка заняла 10 минут (одна команда для импорта в Claude Code).

Автор отмечает, что большинство стартапов по "оптимизации MCP" — это просто BM25-поиск под видом инновации. Описания инструментов короткие, структурированные и полные совпадений ключевых слов — не нужны ни векторная БД, ни LLM в цикле. BM25 по плоской проекции названия + описания дает 90% результата детерминистически за микросекунды, офлайн.

Ключевой урок: "заменить" лучше, чем "предложить". Если ваш шлюз дает модели 5 инструментов вместо 142, математика работает. Если он предлагает 5 вместе с 142, модель все равно загружает 142, и вы ничего не сэкономили.

📖 Источник: r/ClaudeAI

Ad

👀 Смотрите также

Claude Hindsight: Инструмент наблюдаемости для сессий кодирования в Claude
Инструменты

Claude Hindsight: Инструмент наблюдаемости для сессий кодирования в Claude

Claude Hindsight — это открытый уровень наблюдаемости для Claude Code, который фиксирует вызовы инструментов, токены и ошибки в доступную для изучения панель управления. Создатель использовал его для рефакторинга открытого проекта за одну 11-часовую сессию с 733 вызовами инструментов и 692,8 млн токенов кэша.

OpenClawRadar
Superglue CLI: Позвольте ИИ-агентам выполнять API-вызовы без предустановленных инструментов
Инструменты

Superglue CLI: Позвольте ИИ-агентам выполнять API-вызовы без предустановленных инструментов

Superglue CLI предоставляет навык, который обучает ИИ-агентов для программирования использованию его команд, работе с аутентификацией, созданию инструментов и отладке сбоев. Вместо создания предустановленных инструментов для каждой интеграции API, агенты могут читать спецификации API во время выполнения и планировать многошаговые вызовы.

OpenClawRadar
Перекрестная модель цикла проверки для AI-агентов программирования выявляет критические недостатки планирования.
Инструменты

Перекрестная модель цикла проверки для AI-агентов программирования выявляет критические недостатки планирования.

Разработчик создал систему кросс-модельного ревью, в которой вторая модель ИИ проверяет планы от кодирующих агентов перед выполнением, выявляя критические недостатки, такие как сбои отката и уязвимости безопасности. Инструмент имеет лицензию MIT и включает TUI-панель управления.

OpenClawRadar
Мурмура: Открытый демон Cron для автоматизации сеансов кодирования с Claude
Инструменты

Мурмура: Открытый демон Cron для автоматизации сеансов кодирования с Claude

Murmur — это демон cron, который планирует и автоматизирует сеансы кода Claude с использованием файла HEARTBEAT.md для настройки.

OpenClawRadar