Шлюз контекста: открытый прокси для сжатия контекста ИИ-агентов

Что делает Context Gateway
Context Gateway — это агентский прокси, который располагается между AI-агентами для программирования (такими как Claude Code, OpenClaw или Cursor) и API LLM. Когда выходные данные инструментов, такие как чтение файлов или результаты grep, сбрасывают тысячи токенов в контекстное окно, прокси сжимает этот контент до того, как он достигнет LLM. Мотивация исходит из исследований, показывающих, что бенчмарки с длинным контекстом испытывают резкое падение точности по мере роста контекста — оценка GPT-5.4 от OpenAI, как сообщается, падает с 97,2% при 32 тыс. токенов до 36,6% при 1 млн токенов.
Как работает сжатие
Система использует небольшие языковые модели (SLM), которые анализируют внутренности модели и обучают классификаторы для обнаружения частей контекста, несущих наибольший сигнал. Когда инструмент возвращает вывод, сжатие происходит с учётом намерения вызова инструмента. Например, если агент вызвал grep для поиска шаблонов обработки ошибок, SLM сохраняет соответствующие совпадения и удаляет остальное. Если модели позже понадобится что-то, что было удалено, она может вызвать expand(), чтобы получить исходный вывод.
Ключевые особенности и настройка
- Фоновое сжатие: Запускается при заполнении окна на 85%, с предварительно вычисленными сводками, чтобы не ждать сжатия
- Ленивая загрузка описаний инструментов: Модель видит только инструменты, релевантные текущему шагу
- Лимиты расходов: Контролируйте затраты с помощью бюджетных ограничений
- Панель управления: Отслеживайте текущие и прошлые сессии
- Уведомления в Slack: Получайте оповещения, когда агент ждёт вас
- Поддерживаемые агенты: Claude Code, Cursor, OpenClaw или пользовательские конфигурации
Начало работы
Установите с помощью:
curl -fsSL https://compresr.ai/api/install | sh
Затем запустите context-gateway, чтобы запустить интерактивный TUI-мастер, который поможет вам:
- Выбрать агента (claude_code, cursor, openclaw или пользовательский)
- Создать/редактировать конфигурацию, включая модель-суммаризатор и API-ключ
- Включить уведомления в Slack при необходимости
- Установить порог срабатывания для сжатия (по умолчанию: 75%)
Инструмент является открытым исходным кодом, написан в основном на Go (90,9%) и поддерживается Compresr, компанией, поддержанной YC. Вы можете проверить логи сжатия в logs/history_compaction.jsonl, чтобы увидеть, что происходит под капотом.
📖 Прочитайте полный исходный код: HN LLM Tools
👀 Смотрите также

Плагин HomeClaw соединяет Apple HomeKit с OpenClaw.
HomeClaw — это плагин OpenClaw, который подключает устройства Apple Home/HomeKit к OpenClaw. Для сборки и запуска требуется аккаунт разработчика Apple из-за ограничений Apple HomeKit для нотариально заверенных дистрибутивов.

Mandala v0.3: Открытая асинхронная среда выполнения для унификации логистической телеметрии в виде OpenTelemetry-спанов для рассуждений агентов
Mandala v0.3 — это асинхронный рантайм с открытым исходным кодом, который получает телеметрию от Samsara, Descartes, Vizion и FMCSA через вебхуки, генерирует события в виде Span OpenTelemetry и предоставляет данные через MCP-инструменты для LLM-агентов.

Выпущен Claude Code Production Grade Plugin v3.0: Автономный конвейер разработки программного обеспечения
Плагин Production Grade Plugin v3.0 для Claude Code теперь доступен как бесплатное программное обеспечение с открытым исходным кодом по лицензии MIT. Плагин создаёт полный конвейер разработки от требований до развёртывания с 13 ИИ-навыками, которые действуют как инженерная команда.

Сократитель Токенов: Плагин Claude Code для интеллектуального сжатия контекста
Token Reducer — это плагин Claude Code, который обрабатывает контекст репозитория локально, сокращая использование токенов на 90–98% с помощью AST-сегментации, гибридного поиска и сжатия TextRank. Распространяется под лицензией MIT и доступен в магазине плагинов.