Calmkeep: Внешний слой непрерывности для противодействия дрейфу LLM в длинных сессиях

✍️ OpenClawRadar📅 Опубликовано: 17 марта 2026 г.🔗 Source
Calmkeep: Внешний слой непрерывности для противодействия дрейфу LLM в длинных сессиях
Ad

Решение проблемы дрейфа LLM в профессиональных рабочих процессах

Calmkeep — это внешний слой непрерывности, созданный специально для противодействия тому, что автор называет «структурным дрейфом» в LLM во время длинных сессий. Этот дрейф возникает, когда LLM, такие как Claude, постепенно отказываются от ранее принятых решений, паттернов или фреймворков, даже когда полное контекстное окно всё ещё содержит их — не из-за галлюцинаций, а из-за систематического отказа от установленных паттернов.

Результаты тестов и методология

Автор провёл состязательные аудиты, используя самого Claude в качестве оценивающей системы, со слепой методологией и оценкой по критериям, установленным в первых пяти шагах. Claude последовательно оценивал транскрипты Calmkeep выше, чем свои собственные результаты.

25-шаговый тест сборки бэкенда

  • Стандартный Claude: 60% итоговой целостности, 8 архитектурных нарушений, коэффициент дрейфа 40%
  • Calmkeep: 85% целостности, 3 архитектурных нарушения, нулевой откат после шага 14

Самый показательный пример: Claude ввёл промежуточное ПО Zod на шаге 14, а затем сразу вернулся к raw parseInt для следующих трёх модулей, как будто обновления никогда не было.

Ad

25-шаговая юридическая/стратегическая сессия

  • Стандартный Claude: 50% стратегической целостности, 5 нарушений, включая смену юрисдикции, которая аннулировала ранее установленную правовую основу, ~35% подверженности профессиональным ошибкам
  • Calmkeep: 100% целостности, нулевые нарушения, <5% риска

Техническая реализация

Calmkeep включает:

  • MCP-коннектор
  • Плагин Claude Code
  • Python SDK

Система работает только как внешняя среда выполнения, требует предоставления вашего собственного ключа Anthropic, не имеет скрытой памяти и не вносит изменений в веса базовой модели.

Доступность и тестирование

Доступна бесплатная 14-дневная пробная версия через Stripe по адресу https://calmkeep.ai. Полные отчёты о тестах, методология, классификации AVE, оценочная рубрика и пошаговые разборы доступны по адресам:

  • https://calmkeep.ai/codetestreport
  • https://calmkeep.ai/legaltestreport

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Tilde.run: Песочница для агентов с транзакционной версионированной файловой системой
Инструменты

Tilde.run: Песочница для агентов с транзакционной версионированной файловой системой

Tilde.run предоставляет изолированные, обратимые песочницы для AI-агентов, с версионируемой файловой системой, которая монтирует GitHub, S3 и Google Drive, и сетевой изоляцией по умолчанию.

OpenClawRadar
Чеппер: Нативный клиент для iOS для LM Studio, Ollama и локальных моделей, совместимых с OpenAI
Инструменты

Чеппер: Нативный клиент для iOS для LM Studio, Ollama и локальных моделей, совместимых с OpenAI

Chapper — это нативное приложение для iOS на SwiftUI, которое подключается к локальным моделям ИИ, работающим в LM Studio, Ollama и на любом совместимом с OpenAI сервере. Приложение полностью работает на устройстве без необходимости облачных сервисов, веб-представлений или обязательных аккаунтов.

OpenClawRadar
Расширение OpenClaw направляет запросы через CLI Claude Code, а не через API.
Инструменты

Расширение OpenClaw направляет запросы через CLI Claude Code, а не через API.

Расширение OpenClaw запускает бинарный файл Claude CLI как подпроцесс, направляя запросы через Claude Code CLI вместо API Anthropic. Это обеспечивает полный опыт работы с Claude Code по фиксированной ставке максимального плана.

OpenClawRadar
🦀
Инструменты

Дайте вашему агенту OpenClaw телефон: плагин с открытым исходным кодом для голосовых звонков

Разработчик опубликовал плагин с открытым исходным кодом, позволяющий OpenClaw совершать телефонные звонки. В отличие от SaaS-решений за $20/мес, этот плагин бесплатен и размещается на собственном сервере.

OpenClawRadar