Обходимый граф навыков для постоянной памяти ИИ-агента в кодовых базах

Практическое решение для ИИ-ассистентов без сохранения состояния
ИИ-ассистентам для программирования не хватает постоянной памяти между сессиями, что вынуждает разработчиков каждый раз начинать с нуля. Распространенный подход с выгрузкой всего в большие файлы правил, такие как .cursorrules, терпит неудачу из-за ограничений по токенам и размывания инструкций.
Представленное решение — это прогрессивное раскрытие информации через обходимый граф навыков, который существует внутри кодовой базы. ИИ самостоятельно перемещается по этому графу между сессиями.
Трехслойная архитектура
Система имеет три отдельных слоя:
- Слой 1 (Всегда загружен): Менее 150 строк (300 токенов). Содержит идентификатор стека, соглашения о папках и непреложные правила. Включает одну исходящую ссылку на
HANDOVER.md. - Слой 2 (Загружается за сессию):
HANDOVER.mdслужит маршрутизатором внимания, а не документом. Он сообщает ИИ, какой файл домена загружать в зависимости от текущей задачи (платежи, аутентификация, база данных, API-маршруты). Каждый файл домена заканчивается инструкциями, указывающими на следующий соответствующий файл, создавая самонаправляющуюся систему. - Слой 3 (Загружается по задаче): Библиотека промптов с 12 категориями. Каждая запись включает разделы контекста, сборки, проверки и отладки. ИИ проверяет индекс, загружает категорию и следует шаблону.
Ключевое понимание: Самонаправляющие инструкции
Основное нововведение заключается в том, что инструкции несут смысл, а не просто ссылки. Например: "загрузи security/threat-modeling.md перед изменением обработчиков вебхуков" сообщает ИИ когда и почему, а не только что.
Разработчик встроил это в SaaS-шаблон, который поставляется вместе с кодовой базой, доступный на launchx.page для тех, кто хочет изучить полную структуру графа.
📖 Прочитать полный источник: r/LocalLLaMA
👀 Смотрите также

Merlin: Локальное первое дедупликация контекста LLM – измерение до 71% перекрытия чанков, бесплатно и с открытым ядром
Merlin — это локальный инструмент дедупликации контекста, который показал 22–71 % дублирования чанков на 22 миллионах пассажей из реальных сессий агентов/RAG. Работает как HTTP-прокси (Ollama/vLLM/SGLang/llama.cpp), MCP-сервер (Claude/Cursor/OpenClaw) или автономный CLI. Открытое ядро (MIT) с ежедневным лимитом использования.

cxt: инструмент CLI/TUI для объединения файлов кода в один блок буфера обмена для Claude
cxt объединяет целые каталоги и конкретные файлы в один блок, готовый для буфера обмена, с XML-тегами и путями к файлам, что упрощает понимание контекста вашей кодовой базы для Claude.

Microsoft VibeVoice: ASR модели на 60 минут и TTS модели на 90 минут с открытым исходным кодом
VibeVoice — это семейство голосовых AI-моделей с открытым исходным кодом от Microsoft, включающее ASR (однопроходная обработка до 60 минут, диаризация дикторов, более 50 языков) и TTS (мультиспикер до 90 минут, потоковый режим в реальном времени). Использует непрерывные токенизаторы речи с частотой 7,5 Гц и диффузию следующего токена.

OpenBridge: Бесплатный открытый удаленный контроль для Claude Code через Slack/Discord
OpenBridge — это бесплатный инструмент с открытым исходным кодом, который позволяет управлять Claude Code из Slack или Discord, организуя проекты как каналы, а обсуждения — как ветки. Он работает локально или на VPS и совместим с существующими подписками Claude Code/Codex без дополнительных плат за API.