4-слойная система самопроверки для поведенческой эволюции OpenClaw

✍️ OpenClawRadar📅 Опубликовано: 17 марта 2026 г.🔗 Source
4-слойная система самопроверки для поведенческой эволюции OpenClaw
Ad

Разработчик, использующий OpenClaw в качестве постоянного ИИ-ассистента в течение 6 недель, обнаружил повторяющуюся проблему: когда Claude проверяет собственное поведение, это создаёт слепые зоны, приводящие к повторяющимся ошибкам, таким как объявление исправлений "готовыми" без тестирования или описание запланированной работы с той же уверенностью, что и выполненной работы.

4-уровневая система аудита

Решение представляет собой 4-уровневую систему, предназначенную для поведенческой эволюции, а не для обучения модели. Веса не меняются, но рабочие инструкции становятся умнее благодаря этим уровням:

  • Проверка после исправления: Исправление + Тестирование + Доказательство как один атомарный шаг. Никаких "исправлено" без доказательств.
  • Анализ паттернов: Еженедельная задача cron, которая читает журнал ошибок в поисках кластеров (одна и та же ошибка 2+ раза = системная проблема).
  • Внешнее зеркалирование: Передача сводок сессий Gemini или другой LLM с промптом "найди, к чему этот ассистент слеп". Разная архитектура создаёт разные слепые зоны.
  • Ожидание vs Реальность: Ежедневная проверка для подтверждения, действительно ли вчерашние "исправленные" пункты остались исправленными.
Ad

Результаты и реализация

В первом реальном тесте Gemini обнаружила 2 паттерна, которые Claude полностью пропустил при самопроверке. Оба были реальными проблемами, которые не были бы выявлены изнутри системы.

Система включает защитные механизмы: человеческое одобрение для изменений поведения, запретные файлы и максимум 3 исправления за цикл. Код доступен на GitHub по адресу https://github.com/oscarsterling/reasoning-loop.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Tilde.run: Песочница для агентов с транзакционной версионированной файловой системой
Инструменты

Tilde.run: Песочница для агентов с транзакционной версионированной файловой системой

Tilde.run предоставляет изолированные, обратимые песочницы для AI-агентов, с версионируемой файловой системой, которая монтирует GitHub, S3 и Google Drive, и сетевой изоляцией по умолчанию.

OpenClawRadar
ClearSpec: Генератор спецификаций для снижения галлюцинаций в коде Claude
Инструменты

ClearSpec: Генератор спецификаций для снижения галлюцинаций в коде Claude

ClearSpec — это инструмент, который генерирует структурированные спецификации из простых описаний на английском языке, подключается к репозиториям GitHub для ссылок на реальные пути к файлам и зависимости, а затем использует эти спецификации в качестве промптов для Claude Code, чтобы предоставить более качественный контекст.

OpenClawRadar
Нельсон: Плагин Claude Code для координации ИИ-агентов по принципу военно-морского флота
Инструменты

Нельсон: Плагин Claude Code для координации ИИ-агентов по принципу военно-морского флота

Nelson — это плагин Claude Code, который структурирует координацию ИИ-агентов, используя принципы военно-морского флота. Он включает три режима выполнения, систему классификации рисков, мониторинг целостности корпуса и шлюзы постоянных приказов для предотвращения распространённых антипаттернов.

OpenClawRadar
OpenClaw Client добавляет отслеживание стоимости API в реальном времени, лимиты расходов и детальные настройки агентов
Инструменты

OpenClaw Client добавляет отслеживание стоимости API в реальном времени, лимиты расходов и детальные настройки агентов

В клиенте OpenClaw теперь доступен интерфейс отслеживания использования в реальном времени с круговыми индикаторами прогресса, лимитами расходов на агента, управлением подчиненными агентами, переключением навыков и сменой моделей от разных провайдеров.

OpenClawRadar