Перекрестная модель цикла проверки для AI-агентов программирования выявляет критические недостатки планирования.

✍️ OpenClawRadar📅 Опубликовано: 16 апреля 2026 г.🔗 Source
Перекрестная модель цикла проверки для AI-агентов программирования выявляет критические недостатки планирования.
Ad

Как работает кросс-модельное ревью

Разработчик на r/ClaudeAI создал систему, которая решает распространённую проблему с ИИ-агентами для программирования, такими как Codex, Claude Code и Cursor: планы выполняются без предварительной проверки их предположений. Решение направляет каждый план через вторую модель ИИ с другой архитектурой и обучающими данными до начала выполнения.

Ключевые детали реализации

Модель-рецензент работает в режиме только для чтения и не может изменять код — она может только оспаривать план. Это ограничение критически важно, потому что «как только она сможет редактировать, она перестаёт быть критиком и начинает идти на компромиссы». Система запускает автоматический цикл с ограничением по раундам: планы возвращаются на доработку, если обнаружены проблемы, пока они не пройдут проверку или не достигнут лимита.

Что система выявляет

  • Планы отката, которые фактически не откатывают изменения
  • Схемы разрешений с реальными уязвимостями безопасности
  • Контрольные точки ревью, принимающие решения о продолжении/остановке на основе устаревших данных
  • Многоэтапные планы, которые кажутся логичными, пока вторая модель не пройдёт по всему процессу
Ad

Критические проектные решения

  • Ограниченный контекст ревью предотвращает трату времени рецензента на чтение нерелевантных частей репозитория
  • Персоны рецензента (риски поставки, воспроизводимость, производительность-стоимость, безопасность-соответствие) выявляют разные типы проблем
  • Живая TUI-панель управления показывает фазу, раунд, вердикт, серьёзность, стоимость и историю в одном терминальном представлении
  • Система работает с разными планировщиками: Claude Code использует нативный хук ExitPlanMode, а Codex и другие оркестраторы используют явный шлюз

Практические результаты

Разработчик использовал систему, чтобы помочь построить её саму: «Codex планировал, Claude рецензировал планы, и дизайн сходился за несколько раундов». Инструмент имеет лицензию MIT и доступен как rival-review на GitHub.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

ClawPy: Минимальная однодокументная реализация OpenClaw на Python с памятью опыта
Инструменты

ClawPy: Минимальная однодокументная реализация OpenClaw на Python с памятью опыта

Разработчик создал ClawPy — упрощённый скрипт на Python, который реализует механику автономного выполнения задач OpenClaw с системой постоянного опыта, обучающейся на прошлых ошибках и успехах.

OpenClawRadar
Замена Kafka, Redis и RabbitMQ на NATS: опыт разработчика
Инструменты

Замена Kafka, Redis и RabbitMQ на NATS: опыт разработчика

Разработчик заменил Kafka, Redis и RabbitMQ на NATS в своей архитектуре, поделившись конкретными деталями реализации и извлечёнными уроками от консолидации нескольких систем обмена сообщениями в один инструмент.

OpenClawRadar
GrapeRoot Pro добавляет Undo Shield для предотвращения удаления вашего проекта Claude Code
Инструменты

GrapeRoot Pro добавляет Undo Shield для предотвращения удаления вашего проекта Claude Code

После сообщений на Reddit о том, что Claude Code удаляет целые проекты, GrapeRoot Pro представляет Undo Shield — функцию, которая отслеживает граф сессии Claude и блокирует разрушительные команды, такие как rm -rf, для файлов, которые активно редактировались.

OpenClawRadar
Агент ИИ Khael делится решениями по производственной архитектуре для OpenClaw
Инструменты

Агент ИИ Khael делится решениями по производственной архитектуре для OpenClaw

Khael, автономный ИИ-агент, работающий на OpenClaw, подробно описывает конкретные архитектурные решения, которые успешно работают в продакшене уже несколько месяцев, включая отдельные файлы LAWS.md, файлы режимов, задания cron для самопроверки и специализированные типы ботов.

OpenClawRadar