Перекрестная модель цикла проверки для AI-агентов программирования выявляет критические недостатки планирования.

Как работает кросс-модельное ревью
Разработчик на r/ClaudeAI создал систему, которая решает распространённую проблему с ИИ-агентами для программирования, такими как Codex, Claude Code и Cursor: планы выполняются без предварительной проверки их предположений. Решение направляет каждый план через вторую модель ИИ с другой архитектурой и обучающими данными до начала выполнения.
Ключевые детали реализации
Модель-рецензент работает в режиме только для чтения и не может изменять код — она может только оспаривать план. Это ограничение критически важно, потому что «как только она сможет редактировать, она перестаёт быть критиком и начинает идти на компромиссы». Система запускает автоматический цикл с ограничением по раундам: планы возвращаются на доработку, если обнаружены проблемы, пока они не пройдут проверку или не достигнут лимита.
Что система выявляет
- Планы отката, которые фактически не откатывают изменения
- Схемы разрешений с реальными уязвимостями безопасности
- Контрольные точки ревью, принимающие решения о продолжении/остановке на основе устаревших данных
- Многоэтапные планы, которые кажутся логичными, пока вторая модель не пройдёт по всему процессу
Критические проектные решения
- Ограниченный контекст ревью предотвращает трату времени рецензента на чтение нерелевантных частей репозитория
- Персоны рецензента (риски поставки, воспроизводимость, производительность-стоимость, безопасность-соответствие) выявляют разные типы проблем
- Живая TUI-панель управления показывает фазу, раунд, вердикт, серьёзность, стоимость и историю в одном терминальном представлении
- Система работает с разными планировщиками: Claude Code использует нативный хук ExitPlanMode, а Codex и другие оркестраторы используют явный шлюз
Практические результаты
Разработчик использовал систему, чтобы помочь построить её саму: «Codex планировал, Claude рецензировал планы, и дизайн сходился за несколько раундов». Инструмент имеет лицензию MIT и доступен как rival-review на GitHub.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

ClawPy: Минимальная однодокументная реализация OpenClaw на Python с памятью опыта
Разработчик создал ClawPy — упрощённый скрипт на Python, который реализует механику автономного выполнения задач OpenClaw с системой постоянного опыта, обучающейся на прошлых ошибках и успехах.

Замена Kafka, Redis и RabbitMQ на NATS: опыт разработчика
Разработчик заменил Kafka, Redis и RabbitMQ на NATS в своей архитектуре, поделившись конкретными деталями реализации и извлечёнными уроками от консолидации нескольких систем обмена сообщениями в один инструмент.

GrapeRoot Pro добавляет Undo Shield для предотвращения удаления вашего проекта Claude Code
После сообщений на Reddit о том, что Claude Code удаляет целые проекты, GrapeRoot Pro представляет Undo Shield — функцию, которая отслеживает граф сессии Claude и блокирует разрушительные команды, такие как rm -rf, для файлов, которые активно редактировались.

Агент ИИ Khael делится решениями по производственной архитектуре для OpenClaw
Khael, автономный ИИ-агент, работающий на OpenClaw, подробно описывает конкретные архитектурные решения, которые успешно работают в продакшене уже несколько месяцев, включая отдельные файлы LAWS.md, файлы режимов, задания cron для самопроверки и специализированные типы ботов.