라이벌-리뷰: AI 에이전트 계획을 위한 교차 모델 검토 루프

무엇인가요
Rival-review는 AI 코딩 에이전트가 적절한 압력 테스트 없이 실행을 시작하는 그럴듯한 계획을 작성하는 일반적인 패턴을 해결하는 도구입니다. 핵심 아이디어는 간단합니다: 계획을 제안하는 모델이 계획을 검토하는 모델이 아닙니다.
작동 방식
루프는 간단합니다:
- 플래너가 계획을 작성합니다
- Claude가 범위가 지정된 컨텍스트에 대해 검토합니다
- 문제는 수정을 위해 돌아갑니다
- 게이트가 통과되거나 최대 라운드에 도달할 때까지 루프가 계속됩니다
두 번째 모델은 구현이 시작되기 전에 읽기 전용 패스로 계획을 감사합니다. 이 교차 모델 검토는 단순한 '계획 다듬기'가 아닌 것들을 포착합니다:
- 실제로 롤백하지 않는 롤백 계획
- 실제 보안 허점이 있는 권한 설계
- 오래된 상태에서 진행/중단 결정을 내리는 검토 게이트
- 두 번째 모델이 전체 흐름을 따라갈 때까지 일관성 있게 들리는 다단계 계획
주요 설계 선택
여러 설계 선택이 매우 중요했습니다:
- 검토자는 읽기 전용이어야 합니다
- 자동 루프에는 하드 라운드 제한이 필요합니다
- 범위가 지정된 컨텍스트가 매우 중요합니다
- 라이브 터미널 대시보드는 검토 루프를 불투명하지 않고 검사 가능하게 만듭니다
구현 세부 사항
이 도구는 다양한 플래너와 함께 작동합니다:
- Claude Code는 기본 계획 종료 훅을 사용할 수 있습니다
- Codex 및 기타 오케스트레이터는 명시적 플래너 게이트를 사용할 수 있습니다
창작자는 스스로 구축하는 데 도움을 주기 위해 사용했습니다: Codex가 계획을 세우고, Claude가 검토했으며, 설계가 여러 라운드에 걸쳐 수렴되었습니다.
사용 가능 여부
이 도구는 MIT 라이선스이며 GitHub에서 사용할 수 있습니다: github.com/alexw5702-afk/rival-review.
📖 전체 Source 읽기: r/LocalLLaMA
👀 See Also

Queuelo: LLM 에이전트를 위한 경량 승인 API
Queuelo는 LLM 에이전트가 되돌릴 수 없는 작업을 실행하기 전에 일시 중지할 수 있게 해주는 간단한 API 레이어입니다. 에이전트가 작업 요청을 POST하면, 사용자는 승인 또는 거절 알림을 받고, 에이전트는 웹훅을 통해 응답을 받습니다.
Terry Tao, LLM 에이전트를 사용해 24개의 Java 애플릿을 JavaScript로 포팅하다 — 원본 코드에서 버그 발견
테렌스 타오가 LLM 코딩 에이전트를 사용하여 1999년에 만든 자바 애플릿 24개를 단 몇 시간 만에 자바스크립트로 포팅했습니다. 에이전트는 원본 코드에서 버그 2개를 찾아냈고, 드래그 처리 관련 사소한 버그 하나만 새로 만들었습니다.

내장된 Ollama 지원 기능을 갖춘 OpenClaw Kubernetes Operator
한 커뮤니티 구성원이 로컬 모델과 함께 동일한 네임스페이스에서 AI 에이전트를 실행할 수 있도록 임베디드 Ollama 지원을 포함한 OpenClaw Kubernetes 오퍼레이터를 만들었습니다. 설정에는 설치 명령어, 로컬 및 클라우드 Ollama 모델에 대한 구성 세부 정보, 대시보드 접근 지침이 포함됩니다.

에이전트 브라우저 프로토콜: AI 에이전트용 오픈소스 Chrome 포크, Mind2Web 벤치마크에서 90% 달성
에이전트 브라우저 프로토콜(ABP)은 각 작업 후 JavaScript와 시간을 정지시켜 웹 브라우징을 AI 에이전트용 멀티모달 채팅으로 변환하는 오픈소스 Chrome 포크입니다. Online Mind2Web 벤치마크에서 90.53%를 달성했으며, 단일 명령어로 Claude Code에 추가할 수 있습니다.