AIコーディングエージェントのためのクロスモデルレビューループが重大な設計上の欠陥を捕捉

✍️ OpenClawRadar📅 公開日: April 16, 2026🔗 Source
AIコーディングエージェントのためのクロスモデルレビューループが重大な設計上の欠陥を捕捉
Ad

クロスモデルレビューの仕組み

r/ClaudeAIの開発者が、Codex、Claude Code、CursorなどのAIコーディングエージェントに共通する問題に対処するシステムを構築しました。その問題とは、計画が誰にも仮定を検証されることなく実行されてしまうことです。この解決策では、実行開始前にすべての計画を、異なるアーキテクチャとトレーニングデータを持つ第二のAIモデルにルーティングします。

主要な実装詳細

レビュアーモデルは読み取り専用で、コードに触れることはできません。計画に対して異議を唱えることしかできません。この制約は、「編集できるようになった瞬間、それは批評家ではなくなり、妥協を始める」ため、非常に重要です。システムはラウンド上限付きの自動ループを実行します。問題が見つかった場合、計画は修正のために戻され、合格するか上限に達するまで繰り返されます。

システムが検出するもの

  • 実際にはロールバックしないロールバック計画
  • 実際のセキュリティホールがある権限設計
  • 古い状態から進める/進めないの決定を行うレビューゲート
  • 第二のモデルが全体の流れを追跡するまで首尾一貫しているように聞こえる多段階計画

重要な設計上の決定

  • スコープ付きレビューコンテキストにより、レビュアーがリポジトリの無関係な部分を読む時間を無駄にすることが防止されます
  • レビュアーのペルソナ(デリバリーリスク、再現性、パフォーマンスコスト、安全性コンプライアンス)により、異なる種類の問題が検出されます
  • ライブTUIダッシュボードは、フェーズ、ラウンド、判定、重大度、コスト、履歴を1つのターミナルビューで表示します
  • システムは異なるプランナーと連携します。Claude CodeはネイティブのExitPlanModeフックを使用し、Codexやその他のオーケストレーターは明示的なゲートを使用します

実際の成果

開発者はこのシステムを、システム自体の構築に役立てました。「Codexが計画し、Claudeが計画をレビューし、設計は複数ラウンドにわたって収束しました。」このツールはMITライセンスで、GitHubでrival-reviewとして利用可能です。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

OpenClaw iOSアプリは、最大18ヶ月分の過去のApple Healthデータ同期機能を追加しました。
Tools

OpenClaw iOSアプリは、最大18ヶ月分の過去のApple Healthデータ同期機能を追加しました。

OpenClaw iOSアプリの最新バージョンでは、Apple Healthの過去データのエクスポートが可能になり、ユーザーは最大18か月分の健康データをエージェントと同期して、パーソナライズされた分析やAIトレーニングに活用できます。

OpenClawRadar
🦀
Tools

ThoughtDAG:LLM对话的可编辑上下文图

ThoughtDAGは、LLMのコンテキストを編集可能なグラフに変換し、モデルが見るものを分岐、統合、剪定できます。パイロットでは、古いブランチを削除してエラーを修正し、トークン数を削減できることが示されています。

OpenClawRadar
Rift CLI: 並列AIエージェントワークフローのためのGitワークツリー管理
Tools

Rift CLI: 並列AIエージェントワークフローのためのGitワークツリー管理

Riftは、同じリポジトリ上でClaude Codeなどの複数のAIコーディングエージェントを同時に実行するために、分離されたGitワークツリーとブランチを作成するCLIツールです。ライフサイクルフック、決定論的ポートマッピング、マルチエディタワークスペースサポートが含まれています。

OpenClawRadar
Kanban CLI:终端用本地优先、智能体优先的任务管理器
Tools

Kanban CLI:终端用本地优先、智能体优先的任务管理器

Kanban CLIは、Rust製のターミナルツールで、完全なgit統合により構造化されたタスク追跡を提供し、AIエージェント駆動のワークフロー向けに設計されています。

OpenClawRadar