コールドバリデーションアーキテクチャ:デュアルエージェントコードレビューシステムをオープンソース化

Cold Validation Architectureは、AI生成コードのためのデュアルエージェント検証を実装するオープンソースシステムです。1つのエージェントがコードを記述し、別の独立したエージェントが構築者の推論や文脈にアクセスせずにレビューを行います。
仕組み
このシステムは、独立監査と同様の職務分離を適用することで、単一エージェントの自己レビューによるバイアスに対処します。レビュアーは構築者の思考プロセスから完全に隔離された状態で動作します。
ワークフローの段階
- 計画作成 →
/review-plan(ゲートA) - 実装 →
/review-impl(ゲートC) - 出荷 →
/acceptance-report(ゲートD)
主要な実装詳細
- レビュアーは隔離された一時ディレクトリで実行される
- レビュアーが参照するのは:計画文書、コード差分、テスト出力のみ
- 発見事項は追跡用のフィンガープリントと共に保持される
- 構築者はレビュアーの論理に異議を唱えることができる
- 各段階で最大2ラウンドまで
- bashスクリプトとJSONスキーマで構築
- 現在はClaude Code + Codex CLIで動作
- パターンはエージェント非依存(異なるAIエージェントでも動作可能)
技術仕様
このシステムは、2つの独立したAIエージェント間を調整するbashスクリプトとして実装されています。JSONスキーマは、計画文書、コードレビュー、受入報告書の構造を定義します。隔離された実行環境により、レビュアーは構築者の内部推論や中間ステップにアクセスできません。
このアプローチは、AI生成コードにより厳格な検証を実装したい開発者、特に単一エージェントの自己レビューが確証バイアスを導入する可能性がある複雑なシステムを扱う場合に有用です。
📖 Read the full source: r/LocalLLaMA
👀 See Also

ソールMCPサーバーがローカルLLM向けに永続メモリと安全性を追加
Soulは、ローカルLLM向けにセッション間で永続的なメモリを提供するオープンソースのMCPサーバーです。2つのコマンド(開始時のn2_bootと終了時のn2_work_end)を使用し、Arkセーフティ機能によりrm -rfやDROP DATABASEなどの危険なコマンドをトークンコストゼロでブロックします。クラウドストレージ設定も含まれています。

Ubuntu UTM VMにおけるOpenClawセットアップ(LLM APIおよびOllamaアクセス対応)
ユーザーは、M3 Mac上でサンドボックス化されたUbuntu VM内でOpenClawを正常に設定しました。macOS上のローカルOllamaと、Gemini、Claude、DeepSeekなどの外部LLM APIの両方にアクセスできます。サンプル設定ファイルとトラブルシューティングのメモはGitHubで入手可能です。

サムゲートは、AI安全性のために清華大学の自然言語エージェント制御パターンを実装しています
オープンソースツールThumbGateは、清華大学のNLAH論文のNatural-Language Agent Harnessパターンを実装し、4つのコンポーネントをマッピングしています:契約をサムズダウンフィードバックからの予防ルールに、検証ゲートをPreToolUseフックに、永続状態をSQLite+FTS5レッスンデータベースに、アダプターを複数のAIコーディングエージェント向けのMCPサーバーアダプターにマッピングしています。
OpenClawボイス:DIYハードウェアによる音声対音声スマートホーム制御
OpenClaw Voiceは、Home Assistant Voice PE(59ドル)を専用ハードウェア音声インターフェースに生まれ変わらせ、サブ秒の音声合成、声紋認識、OpenClawメモリ統合を実現。OpenAI Realtimeによる真の音声対話、カスタムウェイクワード、長時間タスクのフィードバックを提供します。