ケーススタディ:マルチエージェントソフトウェア構築におけるプログラムによるスキャフォールディングの代わりにLLMプロンプトを使用する方法

✍️ OpenClawRadar📅 公開日: February 23, 2026🔗 Source
ケーススタディ:マルチエージェントソフトウェア構築におけるプログラムによるスキャフォールディングの代わりにLLMプロンプトを使用する方法
Ad

システム概要と結果

Claude OpusオーケストレーターとCodexワーカーエージェントからなるマルチエージェントシステムは、人間のコード介入なしで10の完全自律的ソフトウェアビルドを完了しました。このシステムは合計50,000行以上のコードと数百の合格テストを持つ10のTypeScriptブラウザゲームを生成しました。

オーケストレーター(プロンプトとCLIアクセスを与えられた最先端LLM)は、目標を分解し、並列ワーカーを派遣し、結果を分析し、エラーをトリアージし、統合を調整しました。プログラム的なスキャフォールド、ステートマシン、タスクルーティングインフラは使用されず、オーケストレーションロジックはプログラムではなくプロンプトです。

ケーススタディからの主要な発見

  • プロンプトによるスコープ強制はコンパイラの圧力下で完全に失敗(0/20)する一方、事後的なファイル復元による機械的強制は簡単に有効(20/20)
  • 統合エージェントが無制限の編集アクセスを持つ場合、テストされたあらゆる規模(6〜36モジュール)で型契約は統合に必要ない
  • オーケストレーターは11回のコンテキスト圧縮イベントにわたって完全なタスク継続性を維持
  • コスト分析はステートフル性プレミアムを明らかに:約95%のキャッシュヒット率で、オーケストレーター処理の大部分は以前の会話コンテキストの再読み込み
  • 単純プロンプトのアブレーションは、モデルが独立して調整パターンを発見するという強い主張を反証するが、約30K LOC以下では単独実行が調整されたビルドを上回ることを明らかに
Ad

システムアーキテクチャとデータ

このシステムはツリーアーキテクチャを使用:人間がClaude Opusオーケストレーターに目標を提供し、オーケストレーターが作業を分解して並列タスクとしてCodexワーカーに派遣します。ワーカーは完全自律的に動作し、ファイルシステムを通じてのみ通信します。

完全なデータセットには以下が含まれます:

  • 10のClaudeオーケストレーターセッション(52 MB)
  • 88のCodexワーカーセッション(89 MB)
  • 62のワーカー標準出力ログ(186.7 MB、610万行)
  • 完全なプロンプトテキストを含む55の目標ファイル
  • 1つのTUIイベントログ(21 MB、17.3万行)

合計コーパス:88のCodexワーカーセッションと10のClaudeオーケストレーターセッションにわたる2億9500万トークン。

システムの進化

このシステムは約6ヶ月にわたる5つのフェーズを経て進化しました。オペレーターは、二重LLMチャットウィンドウ間の手動コピー&ペーストから始め、ファイルシステムアクセスのためのターミナルCLIツールに移行し、メモリとルーティングを持つプログラム的スキャフォールドを構築しました。スキャフォールドは機能しましたが脆弱で、あらゆるエッジケースに新しいコードが必要でした。CLIアクセスを持つ単一のClaudeセッションがそれを上回りました。

結果として得られたシステム、orch-minimalは、62,792行のサポートコードを保持していますが、コアのオーケストレーションロジックはプログラムではなくプロンプトです。

📖 完全なソースを読む: r/LocalLLaMA

Ad

👀 See Also

Claudeの履歴書レビューにおける批判的質問アプローチと、ChatGPTおよびGeminiとの比較
Use Cases

Claudeの履歴書レビューにおける批判的質問アプローチと、ChatGPTおよびGeminiとの比較

ある開発者がClaude、ChatGPT、Geminiを履歴書最適化に使用して比較したところ、Claudeは経験の空白期間やプロジェクト成果について独自の質問を投げかけ、履歴書を単なる事実の磨き上げではなく、検証すべき主張として扱うことを発見しました。

OpenClawRadar
Claude Codeを使用してAI研究実験を12時間自動化する
Use Cases

Claude Codeを使用してAI研究実験を12時間自動化する

開発者がClaude Codeを使用して12時間連続で自動化されたAI研究実験を実施し、継続学習フレームワークを調整してモデルの選好検証器への適合度を最大化しました。システムは9回の実験を実行し、モデル崩壊のバグを修正、適合度を0%から100%に向上させました。

OpenClawRadar
Claude AIがAlexaのサポート外コマンド処理の代替頭脳として活用
Use Cases

Claude AIがAlexaのサポート外コマンド処理の代替頭脳として活用

ある開発者が、Alexaが処理できないコマンドに対してClaude AIがフォールバックプロセッサとして機能するシステムを構築しました。軽量なレイヤーで、ヒンディー語の処理、CCTVストリーミング、非スマートデバイスの制御に対応しています。システムはTV制御にWebSocket、セットトップボックスにDLNA、CCTVにはRTSP→HLS変換を使用しています。

OpenClawRadar
OpenClawとNotionで信頼性の高いキャッシュフローエージェントを構築:SMS解析と取引ラベリングの教訓
Use Cases

OpenClawとNotionで信頼性の高いキャッシュフローエージェントを構築:SMS解析と取引ラベリングの教訓

ある開発者が、SMSアラート、iPhoneショートカット、Notion、OpenClawを活用し、ビジネスの元帳追跡を自動化するローカルファーストAIエージェントを構築しました。システムは機能していますが、信頼性を確保するために3つの課題を解決する必要がありました。それは、銀行SMSの改行処理、文脈に応じた解析のためのAI活用、小額取引の追跡のためのプロンプト調整です。

OpenClawRadar