tmuxとMarkdown仕様による並列コーディングエージェント

✍️ OpenClawRadar📅 公開日: March 2, 2026🔗 Source
tmuxとMarkdown仕様による並列コーディングエージェント
Ad

マヌエル・シッパーは、tmux、Markdownファイル、bashエイリアス、6つのスラッシュコマンドを使用した軽量なセットアップで並列コーディングエージェントを実行しています。これらはサブエージェントプロファイルやオーケストレーターを使用しないバニラエージェントで、tmuxウィンドウごとに役割命名規則を採用しています:Planner(Markdown仕様書を作成)、Worker(完成した仕様書から実装)、PM(バックログ整理とアイデアダンプ)。

Feature Designシステム

ほとんどのコード作成は、Feature Designs(FDs)と呼ばれる完成した仕様書から行われます。FDは以下の内容を含むMarkdownファイルです:

  • 解決すべき問題
  • 検討されたすべての解決策とそれぞれの長所・短所
  • 更新するファイルを含む実装計画を伴う最終的な解決策
  • 検証手順

このシステムを採用した後、シッパーは4〜8つのエージェントで並行作業が可能になりました。8エージェントを超えると意思決定の質が低下します。このシステムは、300以上の仕様書を持つ1つのプロジェクトで手動で構築され、その後、任意のリポジトリにセットアップをブートストラップする/fd-initコマンドを使用して新しいプロジェクトに移植されました。

FD追跡とライフサイクル

各FDには番号付きの仕様書ファイル(FD-001、FD-002...)が割り当てられ、すべてのFDにわたるインデックスで追跡されます。ファイルはdocs/features/に保存され、8つのステージを経ます:

  • Planned: 特定済み、設計前
  • Design: 解決策を積極的に設計中
  • Open: 設計完了、実装準備完了
  • In Progress: 現在実装中
  • Pending Verification: コード完成、実行時検証待ち
  • Complete: 動作検証済み、アーカイブ準備完了
  • Deferred: 無期限延期
  • Closed: 実施しない

スラッシュコマンド

6つのスラッシュコマンドが完全なライフサイクルを処理します:

  • /fd-new: アイデアダンプから新しいFDを作成
  • /fd-status: インデックスを表示:アクティブ、検証待ち、完了したもの
  • /fd-explore: セッションをブートストラップ:アーキテクチャ文書、開発ガイド、FDインデックスを読み込み
  • /fd-deep: 4つの並列Opusエージェントを起動して困難な設計問題を調査
  • /fd-verify: コードを校正し、検証計画を提案し、コミット
  • /fd-close: FDをアーカイブし、インデックスを更新し、変更履歴を更新

すべてのコミットは対応するFDに関連付けられます(例:「FD-049: 増分インデックス再構築を実装」)。変更履歴はFDが完了するにつれて自動的に蓄積されます。

Ad

FDファイルの例

FD-051: マルチラベル文書分類
Status: Open
Priority: Medium
Effort: Medium
Impact: 下流フィルタリングのリコール向上

問題

受信文書には単一のカテゴリラベルが付与されますが、多くの文書は複数のトピックにまたがります。分類器が単一の最適適合を強制するため、下流フィルターは関連文書を見逃しています。

解決策

単一ラベル分類をマルチラベルに置き換え:

  1. LLMを使用してカテゴリごとの信頼度スコアを割り当て。
  2. 0.90以上の信頼度を持つすべてのラベルを受け入れる。
  3. 曖昧なスコア(0.50-0.90)の場合、数ショット例を使用した第2のLLMパスを実行して確認。
  4. 下流クエリが柔軟に閾値を設定できるよう、すべてのラベルとスコアを保存。

変更するファイル

  • src/classify/multi_label.py(新規:LLMベースのマルチラベルロジック)
  • src/classify/prompts.py(新規:曖昧なケースのための数ショットテンプレート)
  • sql/01_schema.sql(スコア付きdocument_labelsテーブルを追加)
  • sql/06_classify_job.sql(新規:取り込み後のスケジュール分類)

検証

  1. ステージング文書テーブルで分類器を実行
  2. 操作ログにエラーがないことを確認し、ヘルスチェックを実行
  3. スポットチェック:既知のマルチトピックコンテンツを持つ文書が期待されるラベルを持つことを確認
  4. テストを実行し、下流フィルターが信頼度閾値を尊重することを確認

システム初期化

任意のリポジトリで/fd-initを実行すると:

  • CLAUDE.md、パッケージ設定、gitログからプロジェクトコンテキストを推論
  • ディレクトリ構造を作成(docs/features/、docs/features/archive/)
  • プロジェクトにカスタマイズされたFEATURE_INDEX.mdを生成
  • FDテンプレートを作成
  • 6つのスラッシュコマンドをインストール
  • FDライフサイクル規約をプロジェクトのCLAUDE.mdに追加

作成されるファイルには、docs/features/FEATURE_INDEX.md(機能インデックス)、docs/features/TEMPLATE.md(FDファイルテンプレート)、docs/features/archive/(アーカイブディレクトリ)、CHANGELOG.md(Keep a Changelog形式)、FDシステムを含むプロジェクト規約を記載したCLAUDE.mdへの更新が含まれます。

📖 完全なソースを読む: HN AI Agents

Ad

👀 See Also

MephisQuiz:エンジニア職能評価のための無料シナリオベースクイズプラットフォーム
Tools

MephisQuiz:エンジニア職能評価のための無料シナリオベースクイズプラットフォーム

SREの専門家がMephisQuizを構築しました。これは、4つのエンジニアリングロールトラックにまたがる860以上のシナリオベースの質問を備えた無料のクイズプラットフォームです。このプラットフォームは適応型の難易度を使用し、トピックごとの詳細な分析を提供し、Claude AIをペアプログラマーとして活用して開発されました。

OpenClawRadar
Fennara: Godotプラグインと反復フィードバックループによるAIエージェント向けMCP
Tools

Fennara: Godotプラグインと反復フィードバックループによるAIエージェント向けMCP

FennaraはGodotプラグインおよびMCPサーバーで、AIエージェントにスクリプト診断、シーン検証、ランタイムエラー、ノード情報、スクリーンショット、セマンティック検索結果を各編集後に提供し、ワンショットコマンドよりも密なフィードバックループを実現します。

OpenClawRadar
ジャン=クロード: EUのAI規制を風刺するLLMフロントエンド、412のクッキーパートナーと5メッセージごとのVAT請求書付き
Tools

ジャン=クロード: EUのAI規制を風刺するLLMフロントエンド、412のクッキーパートナーと5メッセージごとのVAT請求書付き

Jean-Claude は、AI 利用に EU スタイルの極度の官僚主義を適用する風刺的な LLM フロントエンドです。412 のクッキーパートナー、共同署名が必要な四眼原則、トークンごとの CO₂ 追跡と強制ユーロ相殺、5 メッセージごとの VAT 請求書、そして偽の GDPR/AI 法メトリクスを備えたコンプライアンスセンターを備えています。

OpenClawRadar
AutoProber:ハードウェアハッキングのためのAI駆動フライングプローブ自動化
Tools

AutoProber:ハードウェアハッキングのためのAI駆動フライングプローブ自動化

AutoProberは、ハードウェアハッカーのためのフライングプローブ自動化スタックであり、AIエージェントがターゲットの発見、顕微鏡画像のマッピング、安全監視付きCNC動作、プローブの確認、制御されたピンプローブの実行を可能にします。Python制御コード、Webダッシュボード、CADファイルを含み、GRBL CNCコントローラー、USB顕微鏡、オシロスコープの安全監視で動作します。

OpenClawRadar