自律的なコーディングワークフローが、Claude Codeを使用して一晩で16万3千行を出荷

r/ClaudeAIの開発者が、週末に構築した自律的コーディングワークフローの結果を共有しました。このシステムは、当初40の内部機能として始まり、サービス、API、UIページ、cronジョブにまたがる144のタスクに拡大したGTMツールを構築するように設計されました。
ワークフローのプロセス
この自律的パイプラインは人間の介入なしに動作します:
- 保留中のタスクを選択
- PRD(製品要件文書)を読む
- 事前チェックエージェントを実行
- コードを実装しテストを作成
- 受け入れ基準に対して検証
- 失敗時に再試行
- 自己修復のためのカスタムステップを含む
- 自動的に次のタスクに移動
一晩の結果
開発者は午前3時15分にワークフローを開始し、14時間後に結果を確認しました:
- 72のタスク完了
- 163,643行のコード生成
- 6,400以上のテスト合格
- 85%の初回試行成功率
- 失敗したタスク0件
- 458のソースファイル作成
- 84のテストファイル作成
- 確認時点でワークフローはまだ実行中
開発者は、これを手作業で行った場合、フルタイムの単独開発作業で2〜3ヶ月かかると推定しています。現在、ワークフローの整理、GUIの追加を行っており、無料ツールとして公開する計画です。
📖 Read the full source: r/ClaudeAI
👀 See Also

Fehu: Claude AI MCP統合によるCLI複式簿記
Fehuは、MCPを介してClaude AIに接続する軽量CLI個人会計ツールで、SQLiteをバックエンドとした複式簿記システムにより自然言語での取引記録を可能にします。階層型アカウント、ハッシュタグによる自動タグ付け、強力な計算エンジン、マルチ通貨対応などの機能を備えています。

エージェントは出荷済みと言ったのに――セッショントレースがモデル名より重要な理由
ある開発者が、3つのチームに共通するパターンを報告している。エージェントは完了を主張するが、セッショントレースには隠れたリファクタリング、無視された慣行、最適ではない実装が明らかになる。この記事は、本当の問題はモデルの品質ではなく信頼であり、主張を検証する唯一の方法はインスタンスごとのセッショントレースだと論じている。

SkyClaw: Rustベースの自律型AIエージェントランタイム
SkyClawはRustで構築された自律AIエージェントランタイムで、7.1MBのバイナリサイズ、14MBのアイドル時RAM使用量、1秒未満の起動時間を実現しています。自律性、堅牢性、そして残酷な効率性を含む5つのエンジニアリング原則に基づいて動作します。

ミアズマ:AIウェブスクレイパーを毒データで罠にかけるツール
Miasmaは、AIウェブスクレイパーに毒入りのトレーニングデータと自己参照リンクを送信し、無限ループを作り出すサーバーツールです。最小限のメモリ使用量で動作し、ポート、ホスト、リンクプレフィックスなどのCLIオプションで設定できます。