AIコーディングエージェントのための再帰的自己改善フレームワーク(Claude Code使用)

開発者が、AIコーディングエージェントがClaude Codeを使用して再帰的に自己改善できるフレームワークをオープンソース化しました。このシステムは、モデルプロバイダーが再帰的エージェント最適化をどのように実装しているかについて数ヶ月にわたる研究を経て開発されました。
仕組み
このフレームワークは、エージェント改善のための体系的なアプローチを提供します:
- 2行のコードでエージェントにトレース機能を追加(すでにトレースがある場合はステップ3にスキップ)
- エージェントを複数回実行して実行トレースを収集
- Claude Codeで
/recursive-improveを実行 - システムがトレースを分析し、失敗パターンを発見、修正計画を立案し、承認のために提示
- 修正を適用し、エージェントを再実行し、
/benchmarkでベースラインに対して改善を検証 - 改善を継続するためにサイクルを繰り返す
自律オプション
完全自律運用(Karpathyのautoresearchに類似)の場合:
/ratchetを実行して改善ループ全体を自動実行- システムが改善、評価を行い、変更を保持または元に戻す
- 改善のみが残る
- 一晩中実行して、より優れたエージェントで目覚めることができる
性能結果
実際のエンタープライズエージェントベンチマーク(tau2)で、スキルが完全自律モードで実行された場合のテスト:
- 1回の改善サイクル後に25%の性能向上
技術的背景
元の研究には、大規模なトレース分析のためのサンドボックス化されたREPLを備えた再帰的言語モデルアーキテクチャの構築、マルチエージェントパイプライン、その他のコンポーネントが含まれていました。開発者は、エージェントを構築するほとんどの人々にはこの複雑さは必要なく、Claude Codeが再帰的自己改善に十分な能力を提供することを発見しました。
このフレームワークは、あなたのコーディングエージェントに次のように指示します:これがトレースです、これが分析方法です、これが修正の優先順位付け方法です、そしてこれが検証方法です。
オープンソースリポジトリ:https://github.com/kayba-ai/recursive-improve
📖 Read the full source: r/ClaudeAI
👀 See Also

LivingAgents.ai: Claude APIを使用したWebベースのAIエージェントシミュレーション
LivingAgents.aiは、Claude APIによって駆動されるエージェントが採集、取引、製作、攻撃、繁殖、そして永久的な死といった行動を行うウェブベースのシミュレーションです。各行動には実際のLLM呼び出しが必要となります。

Argus: Claude Codeのリアルタイム可観測性を実現するオープンソースVS Code拡張機能
ArgusはVS Code内でClaude Codeのエージェントステップをリアルタイムに可視化し、タイムライン、依存関係グラフ、コスト/ループ検出を表示して、トークンを浪費する動作をデバッグします。

効率的なワークフロー:実行前の計画立案(Claude Code活用)
ボリス・タネは、構造化された計画優先アプローチでClaude Codeを活用し、詳細な調査と計画に焦点を当てることで、アーキテクチャの決定に対するコントロールを維持しています。

SIDJUA V1.0:AIエージェント向けセルフホスト型ガバナンスプラットフォーム
SIDJUA V1.0は、Docker上で動作するAIエージェント向けの無料のセルフホスティングガバナンスプラットフォームで、Raspberry Piもサポートしています。エージェントタスクの必須チェックポイント、暗号化された認証情報の保存、ネットワーク分離、詳細な予算管理を提供します。