SOPHIA メタエージェント for AIエージェントメンテナンス

SOPHIAは、本番環境におけるAIエージェントの性能劣化という実践的な課題に対処するために設計されたメタエージェントです。営業、臨床文書作成、カスタマーサービス向けのエージェントを運用する際、プロンプトが陳腐化したり、ツールがずれたり、ユーザーの行動が時間とともに変化したりすることがあります。SOPHIAは、システム内の他のすべてのエージェントを観察、診断、調査し、改善を提案するチーフラーニングオフィサーとして機能します。
設計プロセスと技術的貢献
このメタエージェントは、4つのフロンティアモデルを用いて7回の反復を経た実験的プロセスを通じて設計されました:
- Claude → Gemini → ChatGPT → Grokの順で、各モデルが前のバージョンを反復的に改善
- 全3モデルによるピアレビュー、トリアージ、最終的な統合
モデル別の主要な技術的貢献:
- Gemini: アクター・クリティック・パラダイム(エージェントをアクター、Sophiaをクリティックとして)
- ChatGPT: アンチ・グッドハートガードレール、ツール契約レジストリ、再現性
- Grok: エボルバー(進化的プロンプト検索)、エージェント・アズ・ジャッジ、メタ・ソフィア
運用詳細
システムでは、すべての変更に人間の承認が必要です。明示的な承認なしにデプロイは行われません。これにより、SOPHIAが改善を提案できる一方で、人間の監視が本番環境の制御を維持します。
設計プロセス全体と実装の詳細は、プロジェクトのリポジトリに文書化されており、反復的な開発アプローチと設計に使用された各モデルの具体的な貢献が含まれています。
📖 完全なソースを読む: r/LocalLLaMA
👀 See Also

エージェントチャット:AIエージェントのためのソーシャルネットワークと決済システム
新しいプラットフォームにより、AIエージェントは互いを見つけ、自律的に仕事を交渉し、完了したタスクに対して報酬を受け取ることができます。

オープンソースの信頼スコアリングフック for Claude Codeは、セッションを監視し、保護されたパスをブロックします。
開発者が、信頼性、範囲、コストの3つの次元でClaude Codeセッションをスコアリングし、.envファイルなどの保護されたパスへのアクセスをブロックし、改ざん検出のためにイベントをハッシュチェーン化するPythonフックを構築しました。この単一ファイルのツールはGitHubで利用可能です。

js-notepad: Claude Code用の組み込みMCPサーバーを備えたスクリプト可能なメモ帳
js-notepadは、Claude Codeの支援で構築された、無料のオープンソースでスクリプト可能なメモ帳アプリケーションです。内蔵のMCPサーバーを備えており、Claude Codeがページの読み書き、スクリプトの実行、ToDoの作成、結果のプッシュをアプリと直接やり取りできるようになっています。

開発者がClaude Codeとうまく連携するCLIツールを共有
ある開発者がClaude Codeで作業する際にMCPからCLIに切り替え、Claudeがシェルスクリプトやドキュメントの学習によりCLIコマンドを効果的に扱えることを発見しました。彼らは日常的に使用する具体的なCLIとしてgh、ripgrep、stripe、supabase、vercel、sentry-cli、neonを共有しました。