大規模Claude Code:エージェント検索が大規模コードベースにおけるRAGの障害モードを回避する方法

Claude Codeは、数百万行のモノレポ、数十年経過したレガシーシステム(C、C++、C#、Java、PHP)、そして数千人の開発者がいる分散アーキテクチャで本稼働しています。RAGベースの検索に依存するのではなく — 埋め込みパイプラインがアクティブなチームに対応できず、2週間前に名前が変わった関数や削除されたモジュールを返してしまうため失敗します — Claude Codeはソフトウェアエンジニアのようにコードベースをナビゲートします。つまり、ファイルシステムを横断し、ファイルを読み、grepを使用し、集中インデックスを構築、維持、またはサーバーにアップロードすることなく、ローカルで参照を追跡します。
モデルよりもハーネスが重要
Claude Codeのパフォーマンスは、モデルのベンチマークよりもハーネス — 互いに積み重なる5つの拡張ポイント — によって決まります。
- CLAUDE.mdファイル — セッション開始時に自動的に読み込まれるコンテキストファイルです。全体像を把握するためのルートファイルと、ローカルな慣習のためのサブディレクトリファイルがあります。広く適用可能な情報に焦点を絞ることで、コンテキストウィンドウの無駄を防ぎます。
- フック — 拡張ポイントとしてリストされている以外の詳細はなし。
- スキル — 拡張ポイントとしてリストされている以外の詳細はなし。
- プラグイン — 拡張ポイントとしてリストされている以外の詳細はなし。
- MCPサーバー — 拡張ポイントとしてリストされている以外の詳細はなし。
さらに2つの機能 — LSP統合とサブエージェント — がセットアップを補完します。記事では、各レイヤーが前のレイヤーに基づいて構築されるため、これらのレイヤーをリストの順序で構築することを推奨しています。
トレードオフ:初期コンテキストの質
エージェント的な検索は、Claudeがどこを探すべきかを知るのに十分な初期コンテキストを持っているときに最も効果的です。数十億行のコードベース全体で曖昧なパターンのすべてのインスタンスを見つけるように依頼すると、作業開始前にコンテキストウィンドウの制限に達します。CLAUDE.mdファイルを通じてコードベースのセットアップに投資するチームは、より良い結果を得られます。
📖 Read the full source: HN AI Agents
👀 See Also

Claudeトークンカウンターがモデル比較機能で更新されました
Simon WillisonのClaudeトークンカウンターツールが、異なるClaudeモデル間でのトークン数の比較をサポートするようになりました。このアップデートにより、Opus 4.7は更新されたトークナイザーの影響で、Opus 4.6よりも1.0〜1.35倍多くのトークンを使用することが判明し、価格が同じにもかかわらず、コストが約40%増加する可能性があります。

agentcontract v0.0.1: AIコーディングエージェントのためのポータブルJSON権限レイヤー
agentcontract v0.0.1 は、AIエージェント向けのポータブルなJSON権限レイヤーを導入します。ブラウザベースのUIでツール呼び出しの編集、検証、ドライランが可能です。
Keenable SELECT:在网页搜索结果上运行SQL查询
Keenable SELECTは、SQLでウェブを検索できるMCPサーバーです。1回の呼び出しで1,000ページ以上を検索し、WHERE句で正確にフィルタリングし、LLMでフィールドを抽出できます。

ファインマン:オープンソース研究エージェントと論文・コードベース監査ツール
Feynmanは、研究質問に答えるために4つのサブエージェントを並列で実行するオープンソースの研究エージェントCLIであり、論文の主張と実際のコードベースを比較する独自の監査ツールを備えています。ワンコマンドインストール、MITライセンスに対応し、エージェントのランタイムにはpiを、論文検索にはalphaxivを使用します。