AIコーディングエージェントは大規模コードベースでのコンテキスト管理に苦戦

実行のボトルネックは問題ではない
実際のコードベース使用状況の観察から、AIコーディングエージェントは実行よりも発見に多くの時間を費やしていることが一貫して示されています。エージェントが新しいタスクに取り組むたびに、方向付け活動のために15〜20回のツール呼び出しを行います。これには以下が含まれます:
- ルートのgrep検索
- ミドルウェアの読み込み
- 型の確認
エージェントがコードを書き始める頃には、発見作業ですでにコンテキストウィンドウの大部分を消費しています。
簡略化されたアプローチからの証拠
Vercelは、エージェントから80%のツールを削除し、代わりにbashアクセスを与えることで、逆方向からこの問題を実証しました。このアプローチにより100%の精度が達成され、実行能力が制限要因ではないことが示唆されています。
同様に、Pi(最小限のコーディングエージェント)は、わずか4つのツールと1,000トークン未満のシステムプロンプトで同じ点を証明しています。
真の課題:コンテキスト管理
実行が事実上解決されているなら、実際の難しい問題はコンテキスト管理になります。この課題にはいくつかの要因が寄与しています:
- 大規模なコードベースは現在のどのコンテキストウィンドウにも収まらない
- 長いタスクはツール出力を蓄積し、初期の推論を注意ウィンドウから押し出す
- 動的環境はセッション間で変化する
- 「Lost in the Middle」の研究は、モデルがコンテキストウィンドウの開始時(まさにエージェントがまだ検索している時)に最もよく推論することを示している
著者は、これらの問題とAIコーディングエージェント開発への影響を探るより詳細な分析を公開しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

OpenClaw v2026.3.12 ダッシュボードの再設計により、インターフェース要素が統合されました。
OpenClaw v2026.3.12では、チャット、設定、エージェント、セッションのモジュールビュー、コマンドパレット、モバイル用下部タブ、スラッシュコマンド、検索、エクスポート、ピン留めメッセージを単一のインターフェースに統合したダッシュボードの完全な再設計が行われています。

原始人対「簡潔に」プロンプト:Claude向け圧縮プロンプトのベンチマーク
5つのアームにわたる24プロンプトのベンチマークによれば、2語のプロンプト「簡潔に。」は、トークン数と出力品質の両方でキャブマン圧縮に匹敵するものの、キャブマンは構造的一貫性と安全エスケープ機能を提供します。

Claude Code 2.1.63では、バンドルされたスラッシュコマンド、HTTPフック、メモリリークの修正が追加されました。
Anthropicは、新しい/simplifyおよび/batchスラッシュコマンド、JSONをURLにPOSTするHTTPフック、長時間実行セッションにおける複数のメモリリーク修正を含む26のCLI変更を伴うClaude Code 2.1.63をリリースしました。

OpenRouterは、Hunter/Healer AlphaモデルがMiMo V2のバリアントであることを確認しました。
OpenRouterの以前はステルスだったHunter AlphaとHealer Alphaモデルは、MiMo V2のバリアントであることが確認されました。Hunter Alphaは1Mコンテキストウィンドウを持つMiMo V2 Proテキスト専用推論モデルであり、Healer Alphaは262Kコンテキストウィンドウを持つMiMo V2 Omniテキスト+画像推論モデルです。