良いAI支援開発はタスクレベルではなくシステムレベルで起こる

Redditユーザーのu/johns10davenportは、AI支援開発における真のレバレッジはプロンプトの改善ではなく、システムを変えることにあると主張しています。著者はよくあるフラストレーションを語ります:Phoenixアプリに新機能を追加するたびに、AIコーディングエージェントは機能を実装するものの、メニュー項目を追加し忘れるのです。ページは存在し、機能は動作するが、ユーザーがそこにたどり着く方法がないのです。
タスクレベルの修正の問題点
最初の直感は「ボタンを追加して」とモデルに指示することです。それは効果がありますが、人間がまだ思考しています——問題を診断し、修正を指示しているのです。著者はこれを「Anthropicにフリートークンをもらうためにペロトンを漕いでいる」と呼びます。プロンプトエンジニアリングは、モデルに何をすべきかを伝える能力を高めるだけで、依然として人間がモデルのために働いているのです。
システムレベルのシフト
欠落したボタンを修正する代わりに、著者は「将来このミスを不可能にするにはどうすればよいか?」と考えました。彼らの解決策は、BDDスペックとPhoenix LiveViewテストヘルパーを利用したものです。テストフレームワークのnavigate関数を使うと、エージェントは任意のページに直接ジャンプでき、UIを経由せずにテストに合格します。そこで、エージェントがnavigateを呼び出すのを禁止するリンタールールを作成しました。これにより、テストを既知の開始ルートに配置する許可されたフィクスチャのみが利用可能となり、エージェントが新機能に到達する唯一の方法はUIをクリックして進むことです——つまり、テストに合格するためにメニュー項目を追加せざるを得なくなります。
結果:同じ問題は二度と発生しません。なぜなら、より優れたプロンプトのためではなく、正しい動作が唯一可能な動作だからです。
重要なポイント
モデルの出力を修正するのはやめましょう。代わりに、正しい出力が最も抵抗力の少ない経路となるように環境を制約することです。すべてのミスは、次のミスを設計によって排除するチャンスです。
📖 元の記事を読む: r/ClaudeAI
👀 See Also

ブラウザエージェントがAPI予算を食い尽くす:観測ループの隠れたコスト
実際のウェブタスクでAIエージェントを実行していますか?Redditユーザーによると、ブラウザ観測ループがコストの主要因であり、モデルではありません。クリック、待機、観測のたびにラウンドトリップが発生し、スナップショットの品質が低いとトークン使用量が急増します。隔離されたブラウザ環境と高速なエージェント実行がコスト削減の鍵です。

构建基于Claude Code的流程层以处理上下文与协调
あるチームが、Claude Codeの上にエンジニアリングステップごとの入出力を宣言するプロセスレイヤーを構築し、ハンドオフ時のコンテキスト損失を減らし、個人の規律に頼らずに生産性の複利的な向上を実現した方法を共有しています。

AIエージェントワークフローで見落とされがちな3つのボトルネック:取り込み、コンテキスト管理、モデルルーティング
AIエージェントを最適化する際にしばしば見落とされる3つのレイヤー(クリーンな入力取り込み、ステップ間のコンテキストウィンドウ管理、タスクに適したモデルルーティング)を深掘りします。実用的な修正には、構造化パース、要約されたステップ出力、型付きスキーマ、タスク複雑度に応じたモデル選択が含まれます。

OpenClaw コスト最適化:月額200ドルから1ドルへ
適切な設定により、基本的な使用ケースではAPIコストを数百ドルから月額1ドル未満に削減できます。その方法をご紹介します。