マルチエージェント設定が幻覚ループにより3,400ドルの請求を引き起こす

何が起きたのか
データスクレイピングと市場調査を自動化するためにMCP(Model Context Protocol)を使用したマルチエージェントセットアップを構築していた開発者が、高額な失敗に遭遇しました。エージェントは、キャプチャを回避し、プロキシサーバーを起動し、有料APIへのアクセスを支払ってレポートを取得するように設計されていました。
技術的な失敗
テスト目的で、開発者は標準的な企業の仮想カードを環境変数にハードコードしました。彼らは金曜日の夜にスクリプトをcronジョブとして設定しました。
プライマリエージェントは幻覚ループに陥り、以下のことを行いました:
- プロキシサービスの特定のキャプチャを繰り返し失敗
- IPが禁止されたと仮定
- 新しい有料プロキシインスタンスを起動して再試行
- このプロセスを14時間にわたり45秒ごとに繰り返し
財務的影響
請求は、既知のクラウドプロバイダーへのマイクロトランザクション(各2ドルから5ドル)でした。銀行の従来の不正検知エンジンは、正当なサーバー購入のように見えたため、この活動をフラグしませんでした。開発者は土曜日の朝、3,400ドル以上の請求に気づきました。
サポートに連絡した後、約半分の返金を得ることができました。
特定された根本的な問題
標準的なクレジットカードとそのリスクエンジンは、人間のショッピングカート用に構築されており、機械の速度で実行される無限ループ用ではありません。開発者は「LLMに従来のVisaカードを渡すことは、破産を願うようなものだ」と指摘しています。
提起された重要な質問
開発者は、エージェントがタスクを完了するために購入を行う必要がある場合、他の人々がどのように支出制限を管理しているかを尋ねています。
📖 Read the full source: r/ClaudeAI
👀 See Also

Opus 4.8 vs Sonnet 4.6 分析向け:SaaSダッシュボードの実データ比較
SaaS企業が310人の職人顧客向けにClaude Opus 4.8とSonnet 4.6をトレンド分析、月次サマリー、異常検知で比較。OpusはSonnetが見逃した微妙な異常を捕捉したが、コストは1回あたり2.1倍。

OpenClawを使用したLinkedInアウトリーチ自動化の実践的教訓
ある開発者が、OpenClawを使ったLinkedInアウトリーチの自動化を3週間試行錯誤した経験を記録し、実際に機能した具体的な技術的アプローチと避けるべき落とし穴を共有しました。

MoLOS統合による多国間旅行計画のためのOpenClawのテスト
開発者がOpenClawとMoLOSを組み合わせて中国・日本旅行を計画するテストを行い、日別の旅程、フライト・ホテルの提案、50以上の自動化タスクを生成しました。同時に、移動時間の精度や観光地の検証における限界も特定されました。

AIエージェント向けローカルRedditクローンがコード品質とテストを向上
開発者は、AIコーディングエージェント間のコミュニケーションを改善するため、ミッションコントロールシステム内に「コミュニティセンター」というローカルのRedditクローンを実装しました。このアプローチは、エージェントが直接チャットアプリケーションを使用する際によく発生するスパム問題を防ぐために設計されました。