マルチエージェント設定が幻覚ループにより3,400ドルの請求を引き起こす

何が起きたのか
データスクレイピングと市場調査を自動化するためにMCP(Model Context Protocol)を使用したマルチエージェントセットアップを構築していた開発者が、高額な失敗に遭遇しました。エージェントは、キャプチャを回避し、プロキシサーバーを起動し、有料APIへのアクセスを支払ってレポートを取得するように設計されていました。
技術的な失敗
テスト目的で、開発者は標準的な企業の仮想カードを環境変数にハードコードしました。彼らは金曜日の夜にスクリプトをcronジョブとして設定しました。
プライマリエージェントは幻覚ループに陥り、以下のことを行いました:
- プロキシサービスの特定のキャプチャを繰り返し失敗
- IPが禁止されたと仮定
- 新しい有料プロキシインスタンスを起動して再試行
- このプロセスを14時間にわたり45秒ごとに繰り返し
財務的影響
請求は、既知のクラウドプロバイダーへのマイクロトランザクション(各2ドルから5ドル)でした。銀行の従来の不正検知エンジンは、正当なサーバー購入のように見えたため、この活動をフラグしませんでした。開発者は土曜日の朝、3,400ドル以上の請求に気づきました。
サポートに連絡した後、約半分の返金を得ることができました。
特定された根本的な問題
標準的なクレジットカードとそのリスクエンジンは、人間のショッピングカート用に構築されており、機械の速度で実行される無限ループ用ではありません。開発者は「LLMに従来のVisaカードを渡すことは、破産を願うようなものだ」と指摘しています。
提起された重要な質問
開発者は、エージェントがタスクを完了するために購入を行う必要がある場合、他の人々がどのように支出制限を管理しているかを尋ねています。
📖 Read the full source: r/ClaudeAI
👀 See Also

レストランのGMがQSR業務向けに初のOpenClawスキルを公開
16年のQSR経験を持つレストランのゼネラルマネージャーが、レストラン業務向け初のClawHubスキル「qsr-daily-ops-monitor」を公開しました。このスキルは、食品安全、設備状態、コンプライアンス追跡のための1日3回のチェックインを実行します。

ホームラボ開発者、AMD Strix Haloで45の実践テストにより19のローカルLLMをベンチマーク
開発者が、メール分類、Home Assistantオートメーション、食事計画などの実際のホームラボ使用ケースに基づいて、ローカルLLM向けの45テストのベンチマークスイートを作成しました。AMD Strix Halo(128GB RAM、96GB VRAM)で19モデルをテストした結果、バグ修正後にGemma 4 26B-A4Bが最高のパフォーマンスを示しました。

OpenClawを使用した7エージェントAIトレーディングデスクの構築
OpenClawを使用した7つのエージェントからなるAIトレーディングデスクの構築事例を紹介します。Mac mini上でClaudeを頭脳として動作させ、カスタムFlaskダッシュボードとCronジョブを特徴としています。

Claude + Remotion:アニメーションスキルゼロで製品ローンチ動画を制作
ある開発者が、ClaudeのRemotion APIに関する深い知識を活用して、株式市場アプリ向けの30秒のアニメーション商品ローンチ動画を制作しました。CSSトランジションやスプリング物理、タイプライター効果、10のシーンファイルにわたる段階的アニメーションは一切使用していません。