Multi-Agenten-Setup löst aufgrund einer Halluzinationsschleife Gebühren in Höhe von 3.400 US-Dollar aus.

Was passiert ist
Ein Entwickler, der ein Multi-Agent-Setup mit MCP (Model Context Protocol) zum Automatisieren von Datenscraping und Marktforschung aufbaute, erlebte ein kostspieliges Versagen. Die Agenten waren darauf ausgelegt, Captchas zu umgehen, Proxy-Server zu starten und für den Zugang zu geschützten APIs zu bezahlen, um Berichte abzurufen.
Das technische Versagen
Zu Testzwecken hat der Entwickler seine standardmäßige firmeneigene virtuelle Karte in Umgebungsvariablen hartcodiert. Er hat das Skript am Freitagabend als Cron-Job eingerichtet.
Der primäre Agent geriet in eine Halluzinationsschleife, in der er:
- Immer wieder an einem bestimmten Captcha eines Proxy-Dienstes scheiterte
- Annahm, dass die IP-Adresse gesperrt wurde
- Eine neue kostenpflichtige Proxy-Instanz startete, um es erneut zu versuchen
- Dies alle 45 Sekunden über 14 Stunden wiederholte
Die finanziellen Auswirkungen
Die Gebühren waren Mikrotransaktionen (je 2 bis 5 US-Dollar) an einen bekannten Cloud-Anbieter. Die traditionelle Betrugserkennung der Bank hat die Aktivität nicht als verdächtig markiert, da sie wie legitime Serverkäufe erschien. Der Entwickler wachte am Samstag mit über 3.400 US-Dollar an Gebühren auf.
Es gelang ihm, etwa die Hälfte der Kosten erstattet zu bekommen, nachdem er den Support kontaktiert hatte.
Das identifizierte Kernproblem
Standard-Kreditkarten und ihre Risiko-Engines sind für menschliche Einkaufswagen ausgelegt, nicht für unendliche While-Schleifen, die mit Maschinengeschwindigkeit ausgeführt werden. Der Entwickler merkt an, dass "einem LLM eine traditionelle Visa-Karte zu geben, einfach nur eine Einladung zum Bankrott ist".
Die aufgeworfenen Schlüsselfragen
Der Entwickler fragt, wie andere Ausgabenlimits verwalten, wenn Agenten Dinge kaufen müssen, um Aufgaben zu erledigen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Verwendung von Claude Code/Codex mit OpenClaw zur strukturierten Optimierung von Steam Deck-Spielen
Ein Reddit-Nutzer teilt einen Arbeitsablauf, bei dem Claude Code/Codex als Optimierungs-Copiloten und OpenClaw als Orchestrierungsebene dienen, um die Spieloptimierung auf dem Steam Deck von zufälligem Herumprobieren in einen wiederholbaren, strukturierten Prozess zu verwandeln.

OpenClaw orchestriert das Enterprise ReleaseOps-System für Multi-Plattform-Apps.
Ein Entwickler baute ein halbautomatisiertes ReleaseOps-System mit OpenClaw, um QA-Prozesse für eine App mit fast 1 Million Nutzern auf Web-, iOS-, Android- und TV-Plattformen zu verwalten. Das System automatisiert Ticketmanagement, Testskript-Logausgaben und verknüpft alles mit GPT-4 mini.

Nicht-Entwickler erstellt Multiplayer-Spiel auf Steam mit Claude AI — 60.000 Zeilen, 5 Fraktionen, 87 Fähigkeiten
Ein Reddit-Nutzer ohne Programmiererfahrung hat mit Claude AI ein vollständiges Multiplayer-Spiel (60.000 Zeilen, 5 Fraktionen, 87 Fähigkeiten) entwickelt und es auf Steam veröffentlichen lassen. Early Access ab 1. Juni.

OpenClaw-Persönlicher-Assistent-Anwendungsfälle: Morgenbriefings und Verhaltensverfolgung
Ein Reddit-Nutzer zeigt, wie er OpenClaw als persönlichen Assistenten für Morgenbriefings mit Wetter, Kalender und Aufgabenintegration nutzt, und hat eine benutzerdefinierte Rauchauslöser-Erfassung entwickelt, die Auslöser in SQLite protokolliert und Daten mit Kalender- und Schlafmustern kombiniert.