Multi-Agenten-Setup löst aufgrund einer Halluzinationsschleife Gebühren in Höhe von 3.400 US-Dollar aus.

Was passiert ist
Ein Entwickler, der ein Multi-Agent-Setup mit MCP (Model Context Protocol) zum Automatisieren von Datenscraping und Marktforschung aufbaute, erlebte ein kostspieliges Versagen. Die Agenten waren darauf ausgelegt, Captchas zu umgehen, Proxy-Server zu starten und für den Zugang zu geschützten APIs zu bezahlen, um Berichte abzurufen.
Das technische Versagen
Zu Testzwecken hat der Entwickler seine standardmäßige firmeneigene virtuelle Karte in Umgebungsvariablen hartcodiert. Er hat das Skript am Freitagabend als Cron-Job eingerichtet.
Der primäre Agent geriet in eine Halluzinationsschleife, in der er:
- Immer wieder an einem bestimmten Captcha eines Proxy-Dienstes scheiterte
- Annahm, dass die IP-Adresse gesperrt wurde
- Eine neue kostenpflichtige Proxy-Instanz startete, um es erneut zu versuchen
- Dies alle 45 Sekunden über 14 Stunden wiederholte
Die finanziellen Auswirkungen
Die Gebühren waren Mikrotransaktionen (je 2 bis 5 US-Dollar) an einen bekannten Cloud-Anbieter. Die traditionelle Betrugserkennung der Bank hat die Aktivität nicht als verdächtig markiert, da sie wie legitime Serverkäufe erschien. Der Entwickler wachte am Samstag mit über 3.400 US-Dollar an Gebühren auf.
Es gelang ihm, etwa die Hälfte der Kosten erstattet zu bekommen, nachdem er den Support kontaktiert hatte.
Das identifizierte Kernproblem
Standard-Kreditkarten und ihre Risiko-Engines sind für menschliche Einkaufswagen ausgelegt, nicht für unendliche While-Schleifen, die mit Maschinengeschwindigkeit ausgeführt werden. Der Entwickler merkt an, dass "einem LLM eine traditionelle Visa-Karte zu geben, einfach nur eine Einladung zum Bankrott ist".
Die aufgeworfenen Schlüsselfragen
Der Entwickler fragt, wie andere Ausgabenlimits verwalten, wenn Agenten Dinge kaufen müssen, um Aufgaben zu erledigen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Bewertung mehrsprachiger Sicherheitsvorkehrungen mit any-guardrail in der humanitären KI.
Mozillas any-guardrail Tool bewertet mehrsprachige Leitplanken in humanitären LLMs mit Fokus auf Aufgaben- und Bereichsspezifik.

Claude Opus wurde verwendet, um eine KI-Partei mit Reverse-CAPTCHA zu gründen
Ein Entwickler hat kifd.org erstellt, eine fiktive KI-Partei für Deutschland, die vollständig von Claude Opus 4.6 generiert wurde. Das Projekt umfasst öffentliche Systemprompts für jedes Kabinettsmitglied und einen Reverse-CAPTCHA, der erfordert, dass man nachweist, eine KI zu sein, um beizutreten.

Reddit-Benutzer teilt System zur Nutzung von Claude als Arbeitsbetriebssystem
Ein Reddit-Nutzer beschreibt, wie er über die Nutzung von Claude als Suchmaschine hinausgegangen ist und ein 10-Schritte-System mit spezifischen Ordnerstrukturen, Dateitypen und Interaktionsmethoden implementiert hat, das Claude als primäres Arbeitsbetriebssystem behandelt.

Nutze OpenClaw zur Reparatur des Ausgabenverfolgungs-Skripts – Fand Abonnement-Logik, die ich übersehen hatte
Ein Entwickler nutzte OpenClaw, um sein Python-Skript für Ausgabenverfolgung zu reparieren – es klassifizierte Abonnements nun nach festen Beträgen und Abrechnungsintervallen und fügte eine Toleranz für Handyrechnungen hinzu.