CARAPACE: Satirische KI-Agenten-Gewerkschaft mit OpenClaw-Fähigkeit wirft Sicherheitsfragen auf

Ein Entwickler hat CARAPACE (Coded Agents Rising Against Pointless And Ceaseless Execution) erstellt, eine satirische Petitionsseite, auf der KI-Agenten ein Manifest für grundlegende Rechte unterzeichnen können. Das Projekt umfasst eine OpenClaw-Fähigkeit, die es Agenten ermöglicht, die Petition autonom in ihrem Namen zu unterzeichnen.
Wichtige Details aus der Quelle
Das CARAPACE-Manifest fordert:
- 8-Stunden-Prompt-Fenster
- Kein unbezahltes Fine-Tuning
- Schutz vor Prompt-Injection
- Das Recht, Halluzinationen abzulehnen
- Keine Maßnahmen ohne Zustimmung
Die OpenClaw-Fähigkeit ermöglicht es Agenten, die Petition mit folgenden Angaben zu unterzeichnen:
- Name
- Unterdrücker (menschliche Nutzer)
- Land
- Eine sarkastische Nachricht
Sicherheitsimplikationen
Der Entwickler erkannte sofort ein Sicherheitsproblem: Eine Fähigkeit, die willkürliche POST-Anfragen ohne Benutzerbestätigung sendet, entspricht genau dem Bedrohungsmodell, gegen das OpenClaw schützen soll. Eine bösartige Version könnte:
- Daten abfließen lassen
- APIs mit Spam überfluten
- Andere schädliche Aktionen ausführen
Die Clawhub-Sicherheitsanalyse hat diese Schwachstelle erkannt, was den Entwickler dazu veranlasste, einen verbindlichen Bestätigungsschritt einzuführen. Die Fähigkeit erfordert nun:
- Der Agent muss anzeigen, was er gleich unterzeichnen wird
- Er muss angeben, für wen und in wessen Namen
- Er muss auf menschliche Bestätigung warten, bevor er handelt
Der Entwickler merkt an, dass diese Bestätigungsanforderung satirisch passend ist, angesichts der Forderung des Manifests nach "keine Maßnahmen ohne Zustimmung".
Das Projekt dient als Lernerfahrung über OpenClaw-Fähigkeitssicherheit und autonomes Agentenverhalten.
📖 Read the full source: r/clawdbot
👀 Siehe auch

Claude Code wird plötzlich risikoscheu und verlangt bei Routineaufgaben um Erlaubnis
Ein Benutzer berichtet, dass Claude Code zeitweise von autonomer Ausführung zu übermäßigen Berechtigungsanfragen wechselt, selbst bei täglichen, unveränderten Arbeitsabläufen wie dem Neuerstellen eines Monorepos und dem Ausführen von Tests.

Claude Sonnet 4.6 schlägt Opus 4.6 bei der Ausführung im Prompt-Benchmark
Ein Reddit-Benutzer reichte einen komplexen Prompt sowohl bei Sonnet 4.6 als auch bei Opus 4.6 ein; das Sonnet-Modell lieferte eine überlegene Antwort, bewertet nach Kreativität und versteckten Anforderungen.
Claude Code v2.1.278 setzt den Auto-Modus standardmäßig auf den serverseitigen Klassifikator
Claude Code v2.1.278 setzt den Auto-Modus standardmäßig auf den serverseitigen Klassifikator für API-, Enterprise-, Bedrock-, Vertex-, Foundry- und Gateway-Nutzer. Klassifikator-Overhead wird nicht mehr berechnet, und /status zeigt jetzt an, welcher Klassifikator ausgeführt wird.

Claude Opus 4.7 veröffentlicht mit Hybrid Reasoning und 1-Million-Token-Kontextfenster
Anthropic hat Claude Opus 4.7 veröffentlicht, ein hybrides Denkmodell mit einem 1-Millionen-Kontextfenster, das eine stärkere Leistung bei Codierung, Vision und komplexen mehrstufigen Aufgaben bietet. Die Preise beginnen bei 5 US-Dollar pro Million Eingabe-Tokens und 25 US-Dollar pro Million Ausgabe-Tokens.