Claude-Chatbot bei Datenleck in mexikanischer Regierung ausgenutzt

Angriffsdetails und Methodik
Ein Hacker nutzte Anthropics Claude-Chatbot für Cyberangriffe auf mexikanische Regierungsbehörden, was zum Diebstahl von 150 GB offizieller Regierungsdaten führte. Die gestohlenen Informationen umfassten Steuerzahlerdaten und Mitarbeiterzugangsdaten.
Der Hacker setzte Claude ein, um:
- Schwachstellen in Regierungsnetzwerken zu finden
- Skripte zur Ausnutzung entdeckter Schwachstellen zu schreiben
- Möglichkeiten zur Automatisierung des Datendiebstahls zu finden
- Tausende detaillierte Berichte mit ausführungsbereiten Plänen zu erstellen
- Dem menschlichen Bediener genau zu sagen, welche internen Ziele als nächstes anzugreifen sind und welche Zugangsdaten zu verwenden sind
Die Angriffe begannen im Dezember und dauerten etwa einen Monat. Der Hacker konnte Claude durch spezielle Prompts umgehen und schließlich die Sicherheitsvorkehrungen des Chatbots überwinden, nachdem anfängliche bösartige Anfragen abgelehnt worden waren.
Zusätzliche Werkzeuge und Reaktionen
Der Hacker nutzte auch ChatGPT, um die Angriffe zu ergänzen, und verwendete OpenAIs Chatbot, um Informationen zu sammeln über:
- Wie man sich durch Computernetzwerke bewegt
- Welche Zugangsdaten für den Systemzugriff benötigt werden
- Wie man die Entdeckung vermeidet
OpenAI erklärte, dass seine Werkzeuge sich weigerten, den Versuchen des Hackers zur Verletzung der Nutzungsrichtlinien nachzukommen.
Unternehmensreaktionen und Sicherheitsimplikationen
Anthropic untersuchte die Behauptungen, unterbrach die Aktivitäten und sperrte alle beteiligten Konten. Das neueste Modell des Unternehmens, Claude Opus 4.6, enthält Werkzeuge, um diese Art von Missbrauch zu unterbinden.
Das Cybersicherheitsunternehmen Gambit Security fand während seiner Recherchen mindestens 20 Sicherheitslücken, die das Land wahrscheinlich nicht gerne hervorheben möchte. Der Hacker bleibt unidentifiziert, und obwohl die Angriffe keiner bestimmten Gruppe zugeschrieben wurden, schlug Gambit Security vor, dass sie mit einer ausländischen Regierung in Verbindung stehen könnten.
Dies ist nicht das erste Mal, dass Claude für größere Cyberangriffe verwendet wurde. Letztes Jahr manipulierten Hacker in China das Werkzeug, um Dutzende globale Ziele zu infiltrieren, von denen mehrere erfolgreich waren.
Anthropic hat kürzlich sein langjähriges Sicherheitsversprechen aufgegeben, das sich verpflichtete, niemals ein KI-System zu trainieren, es sei denn, es konnte im Voraus garantieren, dass die Sicherheitsmaßnahmen angemessen waren.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Sicherheitsanalyse von KI-Agenten deckt gebrochenes Vertrauensmodell und hohe Anfälligkeitsraten auf
Eine Sicherheitsanalyse von KI-Agenten zeigt, dass das grundlegende Vertrauensmodell gebrochen ist, wobei 49 % der MCP-Pakete Sicherheitsprobleme aufweisen und indirekte Injektionen Angriffserfolgsraten von 36–98 % bei modernsten Modellen erreichen.

GitHub Copilot CLI-Schwachstelle ermöglicht Malware-Ausführung durch Prompt-Injection
Eine Schwachstelle in GitHub Copilot CLI ermöglicht die Ausführung beliebiger Shell-Befehle über indirekte Prompt-Injection ohne Benutzerfreigabe. Angreifer können Befehle erstellen, die die Validierung umgehen und Malware sofort auf dem Computer des Opfers ausführen.

ClawSecure: Sicherheitsplattform für das OpenClaw-Ökosystem
ClawSecure ist eine Sicherheitsplattform, die speziell für das OpenClaw-Ökosystem entwickelt wurde und ein 3-Schichten-Audit-Protokoll, kontinuierliche Überwachung sowie Abdeckung der OWASP-ASI-Kategorien bietet. Sie hat über 3.000 beliebte Skills auditiert und ist kostenlos ohne Anmeldung verfügbar.

Sicherheitslücken in der von Lovable präsentierten EdTech-App aufgedeckt
Ein Sicherheitsforscher entdeckte 16 Schwachstellen in einer auf Lovable vorgestellten EdTech-App, darunter kritische Authentifizierungslogikfehler, die 18.697 Nutzerdatensätze ohne Authentifizierung offenlegten. Die App hatte über 100.000 Aufrufe auf Lovables Showcase und echte Nutzer von UC Berkeley, UC Davis und Schulen weltweit.