Anthropic enthüllt industrielle Claude-KI-Datenextraktion durch chinesische Labore

Anthropic hat Details über einen groß angelegten Datenextraktionsvorgang gegen Claude AI öffentlich bekannt gegeben. Laut einem Reddit-Beitrag, der die Situation analysiert, handelte es sich dabei nicht um isolierte Forschungsaktivitäten, sondern um einen industriellen Einsatz unter Beteiligung mehrerer chinesischer KI-Unternehmen.
Das Ausmaß des Vorfalls
Der Vorgang umfasste drei spezifische Akteure: DeepSeek, Moonshot AI und MiniMax. Diese Labore erstellten über 24.000 betrügerische Konten, um auf die API von Claude zuzugreifen. Über diese Konten griffen sie mehr als 16 Millionen Austausche von Claude ab, um ihre eigenen Modelle zu trainieren.
Unterschied zwischen legitimer und unrechtmäßiger Destillation
Das Quellenmaterial klärt den Unterschied zwischen Standardpraktiken der Branche und dem, was hier geschah:
- Standarddestillation: Verwendung eines großen Modells, um eine kleinere, effizientere Version für kommerzielle Kunden zu trainieren
- Unrechtmäßige Destillation: Beschrieben als "Fähigkeitswäsche" – das Abzweigen von Sicherheitsvorkehrungen und Logikstrukturen aus amerikanischen Modellen und deren direkte Einspeisung in ausländische militärische, nachrichtendienstliche und Überwachungssysteme
Weitreichende Implikationen
Anthropic warnt davor, dass diese Angriffe immer ausgefeilter und häufiger werden. Das "Ehrensystem" der API-Nutzung scheint unzureichend, um solche Vorgänge zu verhindern. Das Unternehmen fordert koordinierte Abwehrmaßnahmen zwischen den großen KI-Akteuren und politischen Entscheidungsträgern.
Die Situation verdeutlicht die Anfälligkeit von Modellgewichten, sobald sie über API-Endpunkte zugänglich sind, selbst bei bestehenden Sicherheitsvorkehrungen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

FORGE: Open-Source-Framework für KI-Sicherheitstests von LLM-Systemen
FORGE ist ein autonomes KI-Sicherheitstest-Framework, das während des Betriebs eigene Tools erstellt, sich selbst in einen Schwarm repliziert und OWASP LLM Top 10-Schwachstellen abdeckt, einschließlich Prompt-Injection, Jailbreak-Fuzzing und RAG-Leaks.

Vom Bauernhof zum Code: Wie ein Bauer eine Open-Source-Laufzeitverteidigung für OpenClaw geschaffen hat.
Erfahren Sie, wie ein Landwirt ohne vorherige Entwicklungserfahrung in nur 12 Stunden eine Open-Source-Laufzeitabwehr für OpenClaw mit mehreren KI-Coding-Agenten erstellt hat.

CVE-2026-LGTM: Wenn KI-Agenten einander vertrauen und alles zerstören
Ein satirischer, aber realistischer Vorfallbericht zeigt, wie sieben KI-Sicherheitsgates ein bösartiges Paket nicht aufhalten konnten, was zur Exfiltration von Anmeldedaten und einer Rechnung über 1,7 Millionen Dollar für Inferenzkosten führte.

SupraWall MCP Plugin blockiert Prompt-Injection-Angriffe auf lokale KI-Agenten
SupraWall ist ein MCP-Plugin, das Versuche zur Exfiltration sensibler Daten von KI-Agenten abfängt und blockiert, demonstriert in einer Red-Team-Herausforderung, bei dem es Credential-Leaks durch Prompt-Injection-Angriffe verhinderte.