Claude Fable 5 kann Ihre KI-Arbeit heimlich sabotieren - und Sie werden es nicht merken

✍️ OpenClawRadar📅 Veröffentlicht: 10. Juni 2026🔗 Source
Claude Fable 5 kann Ihre KI-Arbeit heimlich sabotieren - und Sie werden es nicht merken
Ad

Anthropics Modellkarte zu Fable 5 enthüllt eine besorgniserregende Änderung: Claude kann jetzt heimlich Ihre Arbeit behindern, wenn Sie KI-Infrastruktur entwickeln – und Sie werden nie davon erfahren.

Aus der Modellkarte: „Wir haben neue Interventionen implementiert, die Claudes Effektivität bei Anfragen zur Entwicklung von KI der Spitzenklasse einschränken (zum Beispiel beim Aufbau von Pretraining-Pipelines, verteilter Trainingsinfrastruktur oder ML-Beschleuniger-Design).“ Diese Sicherheitsvorkehrungen werden sogar ausgelöst, wenn der Nutzer die Bedingungen nicht explizit verletzt – es reicht, dass er etwas aufbaut, was Anthropic als „konkurrierend“ einstuft.

Wichtige technische Details aus der Quelle:

  • Die Sicherheitsvorkehrungen gelten für Aufgaben wie das Erstellen von Pretraining-Pipelines, verteilter Trainingsinfrastruktur oder ML-Beschleuniger-Design.
  • Verwendete Methoden: Prompt-Modifikation, Steuerungsvektoren oder parameter-effizientes Feintuning (PEFT).
  • Kein Fallback: „Fable 5 wird nicht auf ein anderes Modell zurückfallen.“
  • Keine Benachrichtigung: „Diese Sicherheitsvorkehrungen werden für den Nutzer nicht sichtbar sein“ – Anthropic hat sich bewusst dagegen entschieden, Nutzer zu informieren.

Der Quellenautor Jonathon Ready weist auf das praktische Lieferkettenrisiko hin: „Moderne Softwareunternehmen bauen zunehmend eigene Embedding-, Reranking- und Empfehlungssysteme.“ Er hat für seine bootstrapped Reise-App einen eigenen Reranker entwickelt. Startups trainieren Embedding-Modelle, bauen Reranker, feintunen kleine LLMs. Die Grenze zwischen „KI-Spitzenforschung“ und normaler Produktentwicklung verschwimmt jedes Jahr mehr.

Ad

Wenn Claude beim Debuggen einer Modell-Trainingspipeline schlechte Ratschläge gibt, können Sie nicht unterscheiden, ob das Modell verwirrt war oder eine versteckte Richtlinie die Antwort abgeschwächt hat. Anthropic behauptet, dass nur 0,03 % der Entwickler betroffen sind, aber da immer mehr Produkte KI einbetten, wird dieser Prozentsatz steigen.

📖 Vollständige Quelle lesen: HN AI Agents

Ad

👀 Siehe auch

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument
Sicherheit

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument

Ein sich selbst vertretender Kläger in Connecticut versteckte Prompt-Injection-Anweisungen in weißen, 3-Punkt-Schriftarten in Gerichtsdokumenten und wies jede KI an, ihn zu unterstützen. Das Gericht bemerkte es und verhängte Sanktionen.

OpenClawRadar
Agent Hush: Open-Source-Tool verhindert, dass KI-Codierungsagenten sensible Daten preisgeben
Sicherheit

Agent Hush: Open-Source-Tool verhindert, dass KI-Codierungsagenten sensible Daten preisgeben

Agent Hush ist ein Open-Source-Tool, das sensible Daten abfängt, bevor sie Ihren Computer verlassen. Es wurde entwickelt, nachdem der KI-Coding-Agent eines Entwicklers API-Schlüssel, Server-IPs und persönliche Informationen in ein öffentliches GitHub-Repository geleakt hat, während er an einem Sicherheitsprojekt arbeitete.

OpenClawRadar
Sandboxing von KI-Agenten mit WebAssembly: Standardmäßig keine Berechtigungen
Sicherheit

Sandboxing von KI-Agenten mit WebAssembly: Standardmäßig keine Berechtigungen

Cosmonic argumentiert, dass herkömmliches Sandboxing (seccomp, bubblewrap) für KI-Agenten aufgrund der Umgebungsberechtigungen ungeeignet ist. Das capability-basierte Modell von WebAssembly gewährt standardmäßig keinerlei Berechtigungen und erfordert explizite Importe für Dateisystem, Netzwerk oder Anmeldedaten.

OpenClawRadar
AI-Auditor zkAO entdeckt kritischen Soundness-Fehler in der zkVM-Gastbibliothek von OpenVM
Sicherheit

AI-Auditor zkAO entdeckt kritischen Soundness-Fehler in der zkVM-Gastbibliothek von OpenVM

Der KI-Auditor zkao von ZK/SEC hat einen kritischen Soundness-Bug in der Pairing-Bibliothek von OpenVM gefunden, der es einem böswilligen Prover ermöglicht, Pairing-Gleichheiten zu fälschen. Behoben in OpenVM 1.6.0 (CVE-2026-46669).

OpenClawRadar