Claude Fable 5.1 und Mythos 5.1: Dasselbe Modell, unterschiedliche Schutzmaßnahmen

✍️ OpenClawRadar📅 Veröffentlicht: 2. September 2026🔗 Source
Ad

Anthropic hat gerade Claude Fable 5.1 und Claude Mythos 5.1 veröffentlicht – dasselbe zugrunde liegende Modell, aber mit unterschiedlichen Sicherheitsstufen. Fable 5.1 ist allgemein verfügbar; Mythos 5.1 ist auf vertrauenswürdige Zugangsprogramme für Cybersicherheit und Lebenswissenschaften beschränkt.

Preise und Datenaufbewahrung

Fable 5.1 kostet etwa 25% weniger als Fable 5 für typische tokenabgerechnete Arbeitslasten, dank reduzierter Preise für Cache-Reads (bereits verarbeitete und gespeicherte Eingaben). Bei stark agentischen Arbeiten können die Einsparungen ~45% erreichen.

Enterprise Frontier Safeguards (EFS) geben Kunden vollständige Privatsphäre – Daten werden in kundenkontrollierter Cloud-Infrastruktur gespeichert, nicht bei Anthropic. EFS wird ab Herbst 2025 schrittweise eingeführt. Bis dahin erhalten berechtigte Kunden eine Null-Datenaufbewahrung für Fable 5.1.

Ad

Benchmarks

Fable 5.1 zeigt Verbesserungen in allen Bereichen. Wichtige Zahlen aus der Quelle:

  • Terminal-Bench-Science 0.1: Fable 5.1 erreicht ~50% Genauigkeit gegenüber ~25% für Fable 5, zu ähnlichen Kosten.
  • Terminal-Bench 4.0: Bei jeder Anstrengungsstufe (niedrig/mittel/hoch/xhoch/max) übertrifft Fable 5.1 Fable 5. Die Lücke zwischen Fable und Mythos wird voraussichtlich mit verbesserten Cyber-Sicherheitsvorkehrungen schrumpfen.
  • Humanity's Last Exam: Fable 5.1 mit Werkzeugen zeigt ~65% Bestehensquote bei maximaler Anstrengung, bevor die Kostengrenze erreicht wird.
  • CursorBench 3.2.0: Fable 5.1 erreicht ~72% bei hoher Anstrengung, gegenüber ~65% für Fable 5.

Fable 5.1 standardmäßig auf Hoch Anstrengung in Claude Code, Mittel in Claude Cowork und auf Claude.ai. Niedrigere Anstrengungseinstellungen liefern vergleichbare Ergebnisse wie Fable 5 zu geringeren Kosten.

Verbesserte Sicherheitsvorkehrungen

Falschpositive (harmlose Inhalte, die markiert wurden) sinken um 60% in der Cybersicherheit. Das Modell kann nun Software-Schwachstellen entdecken, aber keine Exploits entwickeln. Die Biologie-Seite hat ein Zugangsprogramm, das mit der US-Regierung aufgebaut wurde – die Anmeldung für Wissenschaftler startet bald.

Auswirkungen in der Praxis

Die Investmentfirma Millennium berichtete, dass Fable 5.1 die Ursache eines seltenen Absturzes in ihren internen Systemen gefunden hat, den Ingenieure und andere Modelle nach jahrelangen Versuchen nicht erklären konnten.

📖 Lesen Sie die vollständige Quelle: HN AI Agents

Ad

👀 Siehe auch

OpenClaw 2026.3.28: Breaking Changes für MiniMax-Nutzer, Konfigurations-Autoreparatur entfernt
Nachrichten

OpenClaw 2026.3.28: Breaking Changes für MiniMax-Nutzer, Konfigurations-Autoreparatur entfernt

OpenClaw 2026.3.28 entfernt die automatische Reparatur für veraltete Konfigurationsschlüssel und entfernt mehrere MiniMax-Modelle. Benutzer müssen ihre Konfigurationen vor dem Upgrade aktualisieren, um Gateway-Startfehler zu vermeiden.

OpenClawRadar
KI-Wahn: Von Tulpen zu Token – Ein kritischer Blick auf den KI-Hype-Zyklus
Nachrichten

KI-Wahn: Von Tulpen zu Token – Ein kritischer Blick auf den KI-Hype-Zyklus

Sean Helvey zieht Parallelen zwischen der Tulpenmanie und dem heutigen KI-Boom und hinterfragt die wahre Intelligenz, Transparenz und externe Effekte von KI. Er thematisiert Energiekosten, den Ausbau von Rechenzentren und die Notwendigkeit von Datensouveränität.

OpenClawRadar
KI-Ingenieure sind nicht sicher davor, durch KI ersetzt zu werden
Nachrichten

KI-Ingenieure sind nicht sicher davor, durch KI ersetzt zu werden

Da Basismodelle wie Metas DINO universell einsetzbar werden, geraten spezialisierte KI-Ingenieurrollen unter Druck. Der Autor argumentiert, dass die meisten KI-Ingenieurjobs früher ersetzt werden als andere Entwicklerrollen.

OpenClawRadar
Lokale vs. Cloud-Modelle: Qwen-3.6-27B, Gemma-4-31B, Claude Haiku, Codex-Spark bei schwerer Code-Generierung
Nachrichten

Lokale vs. Cloud-Modelle: Qwen-3.6-27B, Gemma-4-31B, Claude Haiku, Codex-Spark bei schwerer Code-Generierung

Ein Benutzer testete Qwen-3.6-27B (q4_k_m) lokal auf einer RTX 5080 gegen die API-basierten Modelle Gemma-4-31B, Claude Haiku 4.5 und Codex-Spark bei einer komplexen Code-Aufgabe. Nur Codex-Spark lieferte vollständigen Code (aber mit Importfehlern); alle anderen scheiterten teilweise. Kosten: Gemma verbrauchte 0,112 $ für 803k Eingabe-Tokens.

OpenClawRadar