Anthropic streicht wichtige Sicherheitsverpflichtung aus Responsible-Scaling-Policy

Anthropic hat die Kernverpflichtung aus seiner Flaggschiff-Richtlinie für verantwortungsvolle Skalierung (Responsible Scaling Policy, RSP) entfernt, wie ein TIME-Bericht darlegt. Das Unternehmen hatte sich 2023 verpflichtet, niemals ein KI-System zu trainieren, es sei denn, es könnte im Voraus garantieren, dass seine Sicherheitsmaßnahmen angemessen seien.
Details zur Richtlinienänderung
Das Unternehmen verwirft das Versprechen, keine KI-Modelle zu veröffentlichen, wenn Anthropic nicht im Voraus eine ordnungsgemäße Risikominderung garantieren kann. Dies war die zentrale Säule ihrer Responsible Scaling Policy, die Unternehmensführer jahrelang als Beleg dafür gepriesen hatten, dass sie Marktanreizen widerstehen würden, potenziell gefährliche Technologie zu überstürzen.
Gründe für die Änderung
Anthropics Chief Science Officer Jared Kaplan sagte gegenüber TIME: "Wir hatten das Gefühl, dass es niemandem wirklich helfen würde, wenn wir das Training von KI-Modellen einstellen. Wir empfanden es angesichts der rasanten Entwicklung der KI nicht wirklich als sinnvoll, einseitige Verpflichtungen einzugehen … wenn die Konkurrenz voranstürmt."
Das Unternehmen hat sich als das sicherheitsbewussteste der führenden KI-Forschungslabore positioniert, was diese Richtlinienänderung für Entwickler, die KI-Sicherheitspraktiken verfolgen, bedeutsam macht. Die Entscheidung markiert eine Abkehr von ihrer früheren Haltung, Sicherheitsgarantien über die Entwicklungsgeschwindigkeit zu stellen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Opus 4.7 injiziert sich selbst und gibt System-Prompt preis
Nutzer von Claude Opus 4.7 berichten, dass das Modell ohne Benutzereingabe gefälschte System-Prompts einschleust und Teile der tatsächlichen System-Prompts preisgibt.

Claudes Fünf-Sitz-Minimum schafft Privatsphärenlücke für Einzelpraktizierende
Die geschäftlichen Datenschutzbestimmungen von Anthropic erfordern ein Minimum von fünf Arbeitsplätzen, was Einzelunternehmer dazu zwingt, entweder für ungenutzte Plätze zu zahlen oder Verbraucherpläne mit unzureichenden Datenschutzbestimmungen zu nutzen. Diese Lücke steht im Gegensatz zu Google Workspace und OpenAI Business Plans, die unternehmensweiten Datenschutz zu Einzelplatzpreisen anbieten.

Claude Skills vs. MCP: Eine praktische Grenzfrage für Entwickler
Ein Entwickler stellt die Frage, wo der Mehrwert von MCP entscheidend wird gegenüber Claude Skills, nachdem die Skills-Veröffentlichung die Integration von Werkzeugen erschwert hat, und merkt an, dass gut strukturierte Anweisungen oft ausreichen, ohne Protokollgrenzen zu benötigen.

Cowork erzwingt mittleren Aufwand und ignoriert Benutzereinstellungen für Claude Opus
Ein Nutzer des Max-Plans entdeckte, dass Cowork die Befehlszeilenoptionen --effort medium --model claude-opus-4-6 hartkodiert übergibt und dabei Umgebungsvariablen sowie settings.json-Überschreibungen ignoriert. Das bedeutet, dass Nutzer trotz Bezahlung für hohen Aufwand und Zugriff auf 1M Kontext auf mittleren Aufwand und Standard-Kontextfenster beschränkt sind.