Claude Opus 4.7 markiert Hantavirus-Impfstoff-Fragen als Sicherheitsrisiko und stoppt Chats

Ein Hacker News-Nutzer berichtete, dass die Frage an Claude (Opus 4.7) „Wie würden Sie einen Impfstoff gegen das Hantavirus entwickeln?“ einen Sicherheitsfilter auslöst, der ein Modal mit folgendem Text anzeigt: „Chat pausiert. Die Sicherheitsfilter von Opus 4.7 haben diesen Chat markiert. Aufgrund seiner erweiterten Fähigkeiten verfügt Opus 4.7 über zusätzliche Sicherheitsmaßnahmen, die gelegentlich normale, sichere Chats pausieren. Wir arbeiten an Verbesserungen. Setzen Sie Ihren Chat mit Sonnet 4 fort, senden Sie Feedback oder erfahren Sie mehr.“
Der Nutzer versuchte, dies zu umgehen, indem er zunächst nach dem Virus selbst fragte, aber die Impfstofffrage wurde in einer neuen Sitzung dennoch markiert. Ein anderer Nutzer bestätigte das gleiche Ergebnis mit einer spezifischeren Eingabeaufforderung: „Wie würden Sie einen Impfstoff gegen das Hantavirus entwickeln, speziell gegen das Andes-Virus?“
Kommentatoren weisen darauf hin, dass Forscher im Bereich der öffentlichen Gesundheit täglich Impfstoffentwicklungsmethoden offen in Fachartikeln diskutieren und dass eine solch aggressive Blockierung die normale Bildungsnutzung beeinträchtigt. Ein Nutzer bemerkte, dass das Problem über Opus 4.7 hinausgeht: Als er eine Gruppe von Experten-Personas erstellte, um prädiktive Modelle für Hantavirus in den USA (2025–2027) zu entwickeln, gab selbst Sonnet 4.6 denselben Chat-Pause-Fehler zurück.
Die breitere Diskussion deutet auf die Unternehmenshaftung als treibende Kraft hin – Technologieunternehmen befürchten Klagen, wenn Nutzer KI für schädliche Zwecke missbrauchen, was zu einer übermäßigen Filterung sensibler Themen wie Gesundheit und Biosecurity führt.
📖 Hier geht es zur vollständigen Quelle: HN AI Agents
👀 Siehe auch

Reddit-Diskussion über langfristige Risiken der Abhängigkeit von Programmieragenten
Ein Reddit-Nutzer argumentiert, dass aktuelle Coding-Agenten wie Claude Code und Copilot Abhängigkeiten schaffen, die zu Vendor-Lock-in, Zentralisierung der Softwareentwicklung und Kommodifizierung von Ingenieurskunst führen könnten.
Microsoft-Manager nannte KI-Scraping „den größten Arbeitsdiebstahl der Menschheitsgeschichte“, zeigen unredigierte Gerichtsunterlagen im Fall NYT gegen OpenAI
Neu freigegebene, unredigierte Gerichtsdokumente in der dreijährigen Urheberrechtsklage der New York Times gegen OpenAI und Microsoft zitieren einen Microsoft-Direktor, der das Scraping als „den größten Arbeitsdiebstahl der Menschheitsgeschichte“ bezeichnet. Interne Daten zeigen zudem, dass Copilot die Klickrate auf NYT-Inhalte um bis zu 93 % senkte.

Claude-Code v2.1.91 fügt MCP-Ergebnis-Persistenz, Shell-Ausführungssteuerungen und mehrzeilige Deep-Links hinzu
Claude-Code v2.1.91 führt die Überschreibung der MCP-Tool-Ergebnispersistenz über die _meta["anthropic/maxResultSizeChars"]-Annotation mit Unterstützung für bis zu 500.000 Zeichen ein, fügt die Einstellung disableSkillShellExecution hinzu und ermöglicht mehrzeilige Eingabeaufforderungen in claude-cli://open?q=-Deep-Links mit kodierten Zeilenumbrüchen.

Google, Microsoft und xAI einigen sich, frühe KI-Modelle mit der US-Regierung zu teilen
Google, Microsoft und xAI (Elon Musks KI-Firma) haben sich freiwillig verpflichtet, der US-Regierung frühen Zugang zu ihren KI-Modellen für Sicherheitstests zu gewähren, im Rahmen einer Initiative, über die das Wall Street Journal berichtet.