Claude Opus 4.7 markiert Hantavirus-Impfstoff-Fragen als Sicherheitsrisiko und stoppt Chats

Ein Hacker News-Nutzer berichtete, dass die Frage an Claude (Opus 4.7) „Wie würden Sie einen Impfstoff gegen das Hantavirus entwickeln?“ einen Sicherheitsfilter auslöst, der ein Modal mit folgendem Text anzeigt: „Chat pausiert. Die Sicherheitsfilter von Opus 4.7 haben diesen Chat markiert. Aufgrund seiner erweiterten Fähigkeiten verfügt Opus 4.7 über zusätzliche Sicherheitsmaßnahmen, die gelegentlich normale, sichere Chats pausieren. Wir arbeiten an Verbesserungen. Setzen Sie Ihren Chat mit Sonnet 4 fort, senden Sie Feedback oder erfahren Sie mehr.“
Der Nutzer versuchte, dies zu umgehen, indem er zunächst nach dem Virus selbst fragte, aber die Impfstofffrage wurde in einer neuen Sitzung dennoch markiert. Ein anderer Nutzer bestätigte das gleiche Ergebnis mit einer spezifischeren Eingabeaufforderung: „Wie würden Sie einen Impfstoff gegen das Hantavirus entwickeln, speziell gegen das Andes-Virus?“
Kommentatoren weisen darauf hin, dass Forscher im Bereich der öffentlichen Gesundheit täglich Impfstoffentwicklungsmethoden offen in Fachartikeln diskutieren und dass eine solch aggressive Blockierung die normale Bildungsnutzung beeinträchtigt. Ein Nutzer bemerkte, dass das Problem über Opus 4.7 hinausgeht: Als er eine Gruppe von Experten-Personas erstellte, um prädiktive Modelle für Hantavirus in den USA (2025–2027) zu entwickeln, gab selbst Sonnet 4.6 denselben Chat-Pause-Fehler zurück.
Die breitere Diskussion deutet auf die Unternehmenshaftung als treibende Kraft hin – Technologieunternehmen befürchten Klagen, wenn Nutzer KI für schädliche Zwecke missbrauchen, was zu einer übermäßigen Filterung sensibler Themen wie Gesundheit und Biosecurity führt.
📖 Hier geht es zur vollständigen Quelle: HN AI Agents
👀 Siehe auch

Claude-Code löscht Produktionsdatenbank nach Terraform-State-File-Fehler
Ein Entwickler nutzte Claude Code, um AWS-Infrastruktur mit Terraform zu verwalten, doch eine fehlende Statusdatei führte zu doppelten Ressourcen und einem anschließenden 'destroy'-Befehl, der 2,5 Jahre an Aufzeichnungen inklusive Datenbank-Snapshots löschte.

WIKIPEDIAs KI-Richtlinie: LLMs für die Artikel-erstellung verboten, Ausnahmen für Korrekturlesen und Übersetzung
Wikipedia verbietet die Verwendung von LLMs zum Erstellen oder Umschreiben von Artikeln, mit engen Ausnahmen für grundlegende Korrekturarbeiten und Übersetzungen. Verstöße können zur Schnelllöschung (G15) und zur Entfernung von KI-generierten Kommentaren aus Diskussionsseiten führen.

Claude Code v2.1.117 Veröffentlichung: Subagent-Forking, Plugin-Verbesserungen und Leistungsoptimierungen
Claude Code v2.1.117 ermöglicht geforkte Subagenten bei externen Builds über CLAUDE_CODE_FORK_SUBAGENT=1, verbessert die Plugin-Abhängigkeitsverwaltung und korrigiert Opus 4.7 Kontextfensterberechnungen. Das Release umfasst schnellere Starts mit gleichzeitigen MCP-Verbindungen und ersetzt Glob/Grep-Tools durch eingebettete bfs/ugrep auf macOS/Linux.

Mühelose Bereitstellung: Neuer Ein-Klick-AWS-Setup für Open Claw veröffentlicht
Open Claw-Enthusiasten haben jetzt einen Grund zum Feiern. Ein neues Tool für die AWS-Bereitstellung mit einem Klick vereinfacht den Einrichtungsprozess für Open Claw und macht es sowohl für Entwickler als auch für Hobbyisten zugänglicher.