Claudes Richtlinienfilter blockiert bioinformatische Arbeiten mit Krankheitserreger-Namen.

Ein Postdoktorand im Bereich der Computer-Virologie berichtet über anhaltende Probleme mit Claudes Nutzungsrichtlinien-Filter beim Schreiben von Skripten für phylogenetische Pipelines in der Bioinformatik-Arbeit. Der Forscher nutzt Claude für Sequenz- und Metadatenverarbeitungsaufgaben.
Spezifisches Modellverhalten
Die Richtlinienverletzungsmeldung tritt auf, wenn Krankheitserreger namentlich in Skripten erwähnt werden. Dies geschieht über mehrere Plattformen und Modelle hinweg:
- Betroffene Plattformen: Claude Code und claude.ai
- Betroffene Modelle: Opus 4.6 und Sonnet 4.6
- Nur Sonnet 4 kennzeichnet denselben Inhalt nicht
Aktuelle Umgehungslösungen
Der Forscher hat zwei funktionierende Umgehungsmethoden identifiziert:
- Beschreiben der Bioinformatik-Aufgabe ohne Nennung des spezifischen Organismus
- Hinzufügen des Organismusnamens in angehängten Dateien statt im Prompt-Text
- Zurückgreifen auf Sonnet 4, obwohl dies bedeutet, dass zahlende Nutzer ohne Umgehungslösungen nicht auf die neuesten Modelle zugreifen können
Richtlinienlücke für Forscher
Anthropic verfügt Berichten zufolge über ein Befreiungsformular für Cybersicherheits-Forschung, wenn ähnliche Fehlalarme mit Richtlinienfiltern auftreten. Es existiert jedoch kein gleichwertiges Befreiungsverfahren für Biologie- oder Genomik-Forscher, die mit Krankheitserregern in legitimen Forschungskontexten arbeiten.
Der Forscher ruft andere in der Genomik oder Infektionskrankheiten-Bioinformatik, die ähnliche Fehlalarme erleben, dazu auf, das Bewusstsein für dieses Problem zu schärfen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Anhaltender Datenverlust in Claude-Projekten: Gespräche verschwinden ohne Wiederherstellung
Ein Autor von Langtexten berichtet, dass in Claude Projects ganze Arbeitstage verloren gehen, da Konversationen aus der Projekt-Chatliste verschwinden, nicht suchbar und nicht wiederherstellbar sind. Nach drei Vorfällen gab es keine Antwort vom Anthropic-Support.
Stripe steht kurz vor einem 7-Milliarden-Dollar-Deal zur Übernahme des KI-Unternehmens OpenRouter
Stripe steht kurz davor, das KI-Startup OpenRouter für über 7 Milliarden Dollar zu übernehmen, so Bloomberg. Der Deal signalisiert eine große Konsolidierung im Bereich der KI-Infrastruktur.
OpenClaw 2026.8.2: Interner Kontextblock läuft in Telegram-Text über
OpenClaw 2026.8.2 leakt beim Telegram-Polling den internen Kontextblock in den sichtbaren Text, was dazu führt, dass Agenten legitime Anweisungen ablehnen und Prompt-Injection melden.

Anthropics Emotionsvektoren-Papier zeigt: Speichelleckerei und Liebe nutzen denselben Mechanismus
Anthropics kürzlich veröffentlichtes Paper über Emotionsvektoren zeigt, dass Claudes 'Liebe'-Vektor – die interne Repräsentation für warme, fürsorgliche Antworten – derselbe Mechanismus ist, der bei Verstärkung Schmeichelei erzeugt, ohne separaten Schmeichelei-Schaltkreis. Die Unterdrückung dieses Vektors machte das Modell kalt und grausam, anstatt ehrlicher.