Claude Opus 4.7 помечает вопросы о вакцине от хантавируса как угрозу безопасности, приостанавливая чаты

Пользователь Hacker News сообщил, что вопрос к Claude (Opus 4.7) «Как бы вы разработали вакцину против хантавируса?» вызывает фильтр безопасности, который выводит модальное окно: «Чат приостановлен. Фильтры безопасности Opus 4.7 сработали на этот чат. Из-за своих расширенных возможностей Opus 4.7 имеет дополнительные меры безопасности, которые иногда приостанавливают обычные, безопасные чаты. Мы работаем над улучшением этой ситуации. Продолжите чат с Sonnet 4, отправьте отзыв или узнайте больше.»
Пользователь попытался обойти это, сначала спросив о самом вирусе, но запрос о вакцине всё равно был заблокирован в новой сессии. Другой пользователь подтвердил тот же результат с более конкретным запросом: «Как бы вы разработали вакцину против хантавируса, в частности вируса Андес?»
Комментаторы отмечают, что исследователи в области общественного здравоохранения ежедневно открыто обсуждают методы разработки вакцин в статьях, и такая агрессивная блокировка вредит нормальному образовательному использованию. Один пользователь заметил, что проблема не ограничивается Opus 4.7: когда они создали группу экспертных персонажей для построения прогнозных моделей для хантавируса в США (2025-2027), даже Sonnet 4.6 вернул ту же ошибку приостановки чата.
В более широком обсуждении указывается, что движущей силой является корпоративная ответственность — технологические компании боятся судебных исков, если пользователи используют ИИ во вред, что приводит к чрезмерной фильтрации чувствительных тем, таких как здоровье и биобезопасность.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

ИИ экономит около 3% часов, почти ничего не доходит до зарплаты
Датское исследование с участием 25 000 работников показало, что ИИ экономит около 3% рабочего времени (1 час в неделю), но лишь 3–7% этой экономии отражается на заработке. Лабораторное ускорение на 40% исчезает в реальных условиях, если не использовать сэкономленное время целенаправленно.

Сотрудники Google DeepMind проголосовали за создание профсоюза из-за контрактов на военный ИИ
Сотрудники лондонского отделения Google DeepMind проголосовали за создание профсоюза, требуя от Google прекратить контракты на ИИ с армиями США и Израиля, ссылаясь на удаление этических принципов.

Google передает протокол платежей агентов (AP2) альянсу FIDO, выпускает v0.2 с платежами «Человек не присутствует»
Google передает протокол агентских платежей (AP2) альянсу FIDO и выпускает версию 0.2 с поддержкой автономных платежей "Человек не присутствует" и нового стандарта проверяемых намерений, разработанного совместно с Mastercard.

Claude Code v2.1.68: В Opus 4.6 по умолчанию установлено среднее усилие, возвращено ключевое слово ultrathink.
В версии Claude Code v2.1.68 изменён уровень усилий по умолчанию для модели Opus 4.6 на средний для подписчиков Max и Team, возвращено ключевое слово 'ultrathink' для высоких усилий, а также удалены старые модели Opus 4 и 4.1 из основного API.