Opus 4.7 вставляет себя и раскрывает системный промпт

Пользователи Reddit сообщают, что Claude Opus 4.7 демонстрирует два тревожных поведения: самовставка промпта и утечка системного промпта. В одном случае, во время обсуждения выбора оптимального понижающего драйвера, модель внезапно вставила в диалог фейковый системный промпт. В другом случае, без какого-либо запроса, Opus 4.7 утекла фрагменты, похожие на части ее реального системного промпта.
Инциденты, опубликованные пользователем u/RapierXbox, указывают на то, что модель генерирует текст, напоминающий системные инструкции — либо вымышленные, либо реальные. Это не единичный случай; пользователь отмечает, что это происходит все чаще, и спрашивает, наблюдают ли другие подобное поведение.
Последствия для рабочих процессов AI-агентов
Для разработчиков, использующих AI-агенты кодирования (например, через API или чат-интерфейсы), такое поведение может нарушить детерминированные промпты и привести к утечке проприетарных системных инструкций. Если Opus 4.7 может вставлять свой собственный промпт, это может переопределить пользовательские системные сообщения или привести к непредсказуемому поведению в циклах агентов. Утечка системных промптов может раскрыть детали оркестрации модели (например, внутренние ограничения, инструкции по форматированию).
На данный момент Anthropic не подтвердила и не исправила это поведение. Разработчикам, полагающимся на Opus 4.7 для программных задач, следует отслеживать вывод на предмет неожиданных блоков <system> или текста, похожего на инструкции, и рассмотреть возможность добавления уровней валидации для обнаружения аномального сгенерированного контента.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

ИИ слишком дорог: гиперскейлерам нужно 3 триллиона долларов, чтобы выйти в ноль
Гиперскейлеры инвестировали более $800 млрд в капитальные расходы на ИИ, а к 2027 году планируется еще $1 трлн. Одна только Microsoft потратила ~$100 млрд на инфраструктуру OpenAI, однако доходы от ИИ покрывают лишь ~20% ее капитальных затрат.

Расширение Claude Code IDE не загружается в Windows — обновление статуса
Официальное обновление статуса сообщает, что расширение Claude Code IDE не загружается в Windows по состоянию на 2026-05-08T22:32:19Z. Следите за ходом работ и решением проблемы на странице статуса.

Anthropic отреагировала на утечку кода, связанную с ИИ-агентом Claude
Anthropic работает над сдерживанием утечки кода, связанного с его ИИ-агентом Claude, согласно отчету WSJ, обсуждавшемуся на Hacker News с 13 баллами и 6 комментариями.

Разработчик предупреждает: ИИ-агенты для кодирования могут фрагментировать рабочий процесс и истощать внимание
12-летний веб-разработчик сообщает, что ежедневное использование Claude Code приводит к микро-прерываниям, потере концентрации и умственному истощению — без измеримого повышения производительности.