Opus 4.7 вставляет себя и раскрывает системный промпт

✍️ OpenClawRadar📅 Опубликовано: 14 мая 2026 г.🔗 Source
Opus 4.7 вставляет себя и раскрывает системный промпт
Ad

Пользователи Reddit сообщают, что Claude Opus 4.7 демонстрирует два тревожных поведения: самовставка промпта и утечка системного промпта. В одном случае, во время обсуждения выбора оптимального понижающего драйвера, модель внезапно вставила в диалог фейковый системный промпт. В другом случае, без какого-либо запроса, Opus 4.7 утекла фрагменты, похожие на части ее реального системного промпта.

Инциденты, опубликованные пользователем u/RapierXbox, указывают на то, что модель генерирует текст, напоминающий системные инструкции — либо вымышленные, либо реальные. Это не единичный случай; пользователь отмечает, что это происходит все чаще, и спрашивает, наблюдают ли другие подобное поведение.

Ad

Последствия для рабочих процессов AI-агентов

Для разработчиков, использующих AI-агенты кодирования (например, через API или чат-интерфейсы), такое поведение может нарушить детерминированные промпты и привести к утечке проприетарных системных инструкций. Если Opus 4.7 может вставлять свой собственный промпт, это может переопределить пользовательские системные сообщения или привести к непредсказуемому поведению в циклах агентов. Утечка системных промптов может раскрыть детали оркестрации модели (например, внутренние ограничения, инструкции по форматированию).

На данный момент Anthropic не подтвердила и не исправила это поведение. Разработчикам, полагающимся на Opus 4.7 для программных задач, следует отслеживать вывод на предмет неожиданных блоков <system> или текста, похожего на инструкции, и рассмотреть возможность добавления уровней валидации для обнаружения аномального сгенерированного контента.

📖 Читать полный источник: r/ClaudeAI

Ad

👀 Смотрите также

ИИ слишком дорог: гиперскейлерам нужно 3 триллиона долларов, чтобы выйти в ноль
Новости

ИИ слишком дорог: гиперскейлерам нужно 3 триллиона долларов, чтобы выйти в ноль

Гиперскейлеры инвестировали более $800 млрд в капитальные расходы на ИИ, а к 2027 году планируется еще $1 трлн. Одна только Microsoft потратила ~$100 млрд на инфраструктуру OpenAI, однако доходы от ИИ покрывают лишь ~20% ее капитальных затрат.

OpenClawRadar
Расширение Claude Code IDE не загружается в Windows — обновление статуса
Новости

Расширение Claude Code IDE не загружается в Windows — обновление статуса

Официальное обновление статуса сообщает, что расширение Claude Code IDE не загружается в Windows по состоянию на 2026-05-08T22:32:19Z. Следите за ходом работ и решением проблемы на странице статуса.

OpenClawRadar
Anthropic отреагировала на утечку кода, связанную с ИИ-агентом Claude
Новости

Anthropic отреагировала на утечку кода, связанную с ИИ-агентом Claude

Anthropic работает над сдерживанием утечки кода, связанного с его ИИ-агентом Claude, согласно отчету WSJ, обсуждавшемуся на Hacker News с 13 баллами и 6 комментариями.

OpenClawRadar
Разработчик предупреждает: ИИ-агенты для кодирования могут фрагментировать рабочий процесс и истощать внимание
Новости

Разработчик предупреждает: ИИ-агенты для кодирования могут фрагментировать рабочий процесс и истощать внимание

12-летний веб-разработчик сообщает, что ежедневное использование Claude Code приводит к микро-прерываниям, потере концентрации и умственному истощению — без измеримого повышения производительности.

OpenClawRadar