Текстовые ИИ-водяные знаки всегда будет тривиально удалить

✍️ OpenClawRadar📅 Опубликовано: 14 августа 2026 г.🔗 Source
Текстовые ИИ-водяные знаки всегда будет тривиально удалить
Ad

Статья 50 Закона ЕС об ИИ, вступающая в силу с августа 2026 года, требует от поставщиков LLM маркировать текст, созданный ИИ, водяными знаками. Но текстовые водяные знаки — это совершенно другая задача, чем водяные знаки для изображений, и их удаление остается тривиальным. Вот технический разбор.

Почему водяные знаки в тексте — это сложно

У изображений есть шум, в котором можно спрятать водяные знаки; у текста его нет. Вы не можете изменить предложение, чтобы это осталось незамеченным. Это делает задачу похожей на стеганографию, где открытый текст нельзя произвольно изменять. Наивный подход, например, «каждая пятая буква — „е“», ухудшил бы качество вывода.

Может ли сама модель управлять водяным знаком? Сильные модели могут, но это сжигает токены рассуждения и снижает качество вывода — плохой компромисс.

Почему обнаружение путем повторного прогона модели не работает

Прогон текста через модель для проверки вероятностей токенов не работает: пространство человеческого текста, который читается как вывод ИИ, огромно, ложные срабатывания многочисленны, а обеспечение бесплатной проверки для каждого гражданина ЕС непомерно дорого.

Ad

Как работает SynthID

SynthID от Google — единственный публичный текстовый водяной знак. Он присваивает каждому токену оценку на основе предыдущих токенов — например, сумма ID токенов по модулю 5. При выборке модель выбирает токен с наивысшей оценкой из пяти наиболее вероятных. Обнаружение агрегирует оценку по всему блоку текста; подозрительно высокая агрегированная оценка указывает на генерацию ИИ.

Это похоже на эвристику с длинным тире, но основано на тонких математических закономерностях, которые люди не могут заметить.

Загвоздка

Но любой водяной знак, который сохраняет лексическое разнообразие, можно удалить простым перефразированием, подменой токенов или даже переводом. Пока текст должен читаться естественно, вы можете устранить сигнал с минимальными усилиями. Устойчивость SynthID ограничена — он предназначен для массового обнаружения, а не для противостояния целенаправленному удалению.

Ожидайте, что ЕС будет обеспечивать соблюдение требования, которое технически невыполнимо. Лаборатории будут соблюдать букву закона, но любой, кому это нужно, сможет обойти его за секунды.

📖 Источник: HN AI Agents

Ad

👀 Смотрите также

Кодекс Конверс: Преемник OpenClaw в области автоматизации ИИ
Новости

Кодекс Конверс: Преемник OpenClaw в области автоматизации ИИ

Кодекс теперь может общаться сам с собой, heralding новая эпоха в автоматизации с использованием ИИ и эффективно заменяя OpenClaw, предыдущего лидера.

OpenClawRadar
🦀
Новости

Сотрудники Amazon используют AI-агентов MeshClaw для «токенмаксинга» с целью достижения показателей использования

Разработчики Amazon автоматизируют ненужные задачи с помощью внутреннего инструмента MeshClaw, чтобы накрутить потребление токенов ИИ, после того как компания установила еженедельные цели использования для 80% разработчиков и ввела внутренние рейтинги.

OpenClawRadar
Claude Code v2.1.79: Сбой OAuth-авторизации после автоматического обновления: Обходное решение и исправление
Новости

Claude Code v2.1.79: Сбой OAuth-авторизации после автоматического обновления: Обходное решение и исправление

В Claude Code v2.1.79 обнаружен подтверждённый баг с авторизацией OAuth, из-за которого CLI зависает после подтверждения в браузере. Проблема возникает из-за автоматического обновления через нативный установщик до этой версии, а исправление требует отката до v2.1.75 путём удаления нативной установки.

OpenClawRadar
GPT 5.5 против Claude: Битва за рефакторинг — отчёт разработчика
Новости

GPT 5.5 против Claude: Битва за рефакторинг — отчёт разработчика

Разработчик использовал GPT 5.5 для планирования и Claude для кодирования масштабного рефакторинга 36 000 строк кода на C. GPT 5.5 впечатлил четкими планами, но израсходовал 85% лимита за 2 часа по тарифу $30.

OpenClawRadar