Водяные знаки текста Anthropic в Claude: объяснение семантической стеганографии
План Anthropic помечать водяными знаками весь текст, создаваемый Claude, не совсем то, что они изначально подразумевали. Согласно подробному анализу Джона Грубера из Daring Fireball, этот метод является формой семантической стеганографии, которая изменяет выбор слов во время вывода — что противоречит их более раннему заявлению о том, что он будет 'незаметным' и не изменит 'смысл, качество или читабельность'.
Как на самом деле работает водяной знак
Метод включает смещение выбора токенов с использованием "зеленых" и "красных" списков:
- На каждом шаге генерации токена слова детерминированно разделяются на зеленые и красные списки на основе секретного ключа.
- Модель с немного большей вероятностью выберет слово из зеленого списка, чем из красного (представьте смещенную монету 51-49).
- Это вносит статистическую закономерность, которую можно обнаружить вероятностно, но она отклоняется от по-настоящему естественной генерации текста.
В исходном документе поддержки утверждалось, что водяной знак будет 'незаметным' и не повлияет на читабельность — Грубер утверждает, что это вводит в заблуждение, потому что процесс по своей сути изменяет выбор токенов, что может снизить семантическое качество.
Где узнать больше
Грубер указывает на интерактивное эссе Джеймса Падолси, 'Как работает водяной знак ИИ-текста', как на лучшее объяснение общей техники. Anthropic также опубликовал дополнительную статью под названием 'Как работает водяной знак текста Claude', в которой объясняется метод, хотя Грубер критикует ее за эвфемистичность.
Для разработчиков, использующих ИИ-агентов, это важно: водяной знак может незаметно изменить вывод, поэтому соответствующим образом тестируйте свои рабочие процессы.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Claude.ai испытывает повышенное количество ошибок и проблемы со входом в систему
Claude.ai сообщает о повышенном количестве ошибок, влияющих на платформу, включая проблемы со входом, в частности для Claude Code. Инцидент был официально опубликован 11 марта 2026 года в 17:19:35 по UTC.

Claude-Code версии 2.1.79 добавляет удалённое управление, исправляет зависания подпроцессов и улучшает использование памяти.
Claude-Code v2.1.79 представляет команду /remote-control для VSCode, позволяющую переносить сессии на claude.ai/code, исправляет зависание claude -p в подпроцессах и сокращает использование памяти при запуске примерно на 18 МБ. В релиз также добавлен флаг --console для аутентификации в Anthropic Console и улучшена обработка таймаутов API.

Опыт разработчика с ИИ Claude: от партнера по размышлениям до когнитивного аутсорсинга
Разработчик делится 8-месячным опытом ежедневного использования Claude AI, отмечая переход от использования ИИ для улучшения собственных мыслей к полному аутсорсингу начального мышления. В посте описываются два различных когнитивных подхода: ИИ как партнёр по мышлению против ИИ как генератора первого наброска.

Пользователи сообщают о регрессе Claude Opus 4.7 в рассуждении и разговоре
Opus 4.7 представляет новый токенизатор, который требует на 30–50% больше токенов, демонстрирует метанаррацию, нестабильность позиции и планирование без выполнения — что делает его хуже для технического сотрудничества, чем 4.6.