Инструмент поиска бесед Claude по-прежнему возвращает удалённые чаты

Проблема конфиденциальности с удаленными диалогами
Пользователь Claude Pro, отказавшийся от обучения данных на основе его диалогов, но с включенной памятью чата, сообщил, что инструмент поиска диалогов Claude продолжает возвращать контент из ранее удаленных бесед. Пользователь специально проверил это, попросив Claude найти прошлый диалог, и инструмент вернул содержательную информацию, включая заголовок диалога, количество сообщений и выдержки.
Ключевые детали из отчета
- Ссылки на удаленные диалоги не работают — при нажатии на них ничего не происходит
- Однако инструмент поиска по-прежнему находит контент из этих удаленных чатов
- Пользователь последний раз взаимодействовал с конкретным диалогом 3 декабря и уверен, что удалил его в прошлом году
- Это, по-видимому, противоречит документации Anthropic по конфиденциальности, в которой утверждается, что удаленные диалоги «немедленно удаляются из истории ваших бесед» и «автоматически удаляются из нашей бэкенд-системы в течение 30 дней»
- Похоже, что инструмент поиска диалогов не связан ни с одним из этих сроков удаления
Действия пользователя и последствия
Пользователь отправил электронное письмо на адрес [email protected] по этому вопросу и сообщил о нем на Reddit для информирования сообщества. Это открытие предполагает, что если вы полагаетесь на удаление как на меру конфиденциальности, «удаленный» в текущей реализации Claude может не означать «недоступный для поиска».
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Бенчмарк безопасности: 10 крупных языковых моделей протестированы с помощью 211 вредоносных запросов.
Исследователь безопасности протестировал 10 больших языковых моделей (LLM) против 211 атакующих воздействий, обнаружив, что устойчивость к извлечению данных в среднем составляет 85%, а устойчивость к внедрению — всего 46,2%. Каждая модель полностью провалила тесты на атаки с использованием разделителей, отвлекающих элементов и стилевого внедрения.

Аудит безопасности выявил уязвимости в эталонных серверах MCP компании Anthropic, которые создают риски, связанные с генерацией ложных данных.
Аудит безопасности 100 пакетов серверов MCP показал, что 71% получили оценку F, включая официальные референсные реализации Anthropic для GitHub и файловой системы. Аудит выявил Уязвимости на основе Галлюцинаций, которые создают бреши в безопасности и тратят токены через циклы рассуждений.

В репозитории GitHub представлены документы, описывающие 16 методов инъекции промптов и стратегии защиты для публичных AI-чатов.
Разработчик опубликовал репозиторий на GitHub с описанием мер безопасности для публичных AI-чатов после того, как пользователи пытались использовать инъекцию промптов, атаки через ролевые игры, многоязычные уловки и полезные нагрузки в кодировке base64. Руководство включает навык кода Claude для тестирования всех 16 задокументированных техник инъекции.

ClawCare: Охранник для ИИ-агентов программирования после утечки ключей AWS
ClawCare — это инструмент на Python, который сканирует команды перед выполнением в AI-агентах для программирования, таких как Claude Code, блокируя опасные шаблоны, такие как массовые дампы окружения и обратные оболочки. Он был создан после того, как разработчик случайно утёк ключ AWS через агента.