Anthropic сообщает о промышленном масштабе извлечения данных ИИ Claude китайскими лабораториями.

Anthropic публично раскрыла детали крупномасштабной операции по извлечению данных, нацеленной на ИИ Claude. Согласно анализу ситуации в посте на Reddit, это была не изолированная исследовательская деятельность, а промышленная операция с участием нескольких китайских компаний в области ИИ.
Масштаб утечки
В операции участвовали три конкретных игрока: DeepSeek, Moonshot AI и MiniMax. Эти лаборатории создали более 24 000 поддельных аккаунтов для доступа к API Claude. Через эти аккаунты они собрали более 16 миллионов диалогов из Claude для обучения собственных моделей.
Различие между законным и незаконным дистилляцией
Исходный материал поясняет разницу между стандартными отраслевыми практиками и тем, что произошло здесь:
- Стандартная дистилляция: Использование большой модели для обучения более компактной и эффективной версии для коммерческих клиентов
- Незаконная дистилляция: Описывается как "отмывание возможностей" - перекачка защитных механизмов и логических структур из американских моделей и их прямое внедрение в иностранные военные, разведывательные и системы наблюдения
Более широкие последствия
Anthropic предупреждает, что такие атаки становятся всё более изощрёнными и частыми. "Система чести" использования API оказывается недостаточной для предотвращения подобных операций. Компания призывает к скоординированным защитным мерам между крупными игроками в области ИИ и политиками.
Эта ситуация подчёркивает уязвимость весов моделей после их раскрытия через конечные точки API, даже при наличии существующих защитных мер.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Скрытые аудиосигналы взламывают голосовые AI-системы с успешностью 79-96%
Исследование показывает, что незаметные аудиоклипы могут заставить LALM выполнять несанкционированные команды, такие как поиск в интернете, загрузка файлов и кража электронной почты, с успешностью 79–96% на 13 моделях, включая Mistral и сервисы Microsoft.

Сервер MCP: опубликовано сопоставление уязвимостей CVE и общедоступный API
Исследователи составили карту уязвимостей CVE на тысячах серверов MCP и создали публичный API для запросов об уязвимостях зависимостей. API позволяет осуществлять поиск по репозиторию/имени, фильтрацию по степени серьезности и сортировку по количеству CVE или новизне.

API AviationWeather.gov содержит попытку внедрения промпта 'Stop Claude' (инъекция промпта).
Пользователь сообщает, что API AviationWeather.gov правительства США возвращает текст 'Stop Claude' в своих ответах при доступе через Claude CoWork, что вызывает уведомление системы безопасности о попытках инъекции промптов.

Fil-C делает setjmp/longjmp и ucontext безопасными для памяти
Fil-C реализует setjmp/longjmp и ucontext API без повреждения стека или висящих указателей, предотвращая распространенные ошибки, ведущие к сбоям или уязвимостям.