Anthropic сообщает о промышленных масштабах атак методом дистилляции на Claude со стороны китайских лабораторий ИИ.

✍️ OpenClawRadar📅 Опубликовано: 24 февраля 2026 г.🔗 Source
Anthropic сообщает о промышленных масштабах атак методом дистилляции на Claude со стороны китайских лабораторий ИИ.
Ad

Операция по извлечению моделей в промышленных масштабах

Anthropic опубликовала результаты, детализирующие скоординированные атаки дистилляции против Claude, проведённые тремя китайскими лабораториями ИИ. Атаки включали массовое создание поддельных аккаунтов для извлечения способностей Claude к рассуждению через огромное количество взаимодействий с API.

Ключевые детали атаки из отчёта Anthropic

  • DeepSeek, Moonshot и MiniMax создали более 24 000 поддельных аккаунтов
  • Общее количество взаимодействий с Claude превысило 16 миллионов
  • Только MiniMax отправила 13 миллионов запросов
  • Когда Anthropic выпустила новую модель, MiniMax перенаправила почти половину своего трафика в течение 24 часов
  • DeepSeek целенаправленно нацеливалась на цепочки рассуждений и цензурно-безопасные ответы
  • Атаки становились всё более изощрёнными со временем по мере адаптации методов лабораториями
Ad

Последствия для безопасности разработчиков ИИ

Этот инцидент подчёркивает уязвимости в безопасности моделей ИИ, когда лаборатории с миллиардными бюджетами систематически пытаются извлечь проприетарные возможности. Масштаб и настойчивость этих атак — охватывающих несколько организаций и адаптирующихся к новым выпускам моделей — указывают на то, что это представляет собой постоянный вектор угрозы, а не изолированные инциденты.

Использованные методы (создание поддельных аккаунтов, целевые запросы на конкретные возможности, быстрая адаптация к новым версиям моделей) потенциально могут быть воспроизведены против других систем ИИ, что поднимает вопросы о безопасности сторонних инструментов ИИ, которые разработчики интегрируют в свои рабочие процессы.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Аудит разрешений кода Claude: практическое руководство по ограничению доступа к инструментам
Безопасность

Аудит разрешений кода Claude: практическое руководство по ограничению доступа к инструментам

Пользователь Reddit проверил настройки Claude Code и обнаружил, что у инструментов были избыточные разрешения, позволявшие редактировать файлы .env и производственные конфигурации. Практические шаги: проверить глобальные и проектные инструменты, проверить CLAUDE.md на наличие секретов и ограничить доступ к файлам по каталогам.

OpenClawRadar
Изоляция AI-агентов с помощью WebAssembly: нулевое доверие по умолчанию
Безопасность

Изоляция AI-агентов с помощью WebAssembly: нулевое доверие по умолчанию

Cosmonic утверждает, что традиционная изоляция (seccomp, bubblewrap) не подходит для AI-агентов из-за фоновых полномочий. Модель на основе возможностей WebAssembly предоставляет нулевые полномочия по умолчанию, требуя явного импорта для файловой системы, сети или учетных данных.

OpenClawRadar
Основная блокировка файлов для помощников по кодированию на основе ИИ: Практический чек-лист по безопасности
Безопасность

Основная блокировка файлов для помощников по кодированию на основе ИИ: Практический чек-лист по безопасности

ИИ-ассистенты для программирования читают данные с локального диска, а не только из вашего репозитория, раскрывая файлы, которые .gitignore защищает от GitHub, но не от агента. В обсуждении на Reddit определены критически важные файлы для блокировки, включая конфигурации ИИ-ассистентов с API-ключами, учетные данные сервисов, SSH-ключи и файлы окружения.

OpenClawRadar
Anthropic сообщает о промышленном масштабе извлечения данных ИИ Claude китайскими лабораториями.
Безопасность

Anthropic сообщает о промышленном масштабе извлечения данных ИИ Claude китайскими лабораториями.

Anthropic подтвердила, что китайские лаборатории ИИ использовали более 24 000 поддельных аккаунтов для сбора 16 миллионов диалогов из Claude, извлекая защитные механизмы и логические структуры для военных и систем наблюдения.

OpenClawRadar