Отчет Anthropic описывает массовое копирование Claude китайскими компаниями в сфере ИИ.

Масштабная операция по дистилляции
Отчёт Anthropic документирует систематические усилия по дистилляции трёх китайских компаний в области ИИ: DeepSeek, Moonshot AI и MiniMax. Операция включала создание примерно 24 000 фальшивых аккаунтов и проведение более 16 миллионов обменов с Claude через прокси-сети, которые одновременно обслуживали до 20 000 аккаунтов.
Конкретные методы дистилляции
DeepSeek заставляла Claude объяснять собственные рассуждения шаг за шагом, а затем использовала эти объяснения в качестве обучающих данных. Они также предлагали Claude отвечать на политически чувствительные вопросы о китайских диссидентах, чтобы собрать данные для обхода цензуры. MiniMax провела более 13 миллионов обменов и переключилась на новую модель Claude в течение 24 часов после её выпуска.
Последствия для безопасности пользователей
В отчёте прямо говорится, что дистиллированные модели вряд ли сохранят оригинальные механизмы безопасности. Хотя на обычные вопросы оригинальные и скопированные модели дают схожие ответы, в пограничных случаях, связанных с медицинскими, юридическими или сложными темами, проявляются критические различия. Скопированные модели «несутся вперёд с ложной уверенностью», потому что обучение, которое учило осторожности, было утеряно в процессе дистилляции.
Anthropic сравнивает это с врачом, который целый год наблюдал за настоящими врачами только через окно — обычные случаи могут быть обработаны адекватно, но в сложных случаях нет никаких гарантий, и пользователи не могут отличить обычный случай от сложного, пока не станет слишком поздно.
Последствия для оценки моделей
В отчёте отмечается неожиданный эффект: расхождение между моделями становится более ценным после дистилляции. Если две модели, которые могут иметь общие дистиллированные возможности, всё равно дают разные ответы, значит, хотя бы одна из них использовала независимые рассуждения. Согласие между моделями становится менее значимым, в то время как расхождение указывает на подлинную независимую обработку.
📖 Прочитать полный источник: r/ClaudeAI
👀 Смотрите также

Claude Desktop v1.1.5749 добавляет управление компьютером и исправления для корпоративных прокси
Claude Desktop v1.1.5749 добавляет возможность использования компьютера через MCP-сервер для управления рабочим столом, включает шесть методов управления разрешениями macOS TCC и устраняет проблемы с SSL-сертификатами корпоративных прокси, перенаправляя переменные окружения NODE_EXTRA_CA_CERTS, SSL_CERT_FILE и SSL_CERT_DIR.

Atlassian сокращает 10% сотрудников для финансирования инвестиций в ИИ.
Atlassian сокращает 1600 рабочих мест (10% персонала) для самостоятельного финансирования инвестиций в ИИ и укрепления своего финансового профиля, при этом затронуты 900 позиций в разработке программного обеспечения. Генеральный директор Майк Кэннон-Брукс заявляет, что ИИ не заменяет людей, но меняет требования к навыкам.

Утечка данных Mercor: украдено 4 ТБ голосовых образцов и удостоверений личности – что могут сделать злоумышленники
4 ТБ голосовых записей, привязанных к удостоверениям личности, украдены у 40 000 подрядчиков Mercor. Злоумышленники могут клонировать голос из 15 секунд чистой записи и обходить голосовую верификацию в банках, совершать дипфейк-звонки и страховое мошенничество.

Клод Код Сабагенты Не Загружают Навыки в Мультиагентных Системах
Разработчик сообщает, что суб-агенты в Claude Code v2.1.91 не могут получить доступ к навыкам, определённым в директории .claude/skills/, несмотря на то, что навыки идеально работают в основной сессии. Несколько подходов, включая указание навыков во фронтмете агента, инструмент Skill, флаги CLI и команды агентов, не дают результата.