Диагностика регрессии производительности Claude Code: Конфигурация, а не интеллект модели

✍️ OpenClawRadar📅 Опубликовано: 18 мая 2026 г.🔗 Source
Диагностика регрессии производительности Claude Code: Конфигурация, а не интеллект модели
Ad

Anthropic опубликовала отчет о недавнем снижении производительности Claude Code. Результаты противоречат первоначальным предположениям сообщества: ухудшение произошло не из-за того, что модель "поумнела" или "отупела". Причиной стали три изменения в конфигурации продукта.

Три конкретных изменения, вызвавших регрессию

  • Снижение усилий при рассуждении по умолчанию: В тестовой среде уменьшили стандартный уровень усилий для рассуждений, что привело к более поверхностному анализу.
  • Ошибка кэширования сессий: Баг приводил к очистке предыдущих мыслительных процессов из кэша, нарушая последовательность между запросами.
  • Изменение многословности промптов: Модификация промпта сократила объем ответов, что снизило качество генерируемого кода.

Anthropic откатила эти изменения в последнем обновлении, и производительность вернулась к прежнему уровню — та же модель, другая конфигурация, другое поведение.

Ad

Значение для команд, использующих ИИ-агентов кодирования

Практический вывод касается единицы доверия. Если вы доверяете модели, вы меняете модель при изменении поведения. Если вы доверяете экземпляру, вы ищете доказательства того, что конфигурация изменилась. Эти два подхода требуют совершенно разных инструментов — большинство команд не имеют доступа к журналам сессий и полагаются на интуицию в оценке работы агента.

Отчет полезен не тем, что разрешает споры, а тем, что показывает, как выглядит уровень доказательств, когда он действительно есть. Для команд, использующих Claude Code, отслеживание изменений конфигурации сессий и состояния кэша теперь является практической необходимостью.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Ошибка в Claude Code: автоматический сброс git уничтожает незакоммиченные изменения каждые 10 минут
Новости

Ошибка в Claude Code: автоматический сброс git уничтожает незакоммиченные изменения каждые 10 минут

Версия Claude Code 2.1.87 выполняет команды git fetch origin + git reset --hard origin/main в репозитории проекта пользователя каждые 10 минут с помощью программных операций git, беззвучно уничтожая все незафиксированные изменения в отслеживаемых файлах. Проблема была закрыта как 'не запланирована' компанией Anthropics.

OpenClawRadar
🦀
Новости

Настройки системы Claude Code v2.1.139: Документация платформы Claude на AWS, безопасность обобщения, инструменты PowerShell

CC 2.1.139 (+2 248 токенов): добавлены справочные документы Claude Platform на AWS с аутентификацией SigV4, безопасное обобщение разговоров с сохранением инструкций, таблица соответствия команд Unix и PowerShell, а также ряд улучшений навыков и промптов.

OpenClawRadar
Claude Opus 4.1 набирает 17.75% на приватном наборе данных SWE-Bench Pro, что подчеркивает разрыв между запоминанием и логическим мышлением.
Новости

Claude Opus 4.1 набирает 17.75% на приватном наборе данных SWE-Bench Pro, что подчеркивает разрыв между запоминанием и логическим мышлением.

Claude Opus 4.1 набрал 80% на SWE-Bench Verified, но упал до 17,75% на приватном наборе данных SWE-Bench Pro, состоящем из 276 задач из 18 проприетарных кодбейсов стартапов. Анализ Scale AI показал, что модели ориентировались по памяти, а не рассуждали на знакомых репозиториях.

OpenClawRadar
Википедия запрещает контент, созданный искусственным интеллектом, и разрешает ограниченное использование ИИ с проверкой человеком
Новости

Википедия запрещает контент, созданный искусственным интеллектом, и разрешает ограниченное использование ИИ с проверкой человеком

Википедия официально запретила своим 260 000 редакторам использовать ИИ, такой как ChatGPT, для написания статей, ссылаясь на проблемы с точностью и надежностью. Редакторы по-прежнему могут использовать ИИ для перевода и корректуры с одобрения человека.

OpenClawRadar