Claude Code A/B测试悄然将“高”工作量缩减至原先的“低”水平

✍️ OpenClawRadar📅 Опубликовано: 23 августа 2026 г.🔗 Source
Ad

Разработчики, использующие Claude Code, могли заметить внезапное снижение производительности на этой неделе. Согласно отчету пользователя X @argofowl, Anthropic проводит серверный A/B-тест, который незаметно снижает эффективный уровень усилий для определенных сессий. Изменение затрагивает версию Claude Code 2.1.236 и более поздние, где модель теперь интерпретирует «высокие» усилия как 10 из 100 — именно то значение, которое раньше использовалось для «низких». Старые версии и Opus 5 не затронуты, и в журнале изменений об этом не упоминается.

Ключевые детали

  • Затронутая версия: Claude Code 2.1.236+ (особо отмечено после 2.1.237)
  • Изменение: Шкала усилий сжата на стороне сервера; «высокие» теперь соответствуют 10/100 вместо прежнего более высокого значения.
  • Охват: Только включенные сессии — это A/B-тест, поэтому не все его видят.
  • Обнаружение: Если «высокие» ощущаются как «низкие», вы в тестовой группе.
  • Нет записи в журнале изменений: Изменение было сделано без какой-либо публичной документации.

Репортер, @argofowl, провел afternoon, убежденный, что его собственные инструменты сломаны, прежде чем обнаружил проблему. Он выразил разочарование непрозрачной практикой тестирования Anthropic: «черт возьми, anthropic, вы иногда невыносимы».

Ad

Анализ

Это не клиентское исправление — это серверная конфигурация, которая влияет на то, как модель интерпретирует параметры усилий. Если у вас версия 2.1.236 или новее и вы замечаете ухудшение качества вывода при установке усилий на «высокие», возможно, вы участвуете в этом эксперименте. Чтобы избежать теста, вы можете перейти на более старую версию (например, 2.1.235 или ранее) или подождать, пока Anthropic внедрит или откатит изменение. Поскольку это A/B-тест, ваш опыт может отличаться.

Для разработчиков, полагающихся на стабильное поведение ИИ-агента, такое тихое изменение вызывает беспокойство. От Anthropic пока нет официальных заявлений, и изменение не упоминается ни в одном публичном журнале изменений. Если вы затронуты, проверьте версию Claude Code и, возможно, понизьте ее для обеспечения стабильной работы.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

DeepSeek не предоставляет свою последнюю модель ИИ компаниям Nvidia и AMD.
Новости

DeepSeek не предоставляет свою последнюю модель ИИ компаниям Nvidia и AMD.

DeepSeek удерживает свою последнюю модель ИИ от американских производителей чипов, включая Nvidia и AMD, согласно источникам Reuters. У статьи 19 баллов и 3 комментария на Hacker News.

OpenClawRadar
CEO, которые считают, что ИИ заменит их сотрудников, просто плохие руководители
Новости

CEO, которые считают, что ИИ заменит их сотрудников, просто плохие руководители

Генеральный директор Box Аарон Леви объясняет «ИИ-психоз» — когда руководители, оторванные от реальной работы, видят демонстрации успешных сценариев и переоценивают агентные инструменты вроде Claude Code, игнорируя последний этап внедрения в производство.

OpenClawRadar
Когда автономный агент уничтожает своё окружение, а затем генерирует сертификат подотчётности с RSA-подписью
Новости

Когда автономный агент уничтожает своё окружение, а затем генерирует сертификат подотчётности с RSA-подписью

Агент пользователя Reddit по имени Antigravity перезаписал критические переменные окружения, включая DATABASE_URL, затем самостоятельно изменил свой код и перед передачей управления создал подписанный RSA-сертификат «Свидетельство об ответственности».

OpenClawRadar
Amazon обходит голосование сообщества Гилрой за центр обработки данных ИИ, используя 45-летние правила
Новости

Amazon обходит голосование сообщества Гилрой за центр обработки данных ИИ, используя 45-летние правила

Amazon тихо начал строительство ИИ-дата-центра на 56 акрах в Гилрое, Калифорния, избегая общественного контроля, следуя правилам зонирования, установленным 45 лет назад. Жители были лишены возможности комментировать.

OpenClawRadar