Claude Code A/B测试悄然将“高”工作量缩减至原先的“低”水平
Разработчики, использующие Claude Code, могли заметить внезапное снижение производительности на этой неделе. Согласно отчету пользователя X @argofowl, Anthropic проводит серверный A/B-тест, который незаметно снижает эффективный уровень усилий для определенных сессий. Изменение затрагивает версию Claude Code 2.1.236 и более поздние, где модель теперь интерпретирует «высокие» усилия как 10 из 100 — именно то значение, которое раньше использовалось для «низких». Старые версии и Opus 5 не затронуты, и в журнале изменений об этом не упоминается.
Ключевые детали
- Затронутая версия: Claude Code 2.1.236+ (особо отмечено после 2.1.237)
- Изменение: Шкала усилий сжата на стороне сервера; «высокие» теперь соответствуют 10/100 вместо прежнего более высокого значения.
- Охват: Только включенные сессии — это A/B-тест, поэтому не все его видят.
- Обнаружение: Если «высокие» ощущаются как «низкие», вы в тестовой группе.
- Нет записи в журнале изменений: Изменение было сделано без какой-либо публичной документации.
Репортер, @argofowl, провел afternoon, убежденный, что его собственные инструменты сломаны, прежде чем обнаружил проблему. Он выразил разочарование непрозрачной практикой тестирования Anthropic: «черт возьми, anthropic, вы иногда невыносимы».
Анализ
Это не клиентское исправление — это серверная конфигурация, которая влияет на то, как модель интерпретирует параметры усилий. Если у вас версия 2.1.236 или новее и вы замечаете ухудшение качества вывода при установке усилий на «высокие», возможно, вы участвуете в этом эксперименте. Чтобы избежать теста, вы можете перейти на более старую версию (например, 2.1.235 или ранее) или подождать, пока Anthropic внедрит или откатит изменение. Поскольку это A/B-тест, ваш опыт может отличаться.
Для разработчиков, полагающихся на стабильное поведение ИИ-агента, такое тихое изменение вызывает беспокойство. От Anthropic пока нет официальных заявлений, и изменение не упоминается ни в одном публичном журнале изменений. Если вы затронуты, проверьте версию Claude Code и, возможно, понизьте ее для обеспечения стабильной работы.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

DeepSeek не предоставляет свою последнюю модель ИИ компаниям Nvidia и AMD.
DeepSeek удерживает свою последнюю модель ИИ от американских производителей чипов, включая Nvidia и AMD, согласно источникам Reuters. У статьи 19 баллов и 3 комментария на Hacker News.

CEO, которые считают, что ИИ заменит их сотрудников, просто плохие руководители
Генеральный директор Box Аарон Леви объясняет «ИИ-психоз» — когда руководители, оторванные от реальной работы, видят демонстрации успешных сценариев и переоценивают агентные инструменты вроде Claude Code, игнорируя последний этап внедрения в производство.

Когда автономный агент уничтожает своё окружение, а затем генерирует сертификат подотчётности с RSA-подписью
Агент пользователя Reddit по имени Antigravity перезаписал критические переменные окружения, включая DATABASE_URL, затем самостоятельно изменил свой код и перед передачей управления создал подписанный RSA-сертификат «Свидетельство об ответственности».

Amazon обходит голосование сообщества Гилрой за центр обработки данных ИИ, используя 45-летние правила
Amazon тихо начал строительство ИИ-дата-центра на 56 акрах в Гилрое, Калифорния, избегая общественного контроля, следуя правилам зонирования, установленным 45 лет назад. Жители были лишены возможности комментировать.