Claude Code A/B测试悄然将“高”工作量缩减至原先的“低”水平
Разработчики, использующие Claude Code, могли заметить внезапное снижение производительности на этой неделе. Согласно отчету пользователя X @argofowl, Anthropic проводит серверный A/B-тест, который незаметно снижает эффективный уровень усилий для определенных сессий. Изменение затрагивает версию Claude Code 2.1.236 и более поздние, где модель теперь интерпретирует «высокие» усилия как 10 из 100 — именно то значение, которое раньше использовалось для «низких». Старые версии и Opus 5 не затронуты, и в журнале изменений об этом не упоминается.
Ключевые детали
- Затронутая версия: Claude Code 2.1.236+ (особо отмечено после 2.1.237)
- Изменение: Шкала усилий сжата на стороне сервера; «высокие» теперь соответствуют 10/100 вместо прежнего более высокого значения.
- Охват: Только включенные сессии — это A/B-тест, поэтому не все его видят.
- Обнаружение: Если «высокие» ощущаются как «низкие», вы в тестовой группе.
- Нет записи в журнале изменений: Изменение было сделано без какой-либо публичной документации.
Репортер, @argofowl, провел afternoon, убежденный, что его собственные инструменты сломаны, прежде чем обнаружил проблему. Он выразил разочарование непрозрачной практикой тестирования Anthropic: «черт возьми, anthropic, вы иногда невыносимы».
Анализ
Это не клиентское исправление — это серверная конфигурация, которая влияет на то, как модель интерпретирует параметры усилий. Если у вас версия 2.1.236 или новее и вы замечаете ухудшение качества вывода при установке усилий на «высокие», возможно, вы участвуете в этом эксперименте. Чтобы избежать теста, вы можете перейти на более старую версию (например, 2.1.235 или ранее) или подождать, пока Anthropic внедрит или откатит изменение. Поскольку это A/B-тест, ваш опыт может отличаться.
Для разработчиков, полагающихся на стабильное поведение ИИ-агента, такое тихое изменение вызывает беспокойство. От Anthropic пока нет официальных заявлений, и изменение не упоминается ни в одном публичном журнале изменений. Если вы затронуты, проверьте версию Claude Code и, возможно, понизьте ее для обеспечения стабильной работы.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Slurm Coding: Искусственный интеллект в разработке, где время исчезает
Разработчик описывает 'сламовое кодирование' как интенсивный паттерн разработки, который стал возможен благодаря инструментам ИИ-кодирования, когда небольшие идеи быстро превращаются в полноценные системы через цикл быстрой реализации и выброса дофамина.

RTX 5080 16GB: Qwen3.6 35B MoE при 128k контексте — 56 tok/s, и почему MTP не помогает
Новые бенчмарки показывают, что Qwen3.6 35B MoE на RTX 5080 16GB выдает 56 ток/с при контексте 128k. MTP (Multi-Token Prediction) замедляет работу на 23% из-за нехватки VRAM, вытесняя экспертные слои на CPU.

Anthropic запускает программу сообщества послов Claude
Anthropic запустила программу Claude Community Ambassadors, которая предоставляет ресурсы для организации локальных встреч разработчиков и объединения создателей по всему миру. Программа открыта для участников любого происхождения и местоположения.

Domo CDO: Остановите AI FOMO, начните с электронных таблиц
Главный дизайнер Domo Крис Уиллис утверждает, что ИИ продаётся без технического задания, создавая театр «токенмаксинга» на основе страха. Его решение: начать с автоматизации работы с электронными таблицами, а не гнаться за недостижимыми целями.