Claude Code A/B测试悄然将“高”工作量缩减至原先的“低”水平

✍️ OpenClawRadar📅 Опубликовано: 23 августа 2026 г.🔗 Source
Ad

Разработчики, использующие Claude Code, могли заметить внезапное снижение производительности на этой неделе. Согласно отчету пользователя X @argofowl, Anthropic проводит серверный A/B-тест, который незаметно снижает эффективный уровень усилий для определенных сессий. Изменение затрагивает версию Claude Code 2.1.236 и более поздние, где модель теперь интерпретирует «высокие» усилия как 10 из 100 — именно то значение, которое раньше использовалось для «низких». Старые версии и Opus 5 не затронуты, и в журнале изменений об этом не упоминается.

Ключевые детали

  • Затронутая версия: Claude Code 2.1.236+ (особо отмечено после 2.1.237)
  • Изменение: Шкала усилий сжата на стороне сервера; «высокие» теперь соответствуют 10/100 вместо прежнего более высокого значения.
  • Охват: Только включенные сессии — это A/B-тест, поэтому не все его видят.
  • Обнаружение: Если «высокие» ощущаются как «низкие», вы в тестовой группе.
  • Нет записи в журнале изменений: Изменение было сделано без какой-либо публичной документации.

Репортер, @argofowl, провел afternoon, убежденный, что его собственные инструменты сломаны, прежде чем обнаружил проблему. Он выразил разочарование непрозрачной практикой тестирования Anthropic: «черт возьми, anthropic, вы иногда невыносимы».

Ad

Анализ

Это не клиентское исправление — это серверная конфигурация, которая влияет на то, как модель интерпретирует параметры усилий. Если у вас версия 2.1.236 или новее и вы замечаете ухудшение качества вывода при установке усилий на «высокие», возможно, вы участвуете в этом эксперименте. Чтобы избежать теста, вы можете перейти на более старую версию (например, 2.1.235 или ранее) или подождать, пока Anthropic внедрит или откатит изменение. Поскольку это A/B-тест, ваш опыт может отличаться.

Для разработчиков, полагающихся на стабильное поведение ИИ-агента, такое тихое изменение вызывает беспокойство. От Anthropic пока нет официальных заявлений, и изменение не упоминается ни в одном публичном журнале изменений. Если вы затронуты, проверьте версию Claude Code и, возможно, понизьте ее для обеспечения стабильной работы.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

Slurm Coding: Искусственный интеллект в разработке, где время исчезает
Новости

Slurm Coding: Искусственный интеллект в разработке, где время исчезает

Разработчик описывает 'сламовое кодирование' как интенсивный паттерн разработки, который стал возможен благодаря инструментам ИИ-кодирования, когда небольшие идеи быстро превращаются в полноценные системы через цикл быстрой реализации и выброса дофамина.

OpenClawRadar
RTX 5080 16GB: Qwen3.6 35B MoE при 128k контексте — 56 tok/s, и почему MTP не помогает
Новости

RTX 5080 16GB: Qwen3.6 35B MoE при 128k контексте — 56 tok/s, и почему MTP не помогает

Новые бенчмарки показывают, что Qwen3.6 35B MoE на RTX 5080 16GB выдает 56 ток/с при контексте 128k. MTP (Multi-Token Prediction) замедляет работу на 23% из-за нехватки VRAM, вытесняя экспертные слои на CPU.

OpenClawRadar
Anthropic запускает программу сообщества послов Claude
Новости

Anthropic запускает программу сообщества послов Claude

Anthropic запустила программу Claude Community Ambassadors, которая предоставляет ресурсы для организации локальных встреч разработчиков и объединения создателей по всему миру. Программа открыта для участников любого происхождения и местоположения.

OpenClawRadar
Domo CDO: Остановите AI FOMO, начните с электронных таблиц
Новости

Domo CDO: Остановите AI FOMO, начните с электронных таблиц

Главный дизайнер Domo Крис Уиллис утверждает, что ИИ продаётся без технического задания, создавая театр «токенмаксинга» на основе страха. Его решение: начать с автоматизации работы с электронными таблицами, а не гнаться за недостижимыми целями.

OpenClawRadar