Предложение по адаптивному маршрутизированию вывода для повышения эффективности обработки AI-запросов

Что это такое
Техническое предложение, представленное команде по продуктам и разработке Anthropic в апреле 2026 года, для автоматической маршрутизации запросов ИИ к соответствующим уровням моделей на основе оценки сложности до начала дорогостоящих вычислений.
Проблема
В настоящее время каждый запрос, отправленный Claude — от простых вопросов вроде «сколько варить яйцо» до технических промптов на 2000 слов — по умолчанию направляется к модели с полными возможностями. Система не оценивает сложность до выделения вычислительных ресурсов, что неэффективно в масштабе. Вывод ИИ — самый быстрорастущий компонент энергопотребления дата-центров, прогнозируется, что к 2028 году он достигнет 12% от потребления электроэнергии в США.
Предлагаемое решение: пятиэтапный процесс
- Шаг 1 — Подсчёт: Измерение длины запроса в символах, количества предложений и наличия вложений или многосоставных инструкций
- Шаг 2 — Сортировка: Маршрутизация к уровню модели на основе оценки сложности. Одиночные короткие предложения по умолчанию направляются к облегчённым моделям; многоабзацные промпты с контекстом направляются к более мощным моделям
- Шаг 3 — Чтение: Назначенная модель обрабатывает запрос в обычном режиме
- Шаг 4 — Ответ: Ответ возвращается пользователю
- Шаг 5 — Эскалация: Если пользователь сигнализирует о неудовлетворённости (возражает, просит углубиться, переформулирует), система автоматически переключается на более мощную модель для последующих запросов
Как работает оценка сложности
Система использует пятифакторную оценку предварительной маршрутизации: количество символов, количество предложений, наличие вложений, плотность вопросительных слов и глубина предыдущего диалога. Это позволит правильно отсортировать значительную часть запросов без какого-либо вывода модели вообще. Длина в символах работает как сигнал первого порядка, потому что большинство простых запросов короткие, а большинство сложных — длинные.
Дизайн пользовательского опыта
Пользователи не должны видеть эту систему или выбирать модель. Интерфейс остаётся идентичным, а маршрутизация невидима. Если ответ недостаточен, пользователи просят больше и получают больше. Это устраняет трение, связанное с просьбой к нетехническим пользователям выбирать между уровнями моделей, такими как Haiku, Sonnet и Opus.
Влияние и обоснование
В масштабах Anthropic даже сокращение средних вычислений на запрос на 20–30% означает значительное снижение стоимости вывода и энергетической нагрузки. Предложение ставит Anthropic впереди регуляторных и PR-вызовов, связанных с энергопотреблением дата-центров, которое становится законодательной проблемой в нескольких юрисдикциях.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Незадокументированная ошибка обнаружена в коде бортового компьютера Apollo 11 с использованием искусственного интеллекта и языка спецификаций.
Исследователи обнаружили ошибку блокировки ресурса в коде управления гироскопом компьютера Apollo Guidance, которая оставалась незамеченной в течение 57 лет, используя ИИ Claude и язык спецификаций Allium для анализа 130 000 строк ассемблерного кода.

Модель искусственного интеллекта Xiaomi MiMo-V2-Pro доступна бесплатно на OpenRouter в течение 7 дней.
AI-модель MiMo-V2-Pro от Xiaomi доступна с бесплатным доступом к API на OpenRouter в течение 7 дней. Модель обладает контекстным окном в 1 миллион токенов, и тесты показывают, что она конкурирует с Claude Opus 4.6 и приближается к производительности GPT-5.2.

Обучение GPT-1 на RTX 2060 Super 8GB – подтверждение концепции локального предварительного обучения
Разработчик обучил оригинальный GPT-1 (117M параметров) на локальной RTX 2060 Super с 8GB VRAM за 1 час, доказав, что любой обладатель игровой видеокарты может предобучить модель размером до 1B. Код и веса открыты.

ChatGPT Workspace Agents: бесплатный предпросмотр завершается сегодня — сравнение с OpenClaw и Hermes
Бесплатная предварительная версия ChatGPT Workspace Agents от OpenAI завершается 6 мая, после чего будет введена кредитная система оплаты. В посте на Reddit проводится сравнение с OpenClaw, Hermes и управляемыми платформами, такими как BetterClaw, для командного и личного использования.