Параллельные субагенты в Claude Code: когда они экономят токены, а когда сжигают

Цифры Anthropic часто игнорируются в шумихе вокруг «используйте под-агентов!»: системы с несколькими агентами потребляют примерно в 15 раз больше токенов, чем один чат, и они «менее эффективны для тесно взаимосвязанных задач, таких как программирование» (источник). Однако кэшированные токены стоят всего 10% от обычной цены (скидка 90%), но только если содержимое, помеченное для кэширования, одинаково во всех запросах (источник).
Мульти-агент увеличивает использование токенов в 15 раз. Кэш делит это на 10. Окупаются ли под-агенты или сжигают деньги, сводится к одному: все ли под-агенты используют один и тот же префикс?
Три способа делегирования, отсортированные по стоимости
- 1. Под-агент с заданным
subagent_type. Пользовательский системный промпт, пользовательские инструменты, пользовательские разрешения (Anthropic). Другой промпт = другой кэш. Нет общего кэша с родителем. Полная цена каждый раз. Используйте, когда действительно нужна изоляция. - 2. Клон, наследующий родителя. Без
subagent_type. Наследует промпт, инструменты и историю родителя в точности. Дочерние агенты 2..N попадают в кэш по цене 10%. Пять клонов, параллельно читающих файлы, ≈ скорость в 5 раз при стоимости ~1.5×. - 3. Без под-агентов. Оставайтесь в основном агенте. Дешевле всего за один шаг. Правильный ответ, когда работа зависит от самой себя — рефакторинг, где шаг 2 требует результата шага 1.
Когда НЕ нужно делегировать (собственная линия Anthropic)
«Лучше всего подходит для задач, которые можно разделить на параллельные направления исследования.» Перевод:
- Хорошо: прочитать 7 файлов параллельно, проверить папки на шаблон, собрать информацию из многих источников.
- Плохо: рефакторинг модуля, исправление ошибки, где каждый шаг зависит от предыдущего. Только основной агент.
Если вы разделяете тесно связанную работу на под-агентов, вы платите в 15 раз больше и ничего не выигрываете.
Что ломает кэш
Anthropic: редактирование определений инструментов, смена моделей, добавление или удаление изображений, изменение структуры предыдущего промпта ломает кэшированный префикс (источник). Так что:
- Устанавливайте ваши MCP в начале сессии, а не в середине.
- Выбирайте модель заранее.
- Не редактируйте
CLAUDE.mdили авто-память в середине сессии — они находятся внутри кэшированного префикса.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Самодельный слой памяти для Claude бесплатно работает на Cloudflare
MCP-сервер Cloudflare Worker позволяет Клоду запоминать и извлекать заметки с помощью семантического поиска, используя Workers AI и Vectorize — все на бесплатном тарифе.

Mneme: бесплатный локальный клиент чата Claude с постоянной памятью
Mneme — это бесплатный, открытый, локальный чат-клиент для Claude с многоуровневой памятью, отслеживанием сущностей, ежедневными сводками и поддержкой Sonnet 4.5 через Anthropic API.

ClaudeHive: Веб-интерфейс для управления параллельными сессиями кода Claude
ClaudeHive — это веб-интерфейс, который управляет параллельными сессиями Claude Code, позволяя пользователям создавать шаблоны промптов с заполнителями, запускать их пакетно на нескольких входах с настраиваемой параллельностью и просматривать все результаты в одном месте. Он включает CLI-инструмент для агентов-менеджеров, чтобы запускать и координировать агентов-исполнителей.

Мышь: Координатное редактирование поэтапных изменений и атомарный откат для AI-агентов кодирования
Mouse заменяет строковую замену шестью координатными операциями (INSERT, DELETE, ADJUST) и поэтапными изменениями с атомарным откатом для AI-агентов.