Agentes Subordinados Paralelos no Claude Code: Quando Eles Economizam vs. Queimam Tokens

Os números da Anthropic frequentemente ignorados no hype "use subagentes!": sistemas multiagente consomem cerca de 15× mais tokens que um chat único e são "menos eficazes para tarefas rigidamente interdependentes, como codificação" (fonte). No entanto, tokens em cache custam apenas 10% do normal (90% de desconto) — mas apenas se o conteúdo sinalizado para cache for idêntico entre as requisições (fonte).
Multiagente multiplica o uso de tokens por 15. O cache divide por 10. Se subagentes economizam ou queimam dinheiro depende de uma coisa: todos os subagentes compartilham o mesmo prefixo?
Três Formas de Delegar, Ordenadas por Custo
- 1. Subagente com
subagent_typedefinido. Prompt de sistema personalizado, ferramentas personalizadas, permissões personalizadas (Anthropic). Prompt diferente = cache diferente. Sem compartilhamento com o pai. Preço total a cada criação. Use quando precisar de isolamento. - 2. Clone que herda do pai. Sem
subagent_type. Herda exatamente o prompt, ferramentas e histórico do pai. Filhos 2..N acessam o cache a 10% do preço. Cinco clones lendo arquivos em paralelo ≈ 5× velocidade a ~1,5× custo. - 3. Sem subagente. Permaneça no agente principal. Mais barato por turno. Resposta certa quando o trabalho depende de si mesmo — refatorações onde o passo 2 precisa do resultado do passo 1.
Quando NÃO Delegar (a Própria Linha da Anthropic)
"Melhor para tarefas que podem ser divididas em vertentes paralelas de pesquisa." Tradução:
- Bom: ler 7 arquivos em paralelo, auditar pastas por um padrão, coletar informações de várias fontes.
- Ruim: refatorar um módulo, corrigir um bug onde cada etapa depende da anterior. Apenas agente principal.
Se você dividir trabalho fortemente acoplado em subagentes, paga 15× e não ganha nada.
O que Quebra o Cache
Anthropic: editar definições de ferramentas, trocar de modelos, adicionar ou remover imagens, ou alterar a estrutura anterior do prompt quebra o prefixo em cache (fonte). Então:
- Instale seus MCPs no início da sessão, não no meio.
- Escolha o modelo de antemão.
- Não edite
CLAUDE.mdou memória automática no meio da sessão — eles vivem dentro do prefixo em cache.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Sylve: Um Plano de Gerenciamento FreeBSD para Virtualização, Contêineres e Armazenamento
Sylve é um plano de gerenciamento licenciado BSD-2 para FreeBSD que fornece controle unificado sobre máquinas virtuais Bhyve, FreeBSD Jails, armazenamento ZFS e rede. Ele usa um modelo de consenso RAFT para clustering e inclui gerenciamento de compartilhamentos Samba com automação de snapshots ZFS.

ClankerRank: Um Benchmark para Habilidades de Codificação Assistida por IA com Claude Haiku
Um desenvolvedor criou o ClankerRank para medir a proficiência em programação assistida por IA usando o modelo Haiku 4.5 do Claude. A plataforma apresenta bugs idênticos aos usuários, pontua as saídas com suítes de testes ocultas e revelou lacunas claras de habilidade entre centenas de participantes.

A ferramenta Squeez comprime a saída do bash em mais de 90% para estender a janela de contexto do Claude Code
Squeez é um hook que comprime automaticamente a saída bruta do bash como ps aux, logs do docker e log do git antes de chegar ao Claude Code. Ele reduz o uso de tokens em 92,8% em média em 19 comandos comuns, ajudando as sessões a durarem mais tempo.

Claude Agent Teams UI: Aplicativo de Desktop para Visualização de Fluxos de Trabalho de Agentes de Código Claude
Um desenvolvedor criou um aplicativo de desktop gratuito e de código aberto que adiciona uma camada visual ao recurso experimental Agent Teams do Claude Code. O aplicativo fornece um quadro kanban em tempo real onde as tarefas se movem automaticamente conforme os agentes trabalham, além de comunicação entre equipes, fluxos de trabalho de revisão integrados e revisão de código por tarefa.