Agentes Subalternos Paralelos en Claude Code: Cuándo Ahorran vs. Queman Tokens

Los números de Anthropic a menudo se ignoran en el hype de "¡usa subagentes!": los sistemas multiagente consumen aproximadamente 15× más tokens que un solo chat, y son "menos efectivos para tareas estrechamente interdependientes como la programación" (fuente). Sin embargo, los tokens almacenados en caché cuestan solo 10% de lo normal (90% de descuento), pero solo si el contenido marcado para caché es idéntico entre solicitudes (fuente).
Los multiagentes multiplican el uso de tokens por 15. El caché lo divide por 10. Si los subagentes ahorran o queman dinero se reduce a una cosa: ¿comparten todos los subagentes el mismo prefijo?
Tres formas de delegar, ordenadas por costo
- 1. Subagente con
subagent_typeconfigurado. Prompt de sistema personalizado, herramientas personalizadas, permisos personalizados (Anthropic). Prompt diferente = caché diferente. Sin compartir con el padre. Precio completo en cada creación. Úsalo cuando realmente necesites aislamiento. - 2. Clone que hereda del padre. Sin
subagent_type. Hereda el prompt, las herramientas y el historial del padre exactamente. Los clones 2..N aciertan en la caché al 10% del precio. Cinco clones leyendo archivos en paralelo ≈ 5× de velocidad a ~1.5× de costo. - 3. Sin subagente. Quédate en el agente principal. Más barato por turno. Respuesta correcta cuando el trabajo depende de sí mismo: refactorizaciones donde el paso 2 necesita el resultado del paso 1.
Cuándo NO delegar (la propia línea de Anthropic)
"Mejor para tareas que se pueden dividir en líneas paralelas de investigación." Traducción:
- Bueno: leer 7 archivos en paralelo, auditar carpetas en busca de un patrón, recopilar información de muchas fuentes.
- Malo: refactorizar un módulo, corregir un error donde cada paso depende del anterior. Solo agente principal.
Si divides trabajo estrechamente acoplado en subagentes, pagas 15× y no ganas nada.
Qué rompe la caché
Anthropic: editar definiciones de herramientas, cambiar de modelo, añadir o eliminar imágenes, o cambiar la estructura anterior del prompt rompe el prefijo en caché (fuente). Así que:
- Instala tus MCPs al inicio de la sesión, no a mitad de sesión.
- Elige el modelo de antemano.
- No edites
CLAUDE.mdni la memoria automática a mitad de sesión: viven dentro del prefijo en caché.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

sandboxd: Herramienta de Código Abierto para Ejecutar Múltiples Agentes de Claude Code en Contenedores Aislados
sandboxd es una herramienta de código abierto (MIT) que ejecuta cada proyecto de Claude Code en su propio contenedor Docker con espacio de trabajo aislado, sesión de Claude Code y URL de vista previa. Admite agentes paralelos, suspensión automática y mantiene las claves API fuera de los contenedores.

Lumyr: Generación de Dashboard mediante Claude con Automatización en Python y Streamlit
Lumyr es una herramienta que genera paneles de control en vivo y compartibles a partir de descripciones en inglés sencillo, utilizando Claude para la generación de paneles y automatizando la capa de Python y Streamlit. Los usuarios no necesitan escribir Python, abrir Streamlit, desplegar, configurar alojamiento ni gestionar infraestructura.

Integrando Agentes LLM Locales con ComfyUI para la Generación de Imágenes por Lotes en Lenguaje Natural
Un desarrollador comparte cómo conectó su agente local de OpenClaw a ComfyUI, permitiendo comandos en lenguaje natural para flujos de trabajo de generación de imágenes por lotes. La integración utiliza una habilidad personalizada del agente que mapea solicitudes en inglés a JSON de flujo de trabajo de ComfyUI y maneja la comunicación API.

ClaudeHive: Interfaz Web para Gestionar Sesiones Paralelas de Código Claude
ClaudeHive es una interfaz web que maneja sesiones paralelas de Claude Code, permitiendo a los usuarios definir plantillas de prompts con marcadores de posición, ejecutarlas en lote a través de múltiples entradas con concurrencia configurable y revisar todos los resultados en un solo lugar. Incluye una herramienta CLI para que los agentes gestores generen y coordinen agentes trabajadores.