Claude Code carga perezosamente esquemas de herramientas mediante ToolSearch para ahorrar tokens

Un análisis de Reddit sobre el prompt del sistema de Claude Code revela que las herramientas se cargan de forma diferida para reducir el consumo de tokens. En lugar de enviar el esquema completo de cada herramienta con cada solicitud, Claude Code envía una lista de nombres de herramientas en una etiqueta <system-reminder> e instruye al modelo para que primero llame a ToolSearch para cargar el esquema de cada herramienta.
Cómo funciona
El prompt del sistema incluye una instrucción como esta:
<system-reminder> Las siguientes herramientas diferidas ya están disponibles mediante ToolSearch. Sus esquemas NO están cargados; llamarlas directamente fallará con InputValidationError. Use ToolSearch con la consulta "select:<nombre>[,<nombre>...]" para cargar los esquemas de las herramientas antes de usarlas:AskUserQuestion CronCreate CronDelete CronList EnterPlanMode EnterWorktree ExitPlanMode ExitWorktree Monitor NotebookEdit PushNotification RemoteTrigger TaskOutput TaskStop TodoWrite WebFetch WebSearch
[+ ~130 herramientas MCP (Slack, Notion, Gmail...)] </system-reminder>
El <system-reminder> se inyecta solo en el primer mensaje de usuario de la conversación. Un bloque similar lista las habilidades con descripciones de una línea.
Impacto en tokens
Según la publicación, las instrucciones del sistema más los recordatorios consumieron 38k tokens en un mensaje de prueba simple como "hola". Cargar el esquema completo de cada herramienta por adelantado aumentaría drásticamente ese consumo, de ahí el enfoque de carga diferida.
Implicaciones prácticas
Si estás desarrollando sobre Claude Code o sistemas similares basados en agentes, vale la pena adoptar este patrón:
- Difiere los esquemas de herramientas de uso poco frecuente hasta que se necesiten.
- Usa un comando similar a
ToolSearchpara solicitar explícitamente los esquemas. - Mantén los recordatorios dentro del primer mensaje para evitar repetir contexto.
Esto también significa que si estás escribiendo herramientas personalizadas para Claude Code, debes asegurarte de que el modelo pueda descubrirlas mediante ToolSearch; de lo contrario, serán invisibles o causarán errores de validación.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

El cuello de botella en los agentes paralelos de IA: la cola de aprobación humana se estrangula a sí misma
Un desarrollador que ejecuta agentes de Claude Code en paralelo describe el 'bottleself' — el punto en que el paralelismo deja de aumentar la producción y comienza a crear un acumulado de aprobaciones humanas. Su solución: un planificador que descompone objetivos en subtareas, genera agentes y solo notifica cuando hay decisiones no resueltas.

PeaDB: Base de Datos Compatible con Redis Desarrollada con Asistentes de IA en C++20
Un desarrollador creó PeaDB, un reemplazo directo de Redis 7.2.5 escrito en C++20 usando Codex, Copilot y Claude, implementando ~147 comandos con persistencia, replicación y soporte de clúster. Los benchmarks muestran un rendimiento cercano a Redis.

Nelson v2.2.3 Publicado: Coordinación Multiagente para Claude Code, más un Benchmark de Simulación de Eventos Discretos
Nelson v2.2.3 incluye una habilidad de coordinación multiagente para Claude Code que utiliza una metáfora naval. Un benchmark de 13 configuraciones muestra que opus-4-7 con razonamiento domina; la elección de habilidad representa un delta menor.

Arranqué la memoria markdown predeterminada de OpenClaw y construí una capa de API con Node.js/Postgres
Un desarrollador desactivó el plugin 'memory-core' de OpenClaw y construyó un backend tipado con Node.js/Express + PostgreSQL. La deriva de contexto se redujo a cero.