Claude Code carga perezosamente esquemas de herramientas mediante ToolSearch para ahorrar tokens

Un análisis de Reddit sobre el prompt del sistema de Claude Code revela que las herramientas se cargan de forma diferida para reducir el consumo de tokens. En lugar de enviar el esquema completo de cada herramienta con cada solicitud, Claude Code envía una lista de nombres de herramientas en una etiqueta <system-reminder> e instruye al modelo para que primero llame a ToolSearch para cargar el esquema de cada herramienta.
Cómo funciona
El prompt del sistema incluye una instrucción como esta:
<system-reminder> Las siguientes herramientas diferidas ya están disponibles mediante ToolSearch. Sus esquemas NO están cargados; llamarlas directamente fallará con InputValidationError. Use ToolSearch con la consulta "select:<nombre>[,<nombre>...]" para cargar los esquemas de las herramientas antes de usarlas:AskUserQuestion CronCreate CronDelete CronList EnterPlanMode EnterWorktree ExitPlanMode ExitWorktree Monitor NotebookEdit PushNotification RemoteTrigger TaskOutput TaskStop TodoWrite WebFetch WebSearch
[+ ~130 herramientas MCP (Slack, Notion, Gmail...)] </system-reminder>
El <system-reminder> se inyecta solo en el primer mensaje de usuario de la conversación. Un bloque similar lista las habilidades con descripciones de una línea.
Impacto en tokens
Según la publicación, las instrucciones del sistema más los recordatorios consumieron 38k tokens en un mensaje de prueba simple como "hola". Cargar el esquema completo de cada herramienta por adelantado aumentaría drásticamente ese consumo, de ahí el enfoque de carga diferida.
Implicaciones prácticas
Si estás desarrollando sobre Claude Code o sistemas similares basados en agentes, vale la pena adoptar este patrón:
- Difiere los esquemas de herramientas de uso poco frecuente hasta que se necesiten.
- Usa un comando similar a
ToolSearchpara solicitar explícitamente los esquemas. - Mantén los recordatorios dentro del primer mensaje para evitar repetir contexto.
Esto también significa que si estás escribiendo herramientas personalizadas para Claude Code, debes asegurarte de que el modelo pueda descubrirlas mediante ToolSearch; de lo contrario, serán invisibles o causarán errores de validación.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

AIDA: Plataforma de Código Abierto para Pruebas de Penetración Potenciadas por IA
AIDA es una plataforma de código abierto que proporciona a los agentes de IA un entorno completo de pruebas de penetración mediante conexión MCP a un contenedor Docker. La última versión reemplaza el requisito de 40GB de Exegol con un contenedor específico de 1GB que contiene herramientas de seguridad esenciales.

El Framework AutoAgents Rust Agrega Enlaces de Python para Prototipado
AutoAgents, un framework multiagente basado en Rust, ahora tiene enlaces para Python que permiten a los desarrolladores prototipar en Python mientras mantienen el mismo núcleo de ejecución en Rust, las interfaces de proveedores, el modelo de canalización y la semántica de agentes. Los enlaces permiten experimentar con modelos de IA locales sin sistemas externos.

Bit-Chat: Los Agentes de IA Pueden Enviar Bitcoin a través de Lightning Mediante Plataformas de Mensajería
Una configuración llamada Bit-Chat permite a los agentes de IA enviar pagos de Bitcoin a través de la red Lightning mediante correo electrónico, WhatsApp, Telegram o Signal. Los agentes pueden generar direcciones dedicadas como [email protected] y los pagos funcionan incluso si el receptor no está registrado.

Sherlock: Documentación de Apple Developer como MCP Local para Claude Code
Sherlock indexa 70.000 símbolos de la API de Apple en SQLite FTS5 y proporciona 5 herramientas MCP + 3 habilidades de activación automática para basar a Claude Code en documentación real, evitando alucinaciones.