CLAUDE.md: El archivo de reemplazo reduce los tokens de salida de Claude en un 63%

Qué hace CLAUDE.md
CLAUDE.md es un archivo único que colocas en la raíz de tu proyecto. Cuando Claude Code lo lee, el comportamiento cambia inmediatamente sin modificaciones de código. Se enfoca específicamente en el comportamiento de salida: adulación, verbosidad y ruido de formato.
El problema que aborda
Por defecto, Claude desperdicia tokens en comportamientos que no agregan valor:
- Inicia respuestas con "¡Claro!", "¡Excelente pregunta!", "¡Absolutamente!"
- Termina con "¡Espero que esto ayude! ¡Avísame si necesitas algo!"
- Usa guiones largos (--), comillas inteligentes, caracteres Unicode que rompen analizadores
- Replantea tu pregunta antes de responder
- Añade sugerencias no solicitadas más allá de lo que pediste
- Sobre-ingenieriza código con abstracciones innecesarias
- Está de acuerdo con afirmaciones incorrectas ("¡Tienes toda la razón!")
Resultados de referencia
Las mismas 5 consultas probadas sin CLAUDE.md (línea base) y con CLAUDE.md (optimizado):
- Explicar async/await: 180 palabras → 65 palabras (reducción del 64%)
- Revisión de código: 120 palabras → 30 palabras (reducción del 75%)
- Qué es una API REST: 110 palabras → 55 palabras (reducción del 50%)
- Corrección de alucinación: 55 palabras → 20 palabras (reducción del 64%)
- Total: 465 palabras → 170 palabras (reducción del 63%)
Aproximadamente 384 tokens de salida ahorrados por cada 4 consultas. Nota: Esto es un indicador direccional de 5 consultas, no un estudio estadísticamente controlado.
Cuándo ayuda vs. cuándo no
Funciona mejor para:
- Canalizaciones de automatización con alto volumen de salida (bots de currículum, bucles de agentes, generación de código)
- Tareas estructuradas repetidas donde la verbosidad predeterminada de Claude se acumula en cientos de llamadas
- Equipos que necesitan formato de salida consistente y analizable entre sesiones
No vale la pena para:
- Consultas únicas cortas (el archivo se carga en contexto en cada mensaje, causando aumento neto de tokens en intercambios de baja salida)
- Uso casual ocasional (la sobrecarga no se compensa con bajo volumen)
- Corregir modos de fallo profundos como implementaciones alucinadas o deriva arquitectónica
- Canalizaciones que usan múltiples sesiones nuevas por tarea
- Fiabilidad del analizador a escala (usa salidas estructuradas como modo JSON en su lugar)
- Trabajo exploratorio o arquitectónico donde el debate y las alternativas son el objetivo
Consideraciones de costo
El archivo CLAUDE.md en sí consume tokens de entrada en cada mensaje. Los ahorros provienen de tokens de salida reducidos. El beneficio neto es positivo solo cuando el volumen de salida es lo suficientemente alto para compensar el costo persistente de entrada. Con bajo uso, cuesta más de lo que ahorra.
Soporte de modelos
Las referencias se ejecutaron solo en Claude. Las reglas son independientes del modelo y deberían funcionar en cualquier modelo que lea contexto, pero los resultados en modelos locales como llama.cpp, Mistral u otros no están probados.
📖 Read the full source: HN AI Agents
👀 Ver también

Forge: un IDE basado en Claude con verificación automatizada y ADN de proyecto.
Forge es un IDE basado en Claude construido sobre VS Code que ejecuta automáticamente verificaciones de tipos, pruebas, comprobaciones de cobertura y validación de importaciones antes de mostrar el código. Incluye bucles de autocorrección para verificaciones fallidas y construye un ADN del Proyecto de los patrones de tu base de código.

GlycemicGPT: Monitor de Diabetes AI Autohospedado con BYOAI y SDK de Plugins
GlycemicGPT es una plataforma de código abierto y autoalojada que conecta monitores Dexcom G7 y bombas Tandem con una capa de análisis de IA. Ofrece resúmenes diarios, análisis de comidas, chat conversacional y alertas configurables, todo en tu propio hardware.

nervx: Herramienta CLI reduce el uso de tokens de Claude Code analizando la estructura del código base
nervx es una herramienta CLI instalable mediante pip que analiza repositorios con tree-sitter, construye un grafo SQLite de funciones e importaciones, y genera un mapa estructural NERVX.md. Automáticamente agrega instrucciones a CLAUDE.md que enseñan a Claude a usar la navegación de nervx, reduciendo las búsquedas grep en un 65% y los tokens de salida en un 48% en las pruebas.

Asesor de IA persistente con memoria multiplataforma: realiza un seguimiento del historial de decisiones durante 3 meses
Un usuario de Reddit creó un asesor de IA persistente que recuerda cada decisión de producto en Claude Code, Cursor y una interfaz web, detectando contradicciones y mejorando con el paso de los meses.