Desperdicio de tokens en Claude Code: Una autoauditoría muestra que las correcciones conductuales superan al cambio de modelo

Un usuario de Reddit pasó una semana midiendo dónde iban realmente los tokens de su Claude Code, en lugar de solo quejarse de los cambios de precios de mayo. Su conclusión: la mayor parte del consumo era autoinfligido, y los cambios de comportamiento recuperaron más margen que cambiar de modelo.
Mayores logros
/clearentre tareas no relacionadas: un contexto obsoleto de 200 mil tokens arrastrado para una corrección de una línea era el hábito más costoso.- Haz que planifique antes de tocar archivos. Una pasada de planificación, luego ejecuta: más barato y mejor que explorar-editar-explorar en un bucle.
- Deja de permitir que relea archivos que acaba de tocar. Si acaba de editar un archivo, no necesita volver a abrirlo para "verificar". Dilo una vez en tus reglas.
- Busca con un subagente, no con el hilo principal. Grep-y-leer en un repositorio vierte todo el pajar en tu contexto principal de forma permanente. Un subagente devuelve solo la respuesta.
- Elimina los bucles siempre activos y
-pque no estás supervisando. Los agentes en segundo plano quemando tokens mientras duermes son la mayoría de las facturas de pesadilla.
Ninguna de estas soluciones requirió una nueva suscripción, un envoltorio o un servidor MCP. Fue disciplina que el usuario admite ser demasiado vago para aplicar mientras los límites parecían infinitos.
El mensaje reconoce que nada de esto soluciona los aumentos de precio reales; solo evita que quemes adicionalmente por encima de ellos.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Prevención de la desviación de salida en hilos largos de Claude mediante el anclaje de respuestas de alta calidad
Un usuario describe cómo las respuestas de Claude se degradan después de 30-40 mensajes, y cómo anclan la mejor respuesta intermedia para iniciar conversaciones nuevas.

¿El panel de OpenClaw se desconecta tras la actualización 2026.5.27? Solución: eliminar el trabajo launchd atascado en la actualización
Tras la actualización 2026.5.27, un trabajo de launchd atascado provoca desconexiones del WebSocket del panel y fallos en Telegram. Eliminar el trabajo restaura la estabilidad.

Capa de Gobernanza para Agentes Claude: Límites de Seguridad Estrictos y Trazas en Vivo en Producción
Un usuario de la API de Claude construyó una capa de gestión ligera debajo del agente para agregar límites de seguridad estrictos, trazas en tiempo real, control humano en el bucle a través de Telegram y checkpointing automático, resolviendo fallos silenciosos y costos de tokens descontrolados en bucles de agentes de larga duración.

Corrección de Tiempo de Espera de OpenClaw LLM para Carga de Modelo Frío
Un usuario de Reddit identificó y solucionó un problema específico de tiempo de espera en OpenClaw, donde los LLM locales cargados en frío fallaban después de unos 60 segundos, incluso con tiempos de espera generales más altos configurados. La solución implica ajustar la configuración del tiempo de espera de inactividad del LLM del ejecutor embebido.