Pasando de las reglas de CLAUDE.md a la aplicación de infraestructura con Citadel

El problema con la acumulación de reglas
Cuando Claude ignoraba las instrucciones, el instinto era agregar más reglas a CLAUDE.md. Comenzando con 45 líneas, creció a 190 líneas en tres meses, pero el cumplimiento empeoró. Las instrucciones más allá de la línea 100 comenzaron a tratarse como sugerencias en lugar de reglas. Una auditoría forense reveló un 40% de redundancia: reglas que decían lo mismo con palabras diferentes, reglas que se contradecían entre sí y reglas obsoletas. Recortar a 123 líneas mejoró el cumplimiento inmediatamente.
El cambio hacia la infraestructura
La solución real fue reconocer que CLAUDE.md es un punto de entrada para la orientación (convenciones del proyecto, pila tecnológica, prioridades clave), no un hogar permanente para todas las reglas. Todo lo demás debería cargarse solo cuando sea necesario. El cambio clave: trasladar la aplicación de las reglas de las instrucciones al entorno.
Por ejemplo, en lugar de una regla que diga "ejecuta siempre la verificación de tipos después de editar un archivo", que Claude seguía de manera inconsistente, un script de gancho del ciclo de vida se ejecuta automáticamente en cada guardado de archivo. Esto asegura que la verificación de tipos ocurra sin que el agente tenga que decidir, mostrando los errores inmediatamente en lugar de 20 ediciones después. Esto redujo drásticamente el tiempo de revisión, permitiendo enfocarse en la intención y el diseño en lugar de perseguir errores de tipo.
El sistema de progresión
El autor describe una progresión de cinco niveles:
- Nivel 1: Solicitudes en bruto (nada persiste, los mismos errores se repiten)
- Nivel 2: CLAUDE.md (las reglas ayudan pero alcanzan un límite alrededor de 100 líneas)
- Nivel 3: Habilidades (experiencia modular que se carga bajo demanda, cero tokens cuando está inactiva)
- Nivel 4: Ganchos (el entorno aplica la calidad, no las instrucciones)
- Nivel 5: Orquestación (agentes paralelos, campañas persistentes, oleadas coordinadas)
La mayoría de los proyectos están bien en el Nivel 2 o 3. La idea crítica: cuando CLAUDE.md deja de funcionar, la respuesta no es agregar más reglas, sino trasladar la aplicación a la infraestructura.
Implementaciones específicas
El autor implementó tres sistemas clave:
- Habilidades: Archivos Markdown que codifican patrones, restricciones y ejemplos para dominios específicos. El agente carga las habilidades relevantes para la tarea actual, evitando el desperdicio de tokens en contexto irrelevante.
- Archivos de campaña: Documentos estructurados que rastrean lo que se construyó, las decisiones tomadas y lo que queda. Estos persisten entre sesiones, eliminando las reexplicaciones diarias.
- Ganchos automatizados: Verificación de tipos en cada edición, escaneo de antipatrones al final de la sesión, interruptor de circuito que termina el agente después de 3 fallos repetidos en el mismo problema, y protección de compactación que guarda el estado antes de que Claude comprima el contexto.
Citadel: El sistema de código abierto
El sistema completo, llamado Citadel, se ha publicado como código abierto en https://github.com/SethGammon/Citadel. Incluye el sistema de habilidades, ganchos, persistencia de campañas y un comando /do que enruta las tareas al nivel de orquestación correcto automáticamente. Construido a partir de 27 fallos documentados en 198 agentes en una base de código de 668K líneas, cada regla se remonta a algo que se rompió.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Claudebin: Exporta y Comparte Tus Sesiones de Código de Claude
Claudebin te permite exportar sesiones completas de Claude Code, haciéndolas compartibles y reanudables a través de una única URL.

Desarrollo Guiado por Manual: Un Método para Prevenir la Divergencia Confiada del Código de Claude
El Desarrollo Guiado Manual (MDD) es un método que aborda la divergencia confiada en Claude Code, donde la IA produce código incorrecto que pasa sus propias pruebas. En una auditoría de producción, MDD encontró 190 problemas, escribió 876 pruebas nuevas en menos de 8 horas y eliminó violaciones de reglas.

MemAware Benchmark Prueba la Memoria de la IA Más Allá de la Búsqueda por Palabras Clave
MemAware es un punto de referencia con 900 preguntas en 3 niveles de dificultad que evalúa si los asistentes de IA con memoria pueden recuperar contexto relevante cuando las consultas no lo sugieren. Los resultados muestran que la búsqueda BM25 obtuvo un 2,8 % frente al 0,8 % sin memoria, mientras que la búsqueda vectorial cae al 0,7 % en conexiones entre dominios.

Extensión OpenClaw Claude Actualizada para Usar el SDK de Agente Tras Cambios en la Facturación de Anthropic
Un desarrollador de extensiones de OpenClaw reescribió su integración CLI de Claude para usar el claude-agent-sdk oficial después de que Anthropic comenzara a detectar y reclasificar el uso de CLI como uso de aplicaciones de terceros, lo que factura contra un grupo de créditos separado en lugar de los límites del plan Max. El enfoque del SDK se autentica a través del inicio de sesión existente de Claude Code y factura como uso regular del plan Max.