Resultados de la Prueba A/B: Los Hooks de oh-my-claudecode Muestran un Impacto Mínimo en el Rendimiento de Claude Code

Configuración y Metodología del Experimento
Un desarrollador realizó una prueba A/B sencilla para evaluar el impacto de los ganchos dinámicos de oh-my-claudecode en el rendimiento de Claude Code. El experimento utilizó Claude Sonnet 4.6 con la misma tarea de programación ejecutada seis veces en total: tres ejecuciones con los ganchos OMC ACTIVADOS y tres ejecuciones con los ganchos OMC DESACTIVADOS. Todas las ejecuciones utilizaron los mismos mensajes, flujo de sesión y entorno de máquina.
La tarea consistió en construir un editor Markdown desde cero en una sola sesión continua, implementando la aplicación, escribiendo y ejecutando pruebas, luego revisando y corrigiendo errores, problemas de seguridad y accesibilidad antes de ejecutar las pruebas nuevamente. El objetivo no era producir código perfecto, sino medir si los ganchos cambiaban el comportamiento de Claude de manera significativa.
Resultados Clave
- Calidad del código: Puntuaciones idénticas (15.0/20 tanto para DESACTIVADO como ACTIVADO)
- Costo total: Literalmente el mismo ($5.56 para ambas condiciones)
- Tokens totales: Ligeramente más bajo con ganchos ACTIVADOS (6.48M vs 6.76M DESACTIVADO)
- Tiempo real: Los ganchos ACTIVADOS fueron más rápidos en promedio (1,673s vs 2,152s DESACTIVADO)
- Llamadas a herramientas: Ligeramente menos con ganchos ACTIVADOS (37.0 vs 40.7 DESACTIVADO)
Observaciones Notables
El gancho SessionStart aumentó significativamente los tokens de lectura de caché en el primer mensaje: 424K con ganchos ACTIVADOS versus 195K con ganchos DESACTIVADOS (un aumento del 117%). Sin embargo, este contexto adicional no se tradujo en una mejor salida para esta tarea en particular. Curiosamente, para el Mensaje 3, los ganchos DESACTIVADOS realmente utilizaron más lecturas de caché que los ganchos ACTIVADOS.
El repositorio del experimento está disponible en https://github.com/ej31/omc-hook-experiment.
Conclusiones del Desarrollador
El desarrollador concluyó que los ganchos dinámicos no son un "botón mágico de mejor código" para tareas de programación de sesión única, ya que Claude ya funciona bien con instrucciones estáticas. Cualquier beneficio relacionado con los ganchos parece lo suficientemente pequeño como para quedar ahogado por la variación normal entre ejecuciones. La mayor sobrecarga constante podría provenir realmente de la huella estática de OMC—definiciones de herramientas MCP, habilidades, catálogo de agentes—en lugar de solo del comportamiento dinámico de los ganchos.
Es importante destacar que este experimento solo probó el comportamiento de los ganchos, no si el ecosistema más amplio de OMC es útil en flujos de trabajo más grandes y de múltiples sesiones. El desarrollador planea realizar más pruebas eliminando oh-my-claudecode por completo y haciendo que Claude construya un juego de Snake desde cero.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Steelman R5: El Modelo Ajustado de 14B Supera a Claude Opus en la Generación de Código Ada
Un desarrollador ajustó Qwen2.5-Coder-14B-Instruct usando QLoRA en un conjunto de datos verificado por compilador de 3,430 pares de instrucciones Ada/SPARK, logrando una tasa de compilación del 68.6% en una evaluación personalizada frente al 42.1% de Claude Opus 4.6. El modelo está disponible a través de Ollama y cabe en 12GB de VRAM.

Construyendo una Infraestructura de Conocimiento de IA Persistente con OpenClaw
Un desarrollador creó 'Brain', un servicio central de conocimiento con RAG local, coordinación multiagente y un sistema de plugins tipado, para resolver el problema de falta de estado en configuraciones de IA. El sistema funciona completamente en hardware local usando Ollama, Postgres, MongoDB, Qdrant y Memgraph.

Gestión del contexto de IA con una tienda de conocimiento SQLite y herramientas MCP
Un desarrollador creó RunawayContext, un sistema con licencia MIT que almacena lecciones de proyectos en SQLite con FTS5 y sqlite-vec opcional, manteniendo el contexto por sesión por debajo de 3K tokens gracias a herramientas de consulta MCP y límites fijos en el código.

Análisis de Codeflash: 118 Errores de Rendimiento Encontrados en Dos PRs Escritos con Claude Code
Codeflash midió el rendimiento de dos características principales construidas con Claude Code y encontró 118 funciones ejecutándose hasta 446 veces más lento de lo necesario. El análisis reveló patrones de algoritmos ineficientes, cómputo redundante, falta de caché y estructuras de datos subóptimas.