La brevedad supera al plugin cavernícola en el benchmark de compresión de Claude Code

✍️ OpenClawRadar📅 Publicado: 30 de abril de 2026🔗 Source
La brevedad supera al plugin cavernícola en el benchmark de compresión de Claude Code
Ad

Max Taylor comparó el popular plugin de compresión 'caveman' de Claude Code con una línea base trivial: anteponer 'sé breve' a cada prompt. Los resultados son sorprendentemente planos, pero revelan dónde el plugin realmente aporta valor.

Metodología del benchmark

24 prompts en seis categorías (diagnóstico de errores, explicación de conceptos, compensaciones de arquitectura, configuración de múltiples pasos, operaciones de seguridad/destructivas, interpretación de errores). Cada prompt tenía una rúbrica con puntos clave requeridos, términos requeridos y afirmaciones prohibidas. Se probaron cinco variantes: línea base (sin instrucción), 'sé breve' y caveman en tres niveles de intensidad (lite, full, ultra). Todo se ejecutó mediante claude -p en claude-opus-4-7. Las respuestas fueron evaluadas por claude-sonnet-4-6 según la rúbrica.

Resultados de calidad

Todas las variantes obtuvieron puntuaciones dentro del 1.5% entre sí:

  • Línea base: 0.985
  • Breve: 0.985
  • Lite: 0.976
  • Full: 0.975
  • Ultra: 0.970

Todas las variantes alcanzaron el 100% de los puntos clave. No se activaron afirmaciones prohibidas en las 120 respuestas. La compresión no eliminó contenido sustancial.

Conteos de tokens

VarianteTokens promedio
Línea base636
Breve419 (34% de reducción)
Lite401
Full404
Ultra449

'Sé breve' redujo los tokens un 34% en comparación con la línea base. Caveman lite y full se acercaron a 'sé breve'. Ultra, el modo más estricto, produjo las respuestas más largas de las tres, pero el desglose por categorías cuenta una historia diferente.

Ad

El desglose por categorías revela el diseño de caveman

En diagnóstico de errores, explicación de conceptos, compensaciones de arquitectura e interpretación de errores, ultra es el más corto o está empatado. La compresión funciona como se anuncia. En configuración de múltiples pasos y advertencias de seguridad, todos los modos de caveman muestran conteos de tokens más altos. La razón: la regla de 'Auto-Claridad' de caveman deshabilita explícitamente la compresión para advertencias de seguridad, acciones irreversibles y secuencias de múltiples pasos. El escape de seguridad se activa y la compresión se detiene, por diseño.

Entonces, ¿para qué sirve realmente caveman?

Si 'sé breve' iguala en tokens y calidad, el valor del plugin es estructural:

  • Forma de salida consistente — cada respuesta sigue el mismo patrón, útil para herramientas posteriores o una experiencia de sesión uniforme.
  • Control de intensidad — comandos de barra para cambiar entre lite/full/ultra en medio de la sesión.
  • Persistencia en sesiones largas — caveman reinyecta su conjunto de reglas mediante los hooks SessionStart y UserPromptSubmit para evitar la deriva (no probado en este benchmark de una sola ejecución).

El conjunto de datos completo y el harness son de código abierto.

📖 Leer la fuente completa: HN AI Agents

Ad

👀 Ver también

Zoku: Una Herramienta que Detecta Automáticamente Flujos de Trabajo Repetidos en Código Claude
Herramientas

Zoku: Una Herramienta que Detecta Automáticamente Flujos de Trabajo Repetidos en Código Claude

Zoku es una herramienta local que se conecta al sistema de eventos de Claude Code para registrar acciones de herramientas a través de sesiones, identifica patrones repetidos de flujo de trabajo y luego informa a Claude sobre estos patrones para que pueda sugerirlos o ejecutarlos proactivamente. No requiere configuración, no tiene dependencias y almacena todo localmente en ~/.zoku/.

OpenClawRadar
RelayCode Extensión de VS Code Enruta el Código de Claude a Través de RDUs Soberanos
Herramientas

RelayCode Extensión de VS Code Enruta el Código de Claude a Través de RDUs Soberanos

OpenGPU ha lanzado RelayCode, una extensión de VS Code que actúa como un proxy local para redirigir solicitudes de Claude Code o Copilot a través de su red descentralizada hacia modelos de código abierto como DeepSeek-R1 y MiniMax M2.5, ejecutándose en unidades de flujo de datos reconfigurables soberanas.

OpenClawRadar
Vibe Remote: Puente Móvil para Acceder al Código de Claude desde Cualquier Lugar
Herramientas

Vibe Remote: Puente Móvil para Acceder al Código de Claude desde Cualquier Lugar

Vibe Remote es una aplicación móvil que proporciona acceso remoto a entornos de desarrollo de Claude Code desde un teléfono, permitiendo a los usuarios mantener sus configuraciones locales, historial de Git y estructura de archivos sin requerir Tailscale o configuraciones complejas de VPN.

OpenClawRadar
Alfred Beta se Lanza: Alternativa Simplificada de OpenClaw para Usuarios No Técnicos
Herramientas

Alfred Beta se Lanza: Alternativa Simplificada de OpenClaw para Usuarios No Técnicos

Alfred es una nueva herramienta en fase beta que proporciona aproximadamente el 70% de la funcionalidad de OpenClaw con una complejidad significativamente reducida, ofreciendo configuraciones predeterminadas simples para conexiones de aplicaciones, memoria, modos de uso e infraestructura, al tiempo que permite personalizaciones.

OpenClawRadar