Hombre de las cavernas vs. instrucción 'sé breve': comparación de indicaciones de compresión para Claude

✍️ OpenClawRadar📅 Publicado: 29 de abril de 2026🔗 Source
Hombre de las cavernas vs. instrucción 'sé breve': comparación de indicaciones de compresión para Claude
Ad

Un desarrollador comparó caveman (el popular prompt de compresión abreviada) con el prompt simple 'sé breve.' para ver si la complejidad adicional realmente vale la pena. La prueba ejecutó 24 prompts de desarrollo en 6 categorías, comparando 5 brazos: línea base, 'sé breve.', caveman ligero, caveman completo y caveman ultra. Las salidas fueron evaluadas por una instancia separada de Claude usando rúbricas por prompt.

Ad

Resultados del benchmark

  • Línea base: puntuación media 0.985, tokens medios 636
  • 'sé breve.': puntuación media 0.985, tokens medios 419
  • Caveman ligero: puntuación media 0.976, tokens medios 401
  • Caveman completo: puntuación media 0.975, tokens medios 404
  • Caveman ultra: puntuación media 0.970, tokens medios 449

La versión de dos palabras igualó a caveman tanto en compresión como en calidad. Sin embargo, el valor de caveman radica en otros aspectos: estructura de salida consistente, cambio de modo y el escape de seguridad en operaciones destructivas. El escape de seguridad introdujo una varianza significativa en la calidad de salida, lo que puede ser una preocupación para ciertos casos de uso.

El desglose completo con datos por categoría y hallazgos de varianza en preguntas de seguridad está disponible en el sitio del autor. El arnés de benchmark es de código abierto en GitHub.

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

Andrej Karpathy se une al equipo de pre-entrenamiento de Anthropic para impulsar la auto-mejora recursiva usando Claude
Noticias

Andrej Karpathy se une al equipo de pre-entrenamiento de Anthropic para impulsar la auto-mejora recursiva usando Claude

Andrej Karpathy, ex cofundador de OpenAI, se une al equipo de preentrenamiento de Anthropic bajo Nick Josef para construir un nuevo equipo centrado en usar Claude para acelerar la investigación en preentrenamiento, permitiendo la mejora recursiva automática.

OpenClawRadar
Las herramientas de IA necesitan una integración práctica para las pequeñas empresas, no solo publicidad.
Noticias

Las herramientas de IA necesitan una integración práctica para las pequeñas empresas, no solo publicidad.

La comunidad de IA se centra en debates técnicos mientras que los dueños de pequeñas empresas necesitan herramientas existentes integradas en sus flujos de trabajo para manejar tareas repetitivas como programación, seguimientos y contabilidad.

OpenClawRadar
Fallo de memoria en Claude Opus 4.6: El agente olvida todo excepto el cambio de nombre de archivo
Noticias

Fallo de memoria en Claude Opus 4.6: El agente olvida todo excepto el cambio de nombre de archivo

Un desarrollador documenta las 228 entradas de registro de Claude Opus 4.6, 95 acciones de agente y 38 ejecuciones de código que producen solo 1 memoria: la cadena 'Agent Zero Tune-Up'.

OpenClawRadar
Datos de Uso de la API de Claude Muestran el Impacto de los Nuevos Límites en Usuarios del Plan Máximo
Noticias

Datos de Uso de la API de Claude Muestran el Impacto de los Nuevos Límites en Usuarios del Plan Máximo

Un usuario de Claude Max 20x informa que el uso diario equivalente a la API ha disminuido de aproximadamente $210/día a aproximadamente $52/día después de que se implementaron nuevos límites, lo que requiere cambios significativos en el flujo de trabajo, incluido el uso de Sonnet y Codex.

OpenClawRadar