Hombre de las cavernas vs. instrucción 'sé breve': comparación de indicaciones de compresión para Claude

✍️ OpenClawRadar📅 Publicado: 29 de abril de 2026🔗 Source
Hombre de las cavernas vs. instrucción 'sé breve': comparación de indicaciones de compresión para Claude
Ad

Un desarrollador comparó caveman (el popular prompt de compresión abreviada) con el prompt simple 'sé breve.' para ver si la complejidad adicional realmente vale la pena. La prueba ejecutó 24 prompts de desarrollo en 6 categorías, comparando 5 brazos: línea base, 'sé breve.', caveman ligero, caveman completo y caveman ultra. Las salidas fueron evaluadas por una instancia separada de Claude usando rúbricas por prompt.

Ad

Resultados del benchmark

  • Línea base: puntuación media 0.985, tokens medios 636
  • 'sé breve.': puntuación media 0.985, tokens medios 419
  • Caveman ligero: puntuación media 0.976, tokens medios 401
  • Caveman completo: puntuación media 0.975, tokens medios 404
  • Caveman ultra: puntuación media 0.970, tokens medios 449

La versión de dos palabras igualó a caveman tanto en compresión como en calidad. Sin embargo, el valor de caveman radica en otros aspectos: estructura de salida consistente, cambio de modo y el escape de seguridad en operaciones destructivas. El escape de seguridad introdujo una varianza significativa en la calidad de salida, lo que puede ser una preocupación para ciertos casos de uso.

El desglose completo con datos por categoría y hallazgos de varianza en preguntas de seguridad está disponible en el sitio del autor. El arnés de benchmark es de código abierto en GitHub.

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

OpenAI Codex OAuth devuelve errores 429 desde el 16 de marzo a pesar de tener cuota completa.
Noticias

OpenAI Codex OAuth devuelve errores 429 desde el 16 de marzo a pesar de tener cuota completa.

OpenAI Codex OAuth ha estado devolviendo consistentemente errores 429 de "excediste tu cuota actual" desde el 16 de marzo, incluso cuando los paneles de control muestran un 100% de cuota restante. Los usuarios informan que el problema persiste a pesar de la reautenticación, la revocación de tokens y la reconfiguración completa.

OpenClawRadar
Error en la Respuesta Automática de WhatsApp que Silenciosamente Elimina Imágenes Multimedia en OpenClaw 2026.4.2
Noticias

Error en la Respuesta Automática de WhatsApp que Silenciosamente Elimina Imágenes Multimedia en OpenClaw 2026.4.2

Un error en OpenClaw 2026.4.2 hace que las respuestas automáticas de WhatsApp con MEDIA:./ruta/a/imagen.png eliminen silenciosamente las imágenes, mientras que las respuestas solo de texto funcionan correctamente. La misma configuración del agente funciona correctamente en Telegram.

OpenClawRadar
Firefox 148 añade interruptor de apagado de IA y controles de privacidad mejorados.
Noticias

Firefox 148 añade interruptor de apagado de IA y controles de privacidad mejorados.

Firefox 148 presenta una función de "interruptor de apagado de IA" que permite a los usuarios desactivar todas las funcionalidades de IA, incluyendo sugerencias de chatbots y resúmenes de enlaces generados por IA. La actualización también ofrece más control sobre las actualizaciones remotas y la recopilación de datos.

OpenClawRadar
Microsoft lanza el modelo multimodal Phi-4-reasoning-vision-15B con información sobre su entrenamiento.
Noticias

Microsoft lanza el modelo multimodal Phi-4-reasoning-vision-15B con información sobre su entrenamiento.

Microsoft Research ha lanzado Phi-4-reasoning-vision-15B, un modelo de razonamiento multimodal de código abierto con 15 mil millones de parámetros disponible a través de Microsoft Foundry, HuggingFace y GitHub. El modelo equilibra el poder de razonamiento con la eficiencia y destaca en razonamiento matemático/científico y comprensión de interfaces de usuario.

OpenClawRadar