Diagnósticos de Caché de Mensajes de Claude: Hilo de Estadísticas Revela una Tasa de Lectura de Caché del 98.9%

Hace dos días, Anthropic lanzó la función de diagnósticos de caché de prompts en Claude Console. Es una herramienta para que los desarrolladores entiendan por qué una solicitud falla en la caché y reduzcan costos. Un desarrollador (u/samuelroy_) compartió sus estadísticas en un hilo comunitario, con el objetivo de encontrar patrones y mejorar el rendimiento de la caché en general.
Estadísticas Clave de la Fuente
- Ratio de lectura de caché general: 98.9%
- El 80% de los fallos de caché se deben a
messages changed. - Amortización de escritura para Sonnet: 3.69x
El desarrollador señaló que su proyecto está diseñado para solo añadir mensajes al historial, por lo que la alta tasa de fallos por messages changed fue sorprendente. La explicación probable es que los usuarios bifurcan conversaciones, lo que cambia la cadena de mensajes.
Qué Significa Esto
El almacenamiento en caché de prompts reduce costos y latencia. Con un ratio de lectura del 98.9%, el desarrollador ya es eficiente, pero los datos de diagnóstico revelan un área clara de mejora: reducir cambios innecesarios en los mensajes. Si ves patrones similares, auditar cómo se bifurcan o editan las conversaciones podría aumentar las tasas de acierto de caché.
Como referencia, la amortización de escritura (3.69x para Sonnet) indica cuántas veces se escribe una entrada de caché en relación con las lecturas. Un valor más bajo es mejor.
Analíticas de primera mano como esta son un paso adelante para la optimización de costos en APIs de IA. Se espera que otros proveedores sigan el ejemplo.
📖 Lee la fuente original: r/ClaudeAI
👀 Ver también

Anthropic limita OpenClaw con nuevo sistema de crédito: Detalles e impacto
Anthropic vuelve a limitar OpenClaw: a partir del 15 de junio de 2026, todo el uso programático pasa a un grupo de créditos separado con topes mensuales, sin acumulación, y facturación por exceso a tarifas de API.

En IA, el 41% depende del -59%
El economista jefe de Apollo desglosa los márgenes de beneficio de la IA por capas de la cadena de valor: Modelos y Aplicaciones registran un -59%, mientras que la parte alta de la cadena, como Silicio y Equipos, alcanza el 41%. El auge está financiado por inversores, no por clientes.

Claude-Code v2.1.41 Lanzamiento: Actualizaciones clave y correcciones
Claude-Code v2.1.41 introduce mejoras en la actualización de autenticación de AWS, soporte para Windows ARM64 y correcciones a diversas herramientas y elementos de la interfaz.

Error de plantilla de chat de Gemma 4: Parámetros de herramienta con anyOf/null renderizados como tipo vacío
Un error en la plantilla de chat de Gemma 4 elimina $ref, anyOf y $defs de los esquemas de parámetros de herramientas, dejando las referencias anulables como campos de tipo vacío. Una corrección en Jinja restaura el análisis correcto de esquemas para todos los motores de inferencia.