Oodle.ai lanza observabilidad de agentes a $10 por millón de trazas

Oodle.ai (de Kiran y Vijay) lanzó un producto de Observabilidad de Agentes con un precio de $10 por millón de spans, latencia de consulta P99 inferior a un segundo y cero muestreo. El servicio almacena trazas en S3 usando un formato columnar personalizado tipo Parquet, consultado mediante AWS Lambda.
Detalles clave del lanzamiento en HN:
- Motor de almacenamiento columnar personalizado desarrollado durante dos años para logs, métricas y trazas, ahora aplicado a trazas de agentes LLM.
- Las trazas pueden ser de MB a GB; almacenadas en S3 en un formato propietario similar a Parquet, consultadas sin servidor con Lambda.
- Análisis determinista por span antes de evaluaciones LLM: detecta fallos de herramientas, reintentos, bucles, uso anómalo de tokens, regresiones de latencia, violaciones de esquema, sentimiento y otras señales de producción.
- Precios: $10 por millón de spans. Ingestión $0.30/GB, retención $0.001/GB/mes (ejemplo: 1200 GB/mes + retención de 90 días = $362/mes).
- Información inmediata: Fallos de Recuperación de Errores, Alta Duración, Baja Satisfacción del Usuario, Optimización de Costos del Modelo, Ineficiencia de Caché, Excesivas Interacciones con LLM.
- Los autores usaban anteriormente Langfuse (6x más caro). Actualmente procesan más de 3 millones de trazas de agentes/día con cero muestreo.
Cómo funciona: Oodle almacena todas las trazas sin muestreo, analiza cada span de forma determinista en busca de señales de fallo, y luego ejecuta evaluaciones basadas en LLM opcionalmente en las trazas marcadas. Las consultas sobre los datos retenidos son uniformemente rápidas, sin niveles fríos/calientes.
Para quién es: Equipos de ingeniería que implementan agentes de IA en producción y necesitan trazado asequible y de fidelidad completa sin muestreo.
📖 Lea la fuente completa: HN AI Agents
👀 Ver también

Gestión Automatizada del Estado de Sesión para la Transferencia de Código de Claude
Un proyecto de GitHub proporciona ganchos automatizados para mantener un archivo de estado de sesión en vivo (.claude/session-state.md) a lo largo de las conversaciones con Claude, abordando la pérdida de contexto por autocompactación y la degradación del contexto a mitad de conversación. El sistema utiliza cuatro scripts bash con jq para rastrear eventos importantes y ediciones de archivos.

Pali v0.1: Infraestructura de Memoria de Código Abierto para LLMs con Puntos de Referencia Reproducibles
Pali es una infraestructura de memoria de código abierto para LLMs construida en Go como un binario único con APIs multiinquilino, recuperación híbrida y extensiones plug-and-play. La versión v0.1 incluye un conjunto de pruebas comparativas con resultados reproducibles que muestran métricas de rendimiento para diferentes configuraciones.

Sonicker: Aplicación Web de Clonación de Voz Desarrollada con Claude Code en 4 Días
Sonicker es una aplicación web de clonación de voz que requiere solo 3 segundos de entrada de audio y admite 10 idiomas. El desarrollador la construyó solo en 4 días usando Claude Code para todo el frontend, la integración de API y la implementación.

Engram: Un Plugin de Aprendizaje para OpenClaw Que Realmente Hace que el Conocimiento se Mantenga
Engram es un plugin de OpenClaw que utiliza técnicas basadas en neurociencia como pre-evaluación, calificación ciega y programación FSRS-4.5 para asegurar que retengas lo que aprendes, incluso mientras los agentes de IA aceleran tu trabajo.