Oodle.ai lanza observabilidad de agentes a $10 por millón de trazas

Oodle.ai (de Kiran y Vijay) lanzó un producto de Observabilidad de Agentes con un precio de $10 por millón de spans, latencia de consulta P99 inferior a un segundo y cero muestreo. El servicio almacena trazas en S3 usando un formato columnar personalizado tipo Parquet, consultado mediante AWS Lambda.
Detalles clave del lanzamiento en HN:
- Motor de almacenamiento columnar personalizado desarrollado durante dos años para logs, métricas y trazas, ahora aplicado a trazas de agentes LLM.
- Las trazas pueden ser de MB a GB; almacenadas en S3 en un formato propietario similar a Parquet, consultadas sin servidor con Lambda.
- Análisis determinista por span antes de evaluaciones LLM: detecta fallos de herramientas, reintentos, bucles, uso anómalo de tokens, regresiones de latencia, violaciones de esquema, sentimiento y otras señales de producción.
- Precios: $10 por millón de spans. Ingestión $0.30/GB, retención $0.001/GB/mes (ejemplo: 1200 GB/mes + retención de 90 días = $362/mes).
- Información inmediata: Fallos de Recuperación de Errores, Alta Duración, Baja Satisfacción del Usuario, Optimización de Costos del Modelo, Ineficiencia de Caché, Excesivas Interacciones con LLM.
- Los autores usaban anteriormente Langfuse (6x más caro). Actualmente procesan más de 3 millones de trazas de agentes/día con cero muestreo.
Cómo funciona: Oodle almacena todas las trazas sin muestreo, analiza cada span de forma determinista en busca de señales de fallo, y luego ejecuta evaluaciones basadas en LLM opcionalmente en las trazas marcadas. Las consultas sobre los datos retenidos son uniformemente rápidas, sin niveles fríos/calientes.
Para quién es: Equipos de ingeniería que implementan agentes de IA en producción y necesitan trazado asequible y de fidelidad completa sin muestreo.
📖 Lea la fuente completa: HN AI Agents
👀 Ver también

Usar un LLM local como subagente de código de Claude para reducir el uso de contexto
Un desarrollador comparte un método para usar Claude Code para delegar tareas a un LLM local mediante la API de LM Studio, manteniendo el contenido de los archivos fuera del contexto de Claude. El enfoque utiliza un script de Python de ~120 líneas con llamadas a herramientas para leer archivos localmente y devolver resúmenes.

Prime Agent: Un arnés de codificación RLM auto-mejorable con REPL persistente y CRUD de agentes
Prime Agent es un harness de codificación de código abierto basado en un kernel IPython persistente y un Modelo de Lenguaje Recursivo, que permite a los agentes gestionar su propio contexto y subagentes.

Simplificando OpenClaw Hosting: BestClaw mantiene la funcionalidad SSH y amigable para el usuario.
BestClaw se presenta como una solución sencilla para la alojamiento de OpenClaw, equilibrando facilidad de uso con acceso SSH crucial, como se ha discutido en r/openclaw.

El servidor MCP conecta agentes de IA a sesiones existentes de Chrome con cookies y autenticación.
@playwright-repl/mcp es un servidor MCP que conecta agentes de IA a tu navegador Chrome existente a través de la extensión Dramaturg, proporcionando acceso a tu sesión real del navegador, incluyendo cookies y autenticación. Es compatible con JavaScript completo de Playwright, aserciones y funciona con Claude Desktop, Claude Code, Cursor o cualquier cliente MCP.