AgentLens: Herramienta de Observabilidad para Flujos de Trabajo de IA Multi-Agente

AgentLens es una herramienta de observabilidad diseñada para flujos de trabajo de IA multiagente que combinan modelos locales y basados en la nube. Aborda el desafío de rastrear actividades entre diferentes proveedores como Ollama, vLLM, Anthropic y OpenAI.
Características principales
- Trazabilidad unificada en Ollama, vLLM, Anthropic, OpenAI y otros proveedores
- Seguimiento de costos que incluye tiempo de cómputo local convertido a costo estimado
- Servidor MCP para consultar estadísticas desde dentro de Claude Code
- Interfaz CLI para verificaciones rápidas en línea con comandos como
agentlens q stats - Autoalojado - se ejecuta en tu máquina con los datos permaneciendo locales
Implementación y uso
Implementa usando Docker:
docker run -d -p 3100:3100 phoenixaihub/agentlens-collector
Envuelve las llamadas de Ollama con una línea de código:
const { client } = wrapOllama(ollama, { client: lens });
El panel muestra el flujo de agentes, desglose de costos y latencia por proveedor.
Esta herramienta es particularmente útil para desarrolladores que ejecutan flujos de trabajo de IA mixtos donde algunas tareas usan modelos locales (como Ollama) mientras otras requieren modelos basados en la nube (como Claude o GPT) para razonamiento complejo.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Tilde.run: Un entorno aislado para agentes con un sistema de archivos transaccional y versionado
Tilde.run proporciona entornos aislados reversibles para agentes de IA, con un sistema de archivos versionado que monta GitHub, S3 y Google Drive, y aislamiento de red por defecto.

0Latencia: Una Capa de Memoria Persistente para Agentes de IA a través de MCP
0Latency es un servidor MCP que añade memoria persistente a Claude y otros agentes de IA, almacenando recuerdos entre sesiones para evitar la pérdida de contexto. Funciona de forma nativa con Claude Desktop, Claude Code, claude.ai, GPT, Gemini, Cursor y cualquier agente compatible con MCP.

Reduzca los costos de sesiones de codificación con IA en un 90% mediante la indexación de código basada en grafos
Un desarrollador creó una base de datos de grafos local que indexa un código fuente utilizando resúmenes generados por LLM, reduciendo los costos de las sesiones de Claude Code de $6-10 a centavos al evitar la relectura redundante de archivos.

Consulta Tu Sprint de Jira Mediante Claude MCP: Estado Instantáneo, Incidencias Sin Asignar y Elementos Bloqueados
Un usuario de Reddit conectó Jira a Claude mediante MCP, luego hizo preguntas en lenguaje natural sobre su sprint y obtuvo tablas limpias al instante, sin tener que hacer clic en los tableros.