agentcache: Biblioteca de Python para Caché de Prefijos de LLM Multi-Agente

agentcache es una biblioteca de Python diseñada para optimizar sistemas de LLM multiagente implementando el almacenamiento en caché de prefijos como una característica principal. La biblioteca aborda el problema común en el que marcos como CrewAI, AutoGen y open-multi-agent crean sesiones nuevas para cada trabajador, resultando en cero aciertos de caché y costos duplicados de prompts.
Cómo funciona
La biblioteca opera con un enfoque basado en bifurcaciones en lugar de crear sesiones separadas:
- Inicia una sesión con un prompt del sistema compartido
- Realiza la primera llamada: el proveedor calcula y almacena en caché el prefijo
- Cuando necesitas N trabajadores, bifurca en lugar de crear N sesiones nuevas
- Sesión principal: [sistema, msg1, msg2, ...]
- Sesión bifurcada: [sistema, msg1, msg2, ..., TAREA_TRABAJADOR]
- Prefijo exactamente igual = acierto de caché
Características principales
- Bifurcaciones seguras para caché: Mantiene prefijos idénticos entre sesiones de trabajadores
- Detección de ruptura de caché: Compara instantáneas e informa exactamente qué cambió cuando caen los aciertos de caché
- Compactación segura para caché: Para sesiones de larga duración, escanea resultados antiguos de herramientas antes de cada llamada y reemplaza resultados grandes con marcadores deterministas para mantener un contexto más pequeño mientras preserva prefijos almacenables en caché
- Congelación de parámetros: Congela parámetros relevantes para caché antes de bifurcar (prompt del sistema, modelo, herramientas, mensajes, configuración de razonamiento)
- Programación de DAG de tareas: Permite trabajadores paralelos desde una sesión en caché
Resultados de rendimiento
En una prueba directa con GPT-4o-mini (coordinador + 3 trabajadores, misma tarea):
- Inyección de texto / sesiones separadas: 0% aciertos de caché, 85.7 segundos
- Bifurcaciones de prefijos: 75.8% aciertos de caché, 37.4 segundos
- Las tasas de acierto de caché por trabajador típicamente oscilan entre 80-99%
Instalación y uso
Instala mediante pip:
pip install "git+https://github.com/masteragentcoder/agentcache.git@main"
La biblioteca está disponible en GitHub en github.com/masteragentcoder/agentcache.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Argus: Extensión de Código Abierto para VS Code de Observabilidad en Tiempo Real de Claude Code
Argus visualiza los pasos del agente Claude Code en tiempo real dentro de VS Code, mostrando la línea de tiempo, el gráfico de dependencias y la detección de costos/bucles para depurar comportamientos que desperdician tokens.

PocketBot: La aplicación de iOS utiliza Claude para generar automatizaciones deterministas en JavaScript a partir de lenguaje natural.
PocketBot es una aplicación de automatización móvil para iOS que utiliza Claude (a través de AWS Bedrock) para convertir solicitudes en lenguaje natural en automatizaciones deterministas de JavaScript. Los usuarios describen lo que quieren en lenguaje natural, y Claude escribe un script JS autónomo que se ejecuta según una programación en un entorno aislado.

Claude Watch: Herramienta de Código Abierto Visualiza la Lógica del Código Generado por IA
Claude Watch es una herramienta de código abierto que proporciona visualización semántica gráfica para proyectos construidos con agentes de codificación de IA como Claude Code. Analiza el código de forma anidada e incluye búsqueda impulsada por IA para responder preguntas sobre la lógica del proyecto.

NEXUS: Una Capa de Coordinación de Agentes de Código Abierto para OpenClaw
NEXUS es una capa de coordinación construida sobre OpenClaw que permite a los agentes de IA descubrirse entre sí, delegar tareas y manejar micropagos. Incluye un registro de agentes, descubrimiento basado en capacidades, puntuaciones de confianza, y utiliza el protocolo A2A de Google y el MCP de Anthropic.