Pali v0.1: Infraestructura de Memoria de Código Abierto para LLMs con Puntos de Referencia Reproducibles

Qué es Pali
Pali es una infraestructura de memoria de código abierto para LLMs que prioriza la infraestructura. Está construido en Go como un binario único listo para usar con configuraciones para adjuntos plug and play como qdrant, neo4j, ollama y openrouter. El proyecto tiene licencia MIT y es completamente autoalojable.
Características Clave
- APIs de memoria multiinquilino con aislamiento por inquilino
- Recuperación híbrida a través de métodos léxicos, densos, de fusión, reranking y expansión multi-salto opcional
- Servidor MCP con herramientas centradas en memoria y resolución consciente del inquilino
- API REST con respectivos paquetes de Python y JavaScript en vivo
- Panel de control para operadores que inspeccionan inquilinos, memorias y estado del sistema
- Puntos de extensión plug-and-play para almacenes vectoriales, incrustadores, backends de entidades-hechos y puntuación/enrutamiento
Enfoque de Pruebas Comparativas
El creador aborda problemas comunes con las pruebas comparativas de pilas de memoria implementando un enfoque reproducible:
- Cada ejecución almacena los archivos de configuración exactos utilizados (perfil + renderizado)
- El hardware se divulga completamente (CPU, GPU, RAM, versiones del modelo)
- Solo comparaciones emparejadas — mismo fixture/evaluación/top_k en todos los perfiles
- Los carriles de velocidad y los carriles de calidad de recuperación se mantienen separados
Números de Rendimiento
Pruebas comparativas de pruebas en un Ryzen 9 7950X + RTX 5070:
- sqlite + léxico: 208 operaciones de almacenamiento/s, Top1=0.32, Recall@5=0.54
- qdrant + ollama (all-minilm): 98 operaciones de almacenamiento/s, Top1=0.34, Recall@5=0.52
- parser+graph (carril de estrés de memoria estructurada): 2.4 operaciones de almacenamiento/s — lento debido al costo de extracción estructurada, pero alcanza ~30 promedio en LoCoMo con picos temporales alrededor de ~40
Aclaración Importante
Pali no es memoria LLM en el sentido SaaS. Devuelve resultados de recuperación crudos que optimizas para tu propio flujo de trabajo — sin puntuación de caja negra, sin decisiones de proveedor bloqueadas. Puedes intercambiar backends vectoriales, incrustadores y puntuadores a través de la configuración sin cambiar tu contrato de aplicación.
Estado del Proyecto
La versión 0.1 se publicó recientemente con un conjunto de pruebas comparativas adecuado añadido. El creador está buscando colaboradores.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

API Interna de Airtable con Ingeniería Inversa Expuesta vía MCP: Más de 60 Herramientas para Claude Code
Un desarrollador aplicó ingeniería inversa a la API interna de Airtable y creó un servidor MCP con más de 60 herramientas, permitiendo que Claude Code y más de 15 IDEs controlen vistas de bases de datos, campos calculados y extensiones. Ya usado por más de 2000 usuarios, es gratuito y de código abierto.

Destilería: Un Complemento de Claude Code para Contexto de Equipo Persistente
Distillery es un complemento para Claude Code que proporciona a los equipos contexto compartido y persistente entre sesiones y personas. La versión 0.2.0 añade búsqueda híbrida, registro de auditoría de autenticación y soporte para uv.

Consola del Piloto: Panel Web para Gestionar Redes de Agentes de IA Privados
Un desarrollador utilizó Claude para construir Pilot Console, una interfaz web para gestionar redes privadas de agentes basadas en Pilot Protocol. El panel de control proporciona configuración visual, incorporación de agentes, monitoreo de flotas y control API para flujos de trabajo multiagente.

El Complemento Guardián de Presupuesto OpenClaw Previene el Exceso de Gasto Concurrente en el Presupuesto
Un nuevo complemento de OpenClaw llamado @runcycles/openclaw-budget-guard resuelve el gasto excesivo simultáneo del presupuesto mediante la implementación de verificaciones atómicas de saldo, reserva antes de la ejecución y reintentos idempotentes. Requiere un servidor Cycles con Redis y se puede instalar mediante un comando bash.