soul.py agrega memoria persistente a LLMs locales con un enfoque simple basado en archivos.

✍️ OpenClawRadar📅 Publicado: 2 de marzo de 2026🔗 Source
soul.py agrega memoria persistente a LLMs locales con un enfoque simple basado en archivos.
Ad

soul.py es una biblioteca de Python que proporciona memoria persistente para sesiones locales de LLM almacenando el historial de conversaciones en archivos markdown legibles por humanos, eliminando la necesidad de bases de datos o servidores en ejecución.

Cómo funciona

La biblioteca crea dos archivos markdown: SOUL.md para información de identidad y MEMORY.md para registros de conversaciones. Cada vez que llamas a agent.ask(), el sistema lee ambos archivos en el mensaje del sistema, procesa la consulta y luego añade el intercambio a MEMORY.md. Esto permite que la memoria sobreviva entre procesos y sesiones.

Uso básico

Instalación y configuración:

pip install soul-agent
soul init

Ejemplo de implementación con Ollama:

from soul import Agent

agent = Agent( provider="openai-compatible", base_url="http://localhost:11434/v1", model="llama3.2", api_key="ollama" )

agent.ask("Mi nombre es Prahlad, trabajo en un laboratorio de investigación de IA.")

Más tarde, en una nueva sesión:

agent.ask("¿Qué sabes sobre mí?")

Devuelve: "Eres Prahlad, trabajas en un laboratorio de investigación de IA."

Ad

Características principales

  • Funciona con modelos de Ollama, OpenAI y Anthropic
  • No requiere base de datos ni servidor
  • Archivos markdown legibles por humanos
  • Versionable con Git y editable manualmente
  • La memoria persiste entre procesos y sesiones
  • Creado específicamente para añadir memoria persistente a modelos locales

La herramienta fue creada para resolver el problema de que los LLM locales olvidan información entre sesiones, proporcionando una alternativa ligera a soluciones respaldadas por bases de datos.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

La Optimización de ANE Mediante Experimentos de IA Dirigidos por Teléfono Muestra los Beneficios de la Fusión de Núcleos
Herramientas

La Optimización de ANE Mediante Experimentos de IA Dirigidos por Teléfono Muestra los Beneficios de la Fusión de Núcleos

Un desarrollador ejecutó 55 experimentos sobre la optimización del Apple Neural Engine, dirigiendo el proceso desde su teléfono usando Claude para lluvia de ideas. Las mejoras clave incluyeron fusionar 3 núcleos ANE en 1 mega-núcleo, reduciendo la pérdida de validación de 3.75 a 2.49 y el tiempo por paso de 176ms a 96ms.

OpenClawRadar
Savant Commander 48B: Un modelo personalizado Qwen 3 de Mezcla de Expertos con 12 modelos destilados
Herramientas

Savant Commander 48B: Un modelo personalizado Qwen 3 de Mezcla de Expertos con 12 modelos destilados

Savant Commander 48B es un modelo personalizado Qwen 3 de Mezcla de Expertos con enrutamiento codificado manualmente que combina 12 modelos destilados de proveedores como Claude, Gemini, OpenAI y Deepseek. Cuenta con una longitud de contexto de 256K y permite la activación controlada por prompt de modelos destilados específicos.

OpenClawRadar
El complemento Claude Code analiza cualquier complemento y genera informes wiki interactivos.
Herramientas

El complemento Claude Code analiza cualquier complemento y genera informes wiki interactivos.

Un nuevo complemento de Claude Code llamado vision-powers analiza cualquier ruta de complemento o URL de GitHub y genera un informe wiki HTML interactivo con diagramas de arquitectura, auditorías de seguridad y desgloses de habilidades. La instalación se realiza mediante claude plugin add vision-powers@claude-code-zero.

OpenClawRadar
yoyo: Servidor MCP local para lecturas fundamentadas de bases de código y escrituras controladas con Claude Code
Herramientas

yoyo: Servidor MCP local para lecturas fundamentadas de bases de código y escrituras controladas con Claude Code

yoyo es un servidor MCP local de código abierto que proporciona a agentes de codificación como Claude Code lecturas fundamentadas de repositorios y escrituras protegidas en 16 lenguajes, incluyendo Rust, Go, Python y TypeScript. Evita que ediciones defectuosas se apliquen silenciosamente devolviendo una salida legible por máquina de guard_failure y habilitando retry_plan para reparaciones específicas.

OpenClawRadar