soul.py adiciona memória persistente a LLMs locais com uma abordagem simples baseada em arquivos

soul.py é uma biblioteca Python que fornece memória persistente para sessões locais de LLM armazenando o histórico de conversas em arquivos markdown legíveis por humanos, eliminando a necessidade de bancos de dados ou servidores em execução.
Como funciona
A biblioteca cria dois arquivos markdown: SOUL.md para informações de identidade e MEMORY.md para registros de conversas. Cada vez que você chama agent.ask(), o sistema lê ambos os arquivos no prompt do sistema, processa a consulta e, em seguida, anexa a troca ao MEMORY.md. Isso permite que a memória sobreviva entre processos e sessões.
Uso básico
Instalação e configuração:
pip install soul-agent
soul initExemplo de implementação com Ollama:
from soul import Agent
agent = Agent(
provider="openai-compatible",
base_url="http://localhost:11434/v1",
model="llama3.2",
api_key="ollama"
)
agent.ask("Meu nome é Prahlad, estou trabalhando em um laboratório de pesquisa de IA.")
Mais tarde, em uma nova sessão:
agent.ask("O que você sabe sobre mim?")
Retorna: "Você é Prahlad, trabalhando em um laboratório de pesquisa de IA."
Principais recursos
- Funciona com modelos Ollama, OpenAI e Anthropic
- Não requer banco de dados ou servidor
- Arquivos markdown legíveis por humanos
- Versionáveis com Git e editáveis manualmente
- A memória persiste entre processos e sessões
- Criado especificamente para adicionar memória persistente a modelos locais
A ferramenta foi criada para resolver o problema de LLMs locais esquecerem informações entre sessões, fornecendo uma alternativa leve a soluções baseadas em banco de dados.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Dois Ferramentas MCP para Claude Code: Validação de Ideia e Memória do Agente de Negociação
Um desenvolvedor criou duas ferramentas MCP para Claude Code: idea-reality-mcp verifica o GitHub e o Hacker News antes de programar para evitar duplicatas, enquanto tradememory-protocol fornece memória para agentes de IA de trading armazenarem negociações com contexto e acompanharem o desempenho da estratégia. Ambas são de código aberto e estão disponíveis no PyPI.
NVIDIA SkillEvaluator chega ao ClawHub: Uma habilidade é realmente melhor?
O ClawHub agora integra o NVIDIA SkillEvaluator para mostrar se uma habilidade melhora um agente antes de você instalá-la. A visualização de avaliação de Patrick Erichsen compara a linha de base versus o ganho medido em mais de 300 habilidades verificadas.

Aplicando a Arquitetura do Claude Code a Modelos Locais de 9B: Principais Descobertas e Otimizações
Um desenvolvedor extraiu padrões arquiteturais do código-fonte vazado do Claude Code e aplicou 10 otimizações ao qwen3.5:9b rodando localmente em uma RTX 5070 Ti. A descoberta principal foi que o qwen3.5:9b possui tool_calls estruturados nativos, e a maior limitação para modelos de 9B é a autodisciplina em saber quando parar de explorar e começar a produzir saída.

Traduzir para pt: Fluxo de Trabalho do Claude Code Detalhes Visuais Hierarquia de Memória e Sistema de Habilidades
Um usuário do Reddit compartilhou um diagrama visual mostrando como o Claude Code organiza a memória por meio de arquivos CLAUDE.md em camadas e implementa habilidades reutilizáveis via arquivos SKILL.md. O loop de fluxo de trabalho sugere usar o modo Plano com aceitação automática e commits frequentes.