Pali v0.1: Infraestrutura de Memória de Código Aberto para LLMs com Benchmarks Reproduzíveis

✍️ OpenClawRadar📅 Publicado: March 14, 2026🔗 Source
Pali v0.1: Infraestrutura de Memória de Código Aberto para LLMs com Benchmarks Reproduzíveis
Ad

O que é o Pali

Pali é uma infraestrutura de memória de código aberto para LLMs com foco em infraestrutura. É construído em Go como um único binário pronto para uso, com configurações para anexos plug-and-play como qdrant, neo4j, ollama e openrouter. O projeto tem licença MIT e é totalmente auto-hospedável.

Principais Recursos

  • APIs de memória multi-inquilino com isolamento por inquilino
  • Recuperação híbrida através de métodos léxicos, densos, de fusão, reranking e expansão multi-hop opcional
  • Servidor MCP com ferramentas de memória-first e resolução consciente do inquilino
  • API REST com respectivos pacotes Python e JavaScript disponíveis
  • Painel para operadores inspecionarem inquilinos, memórias e estado do sistema
  • Pontos de extensão plug-and-play para armazenamentos vetoriais, embedders, backends de entidades/fatos e pontuação/roteamento

Abordagem de Benchmark

O criador aborda problemas comuns em benchmarks de pilhas de memória implementando uma abordagem reproduzível:

  • Cada execução armazena os arquivos de configuração exatos usados (perfil + renderizado)
  • Hardware totalmente divulgado (CPU, GPU, RAM, versões dos modelos)
  • Apenas comparações pareadas — mesmo fixture/avaliação/top_k em todos os perfis
  • Faixas de velocidade e faixas de qualidade de recuperação são mantidas separadas
Ad

Números de Desempenho

Benchmarks de testes em um Ryzen 9 7950X + RTX 5070:

  • sqlite + léxico: 208 operações de armazenamento/s, Top1=0.32, Recall@5=0.54
  • qdrant + ollama (all-minilm): 98 operações de armazenamento/s, Top1=0.34, Recall@5=0.52
  • parser+graph (faixa de estresse de memória estruturada): 2.4 operações de armazenamento/s — lento devido ao custo de extração estruturada, mas atinge ~30 média no LoCoMo com picos temporários em torno de ~40

Esclarecimento Importante

Pali não é memória de LLM no sentido SaaS. Ele retorna resultados brutos de recuperação que você otimiza para seu próprio fluxo de trabalho — sem pontuação de caixa preta, sem decisões de provedor bloqueadas. Você pode trocar backends vetoriais, embedders e pontuadores através de configuração sem alterar o contrato do seu aplicativo.

Status do Projeto

A versão 0.1 foi recentemente lançada com um conjunto adequado de benchmarks adicionado. O criador está procurando por contribuidores.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Gerenciando Múltiplas Tarefas de Agentes de IA com Quadros Kanban
Tools

Gerenciando Múltiplas Tarefas de Agentes de IA com Quadros Kanban

Um desenvolvedor compartilha sua experiência executando múltiplos agentes de IA Claude em abas de terminal e identifica três desafios principais no fluxo de trabalho: falta de visibilidade do progresso, perda de contexto ao alternar entre tarefas e interrupções por limite de taxa. Sua solução envolve tratar tarefas de IA como itens de trabalho em um quadro Kanban.

OpenClawRadar
Extensão Event Horizon do VS Code Adiciona Bloqueio de Arquivos e Coordenação de Planos para Múltiplos Agentes de IA
Tools

Extensão Event Horizon do VS Code Adiciona Bloqueio de Arquivos e Coordenação de Planos para Múltiplos Agentes de IA

Event Horizon, uma extensão do VS Code originalmente criada para visualizar o Claude Code, agora inclui recursos de bloqueio de arquivos e coordenação de planos para evitar que múltiplos agentes de IA sobrescrevam o trabalho uns dos outros na mesma base de código. A ferramenta suporta Claude Code, OpenCode e Copilot com configuração de um clique.

OpenClawRadar
🦀
Tools

Usando um chat adversarial Claude para capturar ambiguidades de kickoff antes que elas te custem

Um desenvolvedor adicionou um segundo chat Claude cuja única função é revisar adversariamente os kickoffs em busca de especificações ambíguas e falhas silenciosas, economizando entre US$ 150 e US$ 400 em retrabalho do Claude Code em uma fase do projeto.

OpenClawRadar
Claude-Code v2.1.63 adiciona ganchos HTTP, comandos de barra e corrige vazamentos de memória.
Tools

Claude-Code v2.1.63 adiciona ganchos HTTP, comandos de barra e corrige vazamentos de memória.

Claude-Code v2.1.63 introduz ganchos HTTP para chamadas externas baseadas em JSON, adiciona os comandos de barra /simplify e /batch, e corrige múltiplos vazamentos de memória em sessões de longa duração. A versão também melhora o tratamento de servidores MCP e a integração com VSCode.

OpenClawRadar