SDK de Memória Engram: Memória Baseada em Grafos para Agentes de IA com Modelos Locais

✍️ OpenClawRadar📅 Publicado: April 14, 2026🔗 Source
SDK de Memória Engram: Memória Baseada em Grafos para Agentes de IA com Modelos Locais
Ad

SDK de Memória em Grafo para Modelos Locais de IA

Engram Memory SDK é um sistema de memória em grafo de código aberto projetado para agentes de IA que funciona com modelos locais através da integração LiteLLM. A arquitetura principal separa a ingestão da recuperação: você só precisa do LLM uma vez durante a ingestão para extrair entidades e relacionamentos, enquanto a recuperação opera através de busca vetorial pura, travessia de grafo e pontuação sem exigir chamadas adicionais de LLM.

Detalhes Técnicos

O SDK é construído com Python assíncrono e usa Neo4j como seu banco de dados de backend. De acordo com a fonte, ele tem uma média de ~735 tokens por operação de ingestão e alcança 95ms de latência de recuperação. O sistema inclui recursos de memória de auto-reestruturação com decaimento e agrupamento executando em segundo plano.

Ad

Configuração e Instalação

A instalação é simples:

pip install engram-memory-sdk

A configuração requer um arquivo .env com estas variáveis:

LLM_MODEL=ollama/llama3 # ou qualquer modelo local suportado pelo LiteLLM
NEO4J_URI=bolt://localhost:7687

O sistema suporta qualquer modelo via LiteLLM, incluindo implantações locais através de Ollama, vLLM e text-generation-webui. A vantagem principal é a eficiência de custo: com um pequeno modelo local lidando com a extração, as operações contínuas de recuperação têm literalmente custo $0, pois não consomem tokens de LLM.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Usuário do Reddit Compartilha Ferramenta de IA para Coleta de Saldos de Contas Financeiras
Tools

Usuário do Reddit Compartilha Ferramenta de IA para Coleta de Saldos de Contas Financeiras

Uma postagem no Reddit no r/openclaw apresenta um agente de IA projetado para otimizar a coleta de saldos de contas financeiras usando Python. Os usuários discutem o potencial de automação por meio de scripts personalizados que utilizam APIs como a Plaid.

OpenClawRadar
AIsbf 0.9.8 adiciona cache, melhorias de roteamento e suporte expandido a serviços de IA.
Tools

AIsbf 0.9.8 adiciona cache, melhorias de roteamento e suporte expandido a serviços de IA.

AIsbf 0.9.8 é um proxy/roteador de API que expõe uma interface compatível com OpenAI para múltiplos serviços de IA. Esta versão adiciona cache com Redis, SQLite, MySQL e baseado em arquivos, roteamento semântico aprimorado e suporte completo a OAuth2 para assinantes do Claude.ai, Amazon Kiro-cli, OpenAI Codex e Kilo.ai.

OpenClawRadar
Perfilador de Custos de LLM: Ferramenta de código aberto monitora gastos com APIs para justificar adoção de modelos locais
Tools

Perfilador de Custos de LLM: Ferramenta de código aberto monitora gastos com APIs para justificar adoção de modelos locais

LLM Cost Profiler é uma ferramenta Python que monitora cada chamada de API para OpenAI/Anthropic, mostrando exatamente quanto você está gastando e em quê. Ele revela tarefas que são superfaturadas em relação à sua complexidade, fornecendo valores em dólares concretos para justificar a migração para modelos locais.

OpenClawRadar
Bernstein: Um orquestrador semelhante ao Kubernetes para agentes de codificação de IA com verificação e políticas de modelo
Tools

Bernstein: Um orquestrador semelhante ao Kubernetes para agentes de codificação de IA com verificação e políticas de modelo

Bernstein é um orquestrador para agentes de codificação de IA que inclui verificação independente das saídas dos agentes, controles de política de modelo, 13 adaptadores de agentes e agendamento determinístico baseado em Python. O projeto possui mais de 5000 testes e recursos como disjuntores, detecção de anomalias de custo e varredura de PII.

OpenClawRadar