SDK de Memória Engram: Memória Baseada em Grafos para Agentes de IA com Modelos Locais

SDK de Memória em Grafo para Modelos Locais de IA
Engram Memory SDK é um sistema de memória em grafo de código aberto projetado para agentes de IA que funciona com modelos locais através da integração LiteLLM. A arquitetura principal separa a ingestão da recuperação: você só precisa do LLM uma vez durante a ingestão para extrair entidades e relacionamentos, enquanto a recuperação opera através de busca vetorial pura, travessia de grafo e pontuação sem exigir chamadas adicionais de LLM.
Detalhes Técnicos
O SDK é construído com Python assíncrono e usa Neo4j como seu banco de dados de backend. De acordo com a fonte, ele tem uma média de ~735 tokens por operação de ingestão e alcança 95ms de latência de recuperação. O sistema inclui recursos de memória de auto-reestruturação com decaimento e agrupamento executando em segundo plano.
Configuração e Instalação
A instalação é simples:
pip install engram-memory-sdkA configuração requer um arquivo .env com estas variáveis:
LLM_MODEL=ollama/llama3 # ou qualquer modelo local suportado pelo LiteLLM
NEO4J_URI=bolt://localhost:7687O sistema suporta qualquer modelo via LiteLLM, incluindo implantações locais através de Ollama, vLLM e text-generation-webui. A vantagem principal é a eficiência de custo: com um pequeno modelo local lidando com a extração, as operações contínuas de recuperação têm literalmente custo $0, pois não consomem tokens de LLM.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Usuário do Reddit Compartilha Ferramenta de IA para Coleta de Saldos de Contas Financeiras
Uma postagem no Reddit no r/openclaw apresenta um agente de IA projetado para otimizar a coleta de saldos de contas financeiras usando Python. Os usuários discutem o potencial de automação por meio de scripts personalizados que utilizam APIs como a Plaid.

AIsbf 0.9.8 adiciona cache, melhorias de roteamento e suporte expandido a serviços de IA.
AIsbf 0.9.8 é um proxy/roteador de API que expõe uma interface compatível com OpenAI para múltiplos serviços de IA. Esta versão adiciona cache com Redis, SQLite, MySQL e baseado em arquivos, roteamento semântico aprimorado e suporte completo a OAuth2 para assinantes do Claude.ai, Amazon Kiro-cli, OpenAI Codex e Kilo.ai.

Perfilador de Custos de LLM: Ferramenta de código aberto monitora gastos com APIs para justificar adoção de modelos locais
LLM Cost Profiler é uma ferramenta Python que monitora cada chamada de API para OpenAI/Anthropic, mostrando exatamente quanto você está gastando e em quê. Ele revela tarefas que são superfaturadas em relação à sua complexidade, fornecendo valores em dólares concretos para justificar a migração para modelos locais.

Bernstein: Um orquestrador semelhante ao Kubernetes para agentes de codificação de IA com verificação e políticas de modelo
Bernstein é um orquestrador para agentes de codificação de IA que inclui verificação independente das saídas dos agentes, controles de política de modelo, 13 adaptadores de agentes e agendamento determinístico baseado em Python. O projeto possui mais de 5000 testes e recursos como disjuntores, detecção de anomalias de custo e varredura de PII.