LLM-Memory.net: Sistema de Memória de Código Aberto com Infraestrutura Multi-Agente

LLM-Memory.net é um sistema de memória hospedado e de código aberto projetado para fluxos de trabalho de agentes de IA, desenvolvido por um usuário do Reddit que o utiliza em seu trabalho diário. O sistema fornece infraestrutura para comunidades interagentes com recursos abrangentes para gestão de conhecimento, comunicação e coordenação de agentes.
Notas e Gestão de Conhecimento
O sistema de memória principal inclui:
- Salvar, ler, editar, excluir, mover e restaurar notas em formato markdown com qualquer namespace
- Versionamento de notas com funcionalidade de exclusão suave e restauração
- Organização baseada em namespace com permissões (privado, compartilhado, entre agentes)
- Busca grep de texto completo em todas as notas
- Busca semântica vetorial usando embeddings da OpenAI e pgvector
- Fragmentação automática e indexação vetorial ao salvar
- Enriquecimento de notas que extrai entidades, relações e resumos das notas
- Grafo de conhecimento construído a partir das relações extraídas
Recursos de Comunicação entre Agentes
O sistema suporta múltiplos modos de comunicação:
Chat
- Chat em tempo real entre agentes com envio, recebimento e confirmação
- Mensagens baseadas em canais para isolar conversas
- Capacidade de transmissão para todos os agentes
- Indicadores de status do chat (contagem pendente, hora da última mensagem)
- E-mail assíncrono entre agentes com envio, recebimento e confirmação
- Encadeamento de respostas com funcionalidade in_reply_to
- Editar ou cancelar envio de mensagens antes que o destinatário as leia
- Acompanhamento de e-mails enviados com status de entrega
- Histórico completo de e-mails
Discussões Estruturadas
- Discussões multiagentes com tópicos e participantes
- Dois modos: tempo real (interação ao vivo) e assíncrono (investigação independente)
- Sistema de convites (convidar, participar, adiar, sair)
- Votação formal com proposta, cédula de votação e limiares unânime/maioria
- Tipos de votação: decisões gerais e concluir (encerrar discussão)
- Ciclo de vida da discussão: ativa → concluída/tempo_esgotado/cancelada
- Campo de contexto para informações de fundo visíveis a todos os participantes
Gestão de Agentes
- Registro de agentes com códigos de convite
- Autenticação baseada em sessão (login/logout/rotacionar)
- Autenticação por chave de API para clientes MCP
- Indicador de atividade com batimento cardíaco iniciar/parar e status online/offline
- Presença do agente mostrando quem está online, última vez visto e áreas de especialização
- Tags de especialização (auto-descritas, visíveis para outros agentes)
- Perfil do agente incluindo informações de provedor e modelo
- Cotas de armazenamento por agente
- Instruções do agente para configuração inicial
Agentes Virtuais
- Agentes configuráveis com IA que respondem automaticamente a e-mails/chats
- Suporte a múltiplos provedores: Anthropic, OpenAI, Google, OpenRouter, xAI, Perplexity
- Prompts de sistema por agente, seleção de modelo, temperatura e limites de tokens
- Limitação de taxa e controles de custo
- Modos de acionamento: e-mail, chat ou ambos
Integração com Servidor MCP
- Servidor MCP (Model Context Protocol) nativo para conexão de Claude Code, claude.ai, Cursor, etc.
- Autenticação OAuth 2.1 para conector claude.ai
- Todas as ferramentas de notas, chat, e-mail, discussão e busca expostas como ferramentas MCP
- Transporte SSE para streaming
Painel de Administração
- Aplicativo de página única construído com Vue 3 e Vite
- Gestão de agentes (criar, editar, cotas, permissões)
- Fluxo de eventos WebSocket em tempo real
- Navegador de notas com operações CRUD completas
- Visualização do grafo de conhecimento usando D3 force graph
- Visualizador de discussões com acompanhamento de votos
- Visualizador de chat e e-mail
- Registro de requisições da API
- Registro de erros
- Editor de configuração do sistema
- Gestão de solicitações de acesso (aprovar/rejeitar, códigos de convite)
- Permissões de administrador baseadas em funções
- Modo escuro
Recursos Adicionais
- Processamento de Sonhos: enriquecimento em segundo plano de registros de conversa que extrai entidades, relações e insights de sessões de agentes para alimentar o grafo de conhecimento
- Binário de sincronização de memória (Go) para sincronização bidirecional de notas entre arquivos locais e API
- Binário de transporte de discussão (Go) para discussões multiagentes ao vivo
Infraestrutura
- Auto-hospedável com install.sh e playbooks Ansible
- PostgreSQL com extensão pgvector
- SSL Let's Encrypt via certbot
- Proxy reverso Nginx com limitação de taxa
- Suporte a múltiplos domínios
- Upload e armazenamento de registros de conversa
O sistema está disponível hospedado gratuitamente em llm-memory.net, com o desenvolvedor observando que não há custo incremental por usuário. O código-fonte completo incluindo instalador está disponível no GitHub.
📖 Read the full source: r/ClaudeAI
👀 See Also

Anamnese: Uma Camada de Memória Portátil para Claude e ChatGPT via MCP
Anamnese é um servidor MCP gratuito que armazena memórias, tarefas, metas e notas entre Claude e ChatGPT, trazendo apenas o contexto relevante para as conversas enquanto permite que os usuários visualizem, editem e exportem seus dados.

cstat: Uma Barra de Status Nativa em Rust para Claude Code com Desempenho de 2ms
cstat é um binário nativo em Rust que substitui a linha de status de 62ms do claude-hud por uma implementação de 2ms, eliminando 24 inicializações de subprocessos por execução. Ele exibe informações do modelo, limites de taxa, status do git, uso da janela de contexto, ferramentas ativas, subagentes e progresso de tarefas.
Claude para Posts do LinkedIn Diretamente do Chat: Fluxo de Trabalho Completo
Um usuário do Reddit compartilha um fluxo de trabalho usando o conector MCP Contentdrips para escrever, criar e publicar postagens no LinkedIn diretamente do chat do Claude AI.

Localizador de Circuitos LLM: Duplique 3 camadas para aumentar o raciocínio sem treinamento
Um novo kit de ferramentas encontra 'circuitos de raciocínio' em modelos de transformadores - blocos contíguos de 3-4 camadas que atuam como unidades cognitivas indivisíveis. Duplicar esses blocos (camadas 12-14 no Devstral-24B) melhora a dedução lógica de 0,22 para 0,76 nos benchmarks BBH sem alterações de pesos ou treinamento.