Refletir Servidor MCP Implementa Documento de Reflexão para Memória Persistente de Agente de Codificação

Um desenvolvedor implementou o artigo Reflexion (Shinn et al., NeurIPS 2023) como um servidor MCP para resolver um problema comum com agentes de codificação locais: a falta de memória persistente entre sessões. A ferramenta, chamada reflect-mcp, permite que os agentes lembrem e evitem repetir erros.
Como Funciona
O sistema opera através de um fluxo de trabalho estruturado:
- Após cada falha de teste, o agente critica seu próprio trabalho e extrai padrões do erro
- Essas lições são armazenadas para referência futura
- Antes de iniciar novas tarefas, o agente recupera lições passadas usando busca de texto completo
- A correspondência de padrões é totalmente baseada em regex - nenhuma chamada de LLM é necessária para classificação
O desenvolvedor observa que as mensagens de erro são previsíveis o suficiente para que a correspondência determinística funcione efetivamente. O agente escreve a crítica porque tem o contexto, enquanto o servidor cuida da estruturação e deduplicação das lições.
Implementação Técnica
- Construído como um servidor MCP (Model Context Protocol)
- Usa SQLite com FTS5 para armazenamento e busca
- Funciona com qualquer cliente compatível com MCP
- Instale via:
cargo install reflect-mcp
Resultados Após Uma Semana
O desenvolvedor relatou várias melhorias no comportamento do seu agente de codificação:
- Parou de fazer o mesmo
unwrap()em entrada do usuário - Parou de esquecer o tratamento de fuso horário
- Começou a evitar automaticamente padrões de falha previamente vistos
- O rastreamento de padrões tornou visíveis erros recorrentes em todo o projeto
O projeto está disponível no GitHub em https://github.com/rohansx/reflect. O desenvolvedor está buscando feedback de outros que experimentaram configurações de memória persistente para agentes de codificação locais.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Lumyr: Geração de Dashboard via Claude com Automação Python e Streamlit
Lumyr é uma ferramenta que gera painéis interativos e compartilháveis a partir de descrições em inglês simples, utilizando o Claude para a geração dos painéis e automatizando a camada de Python e Streamlit. Os usuários não precisam escrever Python, abrir o Streamlit, implantar, configurar hospedagem ou gerenciar infraestrutura.
Enxame Espinhal: Sistema de IA Multiagente em Tela Visual para Projetos Sem Codificação
Spine Swarm é um sistema multiagente que opera em uma tela visual infinita para completar projetos complexos que não envolvem programação, como análise competitiva, modelagem financeira, auditorias de SEO, apresentações de pitch e protótipos interativos. O sistema usa blocos como abstrações sobre modelos de IA que podem ser conectados para passar contexto entre diferentes tipos de modelos.

Livro de Registro do Projeto: Sistema de Memória com Intervenção Humana para Agentes de Codificação de IA
Um projeto do GitHub apresenta um sistema de registro baseado em YAML onde humanos selecionam o que os agentes de IA lembram sobre bases de código. Inclui uma habilidade /ledger, um gancho UserPromptSubmit para injeção automática de contexto e revisão do auditor Haiku.
MathCode: Um Agente de Codificação Matemática com Formalização em Lean 4
MathCode é um assistente de codificação com IA para terminal que converte problemas de matemática em linguagem simples em teoremas Lean 4 e tenta provas formais, com REPL persistente, bibliotecas reutilizáveis e um grafo de conhecimento Obsidian.