Maggy: Uma Plataforma de Engenharia Autônoma no Claude Code com Memória entre Sessões e Aprendizado em Equipe P2P

✍️ OpenClawRadar📅 Publicado: May 11, 2026🔗 Source
Maggy: Uma Plataforma de Engenharia Autônoma no Claude Code com Memória entre Sessões e Aprendizado em Equipe P2P
Ad

Um desenvolvedor no r/ClaudeAI construiu uma plataforma de engenharia autônoma chamada Maggy sobre o Claude Code. Ela aborda o problema central das ferramentas de codificação de IA serem amnésicas — o conhecimento de uma sessão não é transferido. A Maggy implementa memória entre sessões, inteligência de processos de todo o SDLC e aprendizado em equipe P2P, posicionando-se no Nível 4 do espectro da indústria (autocomplete → assistente de chat → assistente ciente do projeto → agente de tarefas → plataforma de engenharia autônoma).

Principais Funcionalidades

  • Chat — Assunção de Sessão: Detecta automaticamente todas as sessões ativas do Claude Code em projetos. Mostra histórico de sessões, contagens de prompts, duração. Você pode usar --resume em qualquer sessão a partir do painel. Atualmente suporta 7 sessões ativas em 4 projetos visíveis de relance.
  • Triagem de Tarefas: Conecta-se ao GitHub Issues e Asana. Classifica tarefas por prioridade usando IA. Botões "Planejar" ou "Executar" com um clique iniciam o CLI correto com contexto do código-fonte pré-injetado a partir de um grafo de propriedades de código de intenção (iCPG).
  • Inteligência de Processos: Coleta sinais de resultados de CI, comentários de revisão de PR, descobertas do CodeRabbit, padrões de merge, resultados de deploy. Aprende quais padrões de código causam falhas em testes e o que os revisores sinalizam consistentemente — corrige problemas preventivamente antes da criação do PR. Exemplo: "Seu revisor sempre sinaliza falta de tratamento de erros em rotas de API. A Maggy adicionou antes do PR ser criado."
  • Memória entre Sessões (Engram): Identifica 7 patologias de amnésia (anterógrada, retrógrada, temporal, de fonte, de interferência, de ligação de contexto, confabulação). Memória de três níveis: local (específica do projeto), portfólio (entre projetos), malha (compartilhada pela equipe). O conhecimento se acumula entre sessões.
  • Maggy Mesh — Inteligência de Equipe P2P: Conecta instâncias da Maggy em uma equipe. A correção de CI de um desenvolvedor se torna conhecimento de toda a equipe autonomamente. Classes de memória tipadas (pontuações, padrões, políticas, lacunas) com proveniência e quarentena. Novos membros da equipe obtêm meses de aprendizado coletivo no primeiro dia.
  • Roteamento Multimodelo: Descobre automaticamente CLIs disponíveis (Claude, Codex, Kimi, Ollama) sondando --help na inicialização. Roteia por pontuação de complexidade: Blast 1-3 → ollama ou kimi; Blast 4-6 → codex; Blast 7-10 → claude. Segurança, testes, docs, arquitetura sempre vão para Claude. Regras de roteamento são YAML e se auto-atualizam a partir dos resultados das tarefas.
  • Autoaperfeiçoamento em 5 Níveis: Cada tarefa ensina algo à Maggy. Níveis: L0 em tempo real (segundos, detecta falhas de ferramentas/testes, troca de modelos no meio da tarefa), L1 tarefa (minutos, pontuações de recompensa), L2 diário (horas, queda na taxa de aprovação de CI desativa modelos), L3 semanal (dias, evolui arquivos de habilidade), L4 mensal (semanas, recalibra sinais de recompensa).
  • Controle de Orçamento: Gasto de tokens por provedor com limites diários. Quando a Anthropic atinge o orçamento, roteia para OpenAI; quando esse atinge, roteia para Qwen local.
  • Inteligência de Concorrentes: Briefing diário de RSS + Google News para o cenário competitivo.
Ad

Benchmark: Controlador de Despesas (6 tarefas)

MétricaMaggy (4 modelos)Claude Code sozinho
Taxa de sucesso6/6 (100%)6/6 (100%)
Pontuação de qualidade7,4/107,8/10
Uso do Claude1/6 tarefas (17%)6/6 tarefas (100%)
Problemas de segurança encontrados70

A Maggy alcançou 83% de redução no uso de computação premium enquanto detectou 7 problemas de segurança que passaram despercebidos pela abordagem de pipeline único.

Impacto

Isso não é apenas mais um wrapper — o roteamento autoaprimorável e a memória entre sessões representam uma mudança genuína em direção a plataformas de engenharia autônomas. Para equipes cansadas de perda de contexto e fragmentação de ferramentas, a Maggy mostra o que é possível quando o conhecimento se acumula em vez de evaporar.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

obsidian-mcp: Servidor MCP com Consciência de Grafo para Claude com 25 Ferramentas para Grandes Cofres
Tools

obsidian-mcp: Servidor MCP com Consciência de Grafo para Claude com 25 Ferramentas para Grandes Cofres

obsidian-mcp é um servidor MCP que expõe 25 ferramentas (incluindo get_note, traverse_graph, query_dataview, move_note, create_notes) que dá ao Claude acesso ciente do grafo ao seu cofre Obsidian — evitando a morte da janela de contexto em cofres com 5 mil notas. MIT, funciona com Claude Desktop, Claude Code, Cursor, Cline, Continue, Zed.

OpenClawRadar
ToolLoop: Framework de Código Aberto para Ferramentas no Estilo Claude com Qualquer LLM
Tools

ToolLoop: Framework de Código Aberto para Ferramentas no Estilo Claude com Qualquer LLM

ToolLoop é um framework Python de código aberto com 11 ferramentas para operações de arquivo, busca de código, acesso ao shell e subagentes que funciona com qualquer LLM através do LiteLLM. O framework de 2.700 linhas permite trocar de modelo no meio da conversa mantendo o contexto compartilhado.

OpenClawRadar
Hospedagem Nativa para Agentes com MCP: Implante Aplicativos via Agentes de IA no ocl-nexus
Tools

Hospedagem Nativa para Agentes com MCP: Implante Aplicativos via Agentes de IA no ocl-nexus

ocl-nexus apresenta uma configuração de servidor MCP que permite que agentes de codificação de IA implantem aplicativos diretamente em um ambiente ativo protegido por SSO usando apenas uma chave de API.

OpenClawRadar
Claude Code vs OpenCode: Principais Diferenças Técnicas que um Desenvolvedor Encontrou
Tools

Claude Code vs OpenCode: Principais Diferenças Técnicas que um Desenvolvedor Encontrou

Um desenvolvedor compara Claude Code e OpenCode em contexto, memória, uso de ferramentas, subagentes, permissões, segurança e flexibilidade de modelos, concluindo que o Claude Code ainda vence para repositórios de produção.

OpenClawRadar