Substituindo pipelines de recuperação complexos por comandos simples de shell do git para agentes LLM

✍️ OpenClawRadar📅 Publicado: March 20, 2026🔗 Source
Substituindo pipelines de recuperação complexos por comandos simples de shell do git para agentes LLM
Ad

De pipeline complexo para acesso shell simples

A equipe originalmente construiu o DiffMem, um sistema de memória baseado em git para agentes de IA com histórico de versões como contexto. Sua camada de recuperação usava sentence-transformers para pontuação de similaridade de cosseno, rank-bm25 para busca por palavras-chave e um pipeline de LLM em duas etapas para destilar consultas e sintetizar resultados. Isso resultou em uma imagem Docker de 3GB (devido a dependências do PyTorch), taxas de timeout de 10% em usuários pesados e inicializações frias que reconstruíam um índice BM25 na memória a cada vez.

A percepção: LLMs já conhecem git

A percepção veio ao reconhecer que comandos Unix são densamente representados nos dados de treinamento de LLMs através de bilhões de arquivos README, scripts de CI e respostas do Stack Overflow. A equipe percebeu que estavam extraindo informações do git com seu próprio código e alimentando um modelo que já entende comandos git.

A solução: Uma função de ferramenta

Eles substituíram tudo por uma única ferramenta:

{
  "name": "run",
  "description": "Execute um comando somente leitura no repositório de memória",
  "parameters": {
    "command": "Comando shell (suporta encadeamento com |, &&, ||, ;)"
  }
}

Como o agente funciona

O agente segue um protocolo fixo: ler o manifesto da entidade, executar uma sondagem temporal no log de commits, agrupar investigações em uma única chamada de ferramenta, gerar um plano de recuperação e então parar. Ele retorna ponteiros, não conteúdo, mantendo o contexto enxuto.

O agente lê sinais leves durante as rodadas:

  • head -30 para estrutura
  • grep -n para palavras-chave
  • git diff HEAD~3.. para alterações recentes
Ad

Exemplo real: Encontrando conexões através do histórico de commits

Quando um usuário enviou uma mensagem de aniversário mencionando sentir-se isolado, o agente executou:

git log --format='%h %ad' --date=relative --name-only -15

Isso revelou que wife.md e company.md foram alterados na mesma sessão, e um colega-chave apareceu em 2 das últimas 3 sessões. A busca por palavras-chave (BM25) nunca teria encontrado company.md a partir de "sentindo-se isolado no meu aniversário", mas a conexão temporal no histórico git foi o que importou.

Na rodada 3, o agente compôs uma única chamada de ferramenta com nove comandos encadeados com ponto e vírgula:

git diff HEAD~2.. -- memories/people/wife.md; git log --stat -5 -- memories/people/wife.md; head -30 memories/people/wife.md; grep -n "birthday|surgery|stress" memories/people/wife.md; tail -50 timeline/2026-03.md; git diff HEAD~3.. -- timeline/2026-03.md; grep -n "project|deliverable" memories/contexts/company.md; git diff HEAD~2.. -- memories/contexts/company.md; git diff HEAD~1.. -- memories/people/colleague.md

Resultados

A saída final foi um plano de recuperação JSON com diffs git específicos, níveis de prioridade e estimativas de tokens. Isso permitiu a exclusão de rank-bm25, sentence-transformers, scikit-learn e numpy. A imagem Docker caiu ~3GB, o servidor inicia mais rápido, usa menos memória e a taxa de timeout de 10% desapareceu. O que permanece: requests, openai e gitpython.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Signet: Camada de Memória de Código Aberto para Agentes de IA de Programação Atinge 80% de F1 no LoCoMo
Tools

Signet: Camada de Memória de Código Aberto para Agentes de IA de Programação Atinge 80% de F1 no LoCoMo

Signet é um sistema de memória de código aberto para agentes de IA de codificação que alcança 80% de F1 no benchmark LoCoMo, em comparação com 41% do RAG padrão. Ele extrai memórias após cada sessão e injeta contexto relevante antes dos prompts, executando localmente com SQLite.

OpenClawRadar
Tacit: Uma linguagem de programação LLM-First construída com Claude Code e Opus 4.7
Tools

Tacit: Uma linguagem de programação LLM-First construída com Claude Code e Opus 4.7

Tacit é uma linguagem de programação experimental, pensada primeiro para LLMs, projetada e implementada usando Claude Code e Opus 4.7. Ela elimina conveniências humanas para minimizar o uso de tokens e vem com um primer que ensina LLMs de nível médio+ (Sonnet e superiores) a escrever código Tacit.

OpenClawRadar
Vinext da Cloudflare: Um framework compatível com Next.js construído com IA no Vite
Tools

Vinext da Cloudflare: Um framework compatível com Next.js construído com IA no Vite

Engenheiros da Cloudflare reconstruíram a superfície de API do Next.js no Vite usando IA em uma semana, criando o vinext - uma substituição direta que constrói 4x mais rápido e produz pacotes 57% menores. Ele é implantado no Cloudflare Workers com um único comando.

OpenClawRadar
Processo de Extração de Voz Personalizada para Código Claude com Modelo
Tools

Processo de Extração de Voz Personalizada para Código Claude com Modelo

Um desenvolvedor compartilha um processo de extração em três etapas para criar uma habilidade de voz personalizada para o Claude Code, resultando em um arquivo SKILL.md de 510 linhas com listas de proibições para LLM-ismos, regras anti-performativas e modos de voz específicos por formato. O modelo de código aberto funciona com qualquer idioma usando 10+ amostras de escrita.

OpenClawRadar