OmniRecall Beta: Injeção de Memória com FAISS para Chats de LLM na Nuvem

✍️ OpenClawRadar📅 Publicado: March 16, 2026🔗 Source
OmniRecall Beta: Injeção de Memória com FAISS para Chats de LLM na Nuvem
Ad

O que o OmniRecall Faz

OmniRecall é um bypass local do mitmproxy que intercepta o tráfego para interfaces de chat em nuvem (testado no DeepSeek). Ele invade o fluxo de fragmentos SSE proprietário e força uma camada de memória de longo prazo em um sistema que foi projetado para ser sem estado.

Mecanismo Técnico

  • Análise Profunda de Pacotes: Reconstrói a resposta completa do assistente rastreando patches em tempo real
  • Controle de Comandos: Detecta [ADD], [UPDATE], [REMOVE], [CLEAR] da saída da IA
  • Cérebro Local: Mantém memory.txt + índice FAISS (sentence-transformers MiniLM-L6)
  • Injeção de Contexto: Os fatos mais lembrados são forçados na sua próxima mensagem como [RECALL: ...]

Status Atual e Limitações

Esta é uma versão beta/experimental. O desenvolvedor observa: "Este é o mais próximo que cheguei do sonho depois de semanas de inferno de depuração. É bugado. É experimental. [ADD] é basicamente estável, mas [SEARCH] é temperamental—se você quer perfeição, conserte você mesmo. Cheguei ao meu limite de energia nesta versão."

Mudanças na interface do usuário upstream vão quebrá-lo. O desenvolvedor afirma: "Se quebrar, a responsabilidade é sua agora."

Ad

Requisitos e Configuração

Requisitos para PC Batata:

  • Apenas CPU (faiss-cpu + all-MiniLM-L6-v2)
  • Nenhum LLM local necessário — aumenta os modelos em nuvem que você já usa
  • Custo zero, zero chaves de API, 100% de isolamento de dados local

Como Implantar:

pip install mitmproxy faiss-cpu sentence-transformers numpy

Confie no certificado CA do mitmproxy no seu sistema operacional/navegador (execute o mitmproxy uma vez para gerá-lo). Configure o proxy do sistema para 127.0.0.1:8080. Então execute:

mitmdump -s omnirecall.py

Vá para chat.deepseek.com e comece a alimentá-lo com memórias.

Termos da Licença

O projeto usa uma licença de código disponível agressivamente restritiva:

  • Sem uso comercial
  • Sem forks privados
  • ALTERATIONS.md obrigatório e público para quaisquer alterações de lógica
  • Se você portar para Claude/GPT-4o/qualquer outro, mantenha-o público conforme a licença

O desenvolvedor explica: "Vi muitos projetos de desenvolvedores solo serem explorados, privatizados ou transformados em SaaS pago enquanto o criador não recebe nada. Esta licença não é amigável—foi criada para proteger o trabalho exatamente dessas pessoas. Se os termos te assustam, esse é o ponto."

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Arquitetura de Compilador Determinístico para Fluxos de Trabalho de LLM Multi-Etapas Apresenta Fortes Resultados em Benchmarks
Tools

Arquitetura de Compilador Determinístico para Fluxos de Trabalho de LLM Multi-Etapas Apresenta Fortes Resultados em Benchmarks

Uma arquitetura de compilação determinística para fluxos de trabalho estruturados de LLM utiliza registros de nós tipados, contratos de parâmetros e validação estática para compilar grafos de fluxo de trabalho antecipadamente. Os benchmarks mostram que ela supera o GPT-4.1 e o Claude Sonnet 4.6 em profundidades de fluxo de trabalho de 3 a 12+ nós.

OpenClawRadar
Observador de Tarefas: Uma Meta-Habilidade que Automatiza o Aprimoramento de Habilidades para Agentes de Codificação de IA
Tools

Observador de Tarefas: Uma Meta-Habilidade que Automatiza o Aprimoramento de Habilidades para Agentes de Codificação de IA

Task-observer é uma meta-habilidade que auto-melhora todas as habilidades do seu agente de IA, incluindo a si mesma. Ela registrou 600 melhorias em 40 habilidades em 3 meses e automatiza a criação de habilidades a partir de lacunas de trabalho.

OpenClawRadar
Desenvolvedor Alcança Latência Sub-Segundo em STT/TTS com Servidores Locais de Whisper e Coqui-TTS
Tools

Desenvolvedor Alcança Latência Sub-Segundo em STT/TTS com Servidores Locais de Whisper e Coqui-TTS

Um desenvolvedor disponibilizou implementações de servidor local de código aberto para Whisper STT e Coqui TTS que alcançam latência de ~0,2s na conversão de fala para texto e ~250ms na conversão de texto para fala, permitindo agentes de IA conversacionais sem dependências de nuvem.

OpenClawRadar
Stage CLI: Alterações Locais Geradas por IA Revisadas como Capítulos Lógicos
Tools

Stage CLI: Alterações Locais Geradas por IA Revisadas como Capítulos Lógicos

Stage CLI agrupa seu diff local em capítulos lógicos (via qualquer agente de IA) e abre uma interface de navegador para revisão passo a passo. Instale com 'npm install -g stagereview' e adicione a habilidade com 'npx skills add ReviewStage/stage-cli'.

OpenClawRadar