OmniRecall Beta: Injeção de Memória com FAISS para Chats de LLM na Nuvem

O que o OmniRecall Faz
OmniRecall é um bypass local do mitmproxy que intercepta o tráfego para interfaces de chat em nuvem (testado no DeepSeek). Ele invade o fluxo de fragmentos SSE proprietário e força uma camada de memória de longo prazo em um sistema que foi projetado para ser sem estado.
Mecanismo Técnico
- Análise Profunda de Pacotes: Reconstrói a resposta completa do assistente rastreando patches em tempo real
- Controle de Comandos: Detecta [ADD], [UPDATE], [REMOVE], [CLEAR] da saída da IA
- Cérebro Local: Mantém memory.txt + índice FAISS (sentence-transformers MiniLM-L6)
- Injeção de Contexto: Os fatos mais lembrados são forçados na sua próxima mensagem como [RECALL: ...]
Status Atual e Limitações
Esta é uma versão beta/experimental. O desenvolvedor observa: "Este é o mais próximo que cheguei do sonho depois de semanas de inferno de depuração. É bugado. É experimental. [ADD] é basicamente estável, mas [SEARCH] é temperamental—se você quer perfeição, conserte você mesmo. Cheguei ao meu limite de energia nesta versão."
Mudanças na interface do usuário upstream vão quebrá-lo. O desenvolvedor afirma: "Se quebrar, a responsabilidade é sua agora."
Requisitos e Configuração
Requisitos para PC Batata:
- Apenas CPU (faiss-cpu + all-MiniLM-L6-v2)
- Nenhum LLM local necessário — aumenta os modelos em nuvem que você já usa
- Custo zero, zero chaves de API, 100% de isolamento de dados local
Como Implantar:
pip install mitmproxy faiss-cpu sentence-transformers numpyConfie no certificado CA do mitmproxy no seu sistema operacional/navegador (execute o mitmproxy uma vez para gerá-lo). Configure o proxy do sistema para 127.0.0.1:8080. Então execute:
mitmdump -s omnirecall.pyVá para chat.deepseek.com e comece a alimentá-lo com memórias.
Termos da Licença
O projeto usa uma licença de código disponível agressivamente restritiva:
- Sem uso comercial
- Sem forks privados
- ALTERATIONS.md obrigatório e público para quaisquer alterações de lógica
- Se você portar para Claude/GPT-4o/qualquer outro, mantenha-o público conforme a licença
O desenvolvedor explica: "Vi muitos projetos de desenvolvedores solo serem explorados, privatizados ou transformados em SaaS pago enquanto o criador não recebe nada. Esta licença não é amigável—foi criada para proteger o trabalho exatamente dessas pessoas. Se os termos te assustam, esse é o ponto."
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude IDE Bridge: Ferramenta WebSocket para Acesso em Tempo Real à IDE
claude-ide-bridge é uma ponte WebSocket que conecta o Claude Code diretamente ao estado interno da IDE, permitindo diagnósticos em tempo real, ir para definição, encontrar referências, passar o mouse sobre tipos, abrir arquivos, gerenciar pontos de interrupção e transmitir o estado do depurador.

Câmara: Agente de IA para Gerenciamento de Infraestrutura de GPU
Chamber é um agente de IA que gerencia infraestrutura de GPU, lidando com tarefas como provisionamento de clusters, diagnóstico de trabalhos com falha e gerenciamento de cargas de trabalho. Ele fornece operações estruturadas com validação e reversão, não apenas comandos brutos de shell.

Três servidores MCP para pesquisa de e-commerce com Claude: ferramentas Shopify, Amazon e Google Maps
Um desenvolvedor criou três servidores MCP para Claude analisar lojas Shopify sem chaves de API, pontuar oportunidades de produtos na Amazon e encontrar/classificar leads de negócios locais no Google Maps. Todos estão disponíveis no Apify.

Gráfico em Cascata: Mapa Interativo de Restrições Energéticas e Pontos de Estrangulamento de Fornecimento da IA
O Cascade Graph é um grafo de conhecimento direcionado da economia física, mapeando 405 nós (drivers, gargalos, geografias, tickers) conectados por 597 arestas com fontes para rastrear como a pressão estrutural se propaga das restrições de energia e física até os ativos investíveis.