OmniRecall Beta: Inyección de Memoria con Tecnología FAISS para Chats de LLM en la Nube

Qué hace OmniRecall
OmniRecall es una herramienta local de bypass para mitmproxy que intercepta el tráfico hacia interfaces de chat en la nube (probado en DeepSeek). Se infiltra en el flujo de fragmentos SSE propietario e impone una capa de memoria a largo plazo en un sistema diseñado para ser sin estado.
Mecanismo Técnico
- Análisis Profundo de Paquetes: Reconstruye la respuesta completa del asistente rastreando parches en tiempo real
- Control de Comandos: Detecta [ADD], [UPDATE], [REMOVE], [CLEAR] en la salida de la IA
- Cerebro Local: Mantiene memory.txt + índice FAISS (sentence-transformers MiniLM-L6)
- Inyección de Contexto: Los hechos más recordados se insertan forzosamente en tu siguiente mensaje como [RECALL: ...]
Estado Actual y Limitaciones
Esta es una versión beta/experimental. El desarrollador señala: "Es lo más cerca que he estado del sueño después de semanas de infierno depurando. Es buggy. Es experimental. [ADD] es mayormente estable, pero [SEARCH] es temperamental—si quieres perfección, arréglalo tú mismo. He llegado a mi límite de energía con esta versión."
Los cambios en la interfaz de usuario ascendente sí lo romperán. El desarrollador afirma: "Si se rompe, ahora es tu responsabilidad."
Requisitos y Configuración
Requisitos para PC Básico:
- Solo CPU (faiss-cpu + all-MiniLM-L6-v2)
- No se necesita LLM local — mejora los modelos en la nube que ya usas
- Costo cero, sin claves API, aislamiento de datos 100% local
Cómo Desplegar:
pip install mitmproxy faiss-cpu sentence-transformers numpyConfía en el certificado CA de mitmproxy en tu SO/navegador (ejecuta mitmproxy una vez para generarlo). Configura el proxy del sistema a 127.0.0.1:8080. Luego ejecuta:
mitmdump -s omnirecall.pyVe a chat.deepseek.com y comienza a alimentarlo con recuerdos.
Términos de la Licencia
El proyecto utiliza una licencia de código disponible con restricciones agresivas:
- Sin uso comercial
- Sin bifurcaciones privadas
- ALTERATIONS.md obligatorio y público para cualquier cambio lógico
- Si lo adaptas a Claude/GPT-4o/lo que sea, manténlo público según la licencia
El desarrollador explica: "He visto demasiados proyectos de desarrolladores solitarios ser despojados, privatizados o convertidos en SaaS de pago mientras el creador no recibe nada. Esta licencia no es amigable—está diseñada para proteger el trabajo precisamente de esa gente. Si los términos te asustan, ese es el punto."
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Comparación de 14 Variantes del Agente de IA Claw en 10 Categorías
Una comparación detallada de 14 variantes populares de agentes de IA Claw, incluyendo OpenClaw, NanoClaw, NemoClaw, ZeroClaw, PicoClaw, Moltis, IronClaw y NullClaw, evaluadas a través de 53 subparámetros con clasificaciones compuestas y casos de uso ideales para cada una.

Construyendo una Infraestructura de Conocimiento de IA Persistente con OpenClaw
Un desarrollador creó 'Brain', un servicio central de conocimiento con RAG local, coordinación multiagente y un sistema de plugins tipado, para resolver el problema de falta de estado en configuraciones de IA. El sistema funciona completamente en hardware local usando Ollama, Postgres, MongoDB, Qdrant y Memgraph.

Gemma 4 E2B Probado como Coordinador Multi-Agente en un Framework de TypeScript
Un desarrollador probó Gemma 4 E2B como coordinador en una configuración multiagente utilizando el framework TypeScript open-multi-agent. El modelo descompuso exitosamente tareas en JSON, asignó agentes, llamó herramientas como bash y operaciones de archivos, y sintetizó resultados.

Personalizando Claude AI para Mejorar la Retroalimentación
Ajusta la configuración de Claude AI para evitar un exceso de acuerdo y fomentar un pensamiento más crítico y retroalimentación práctica.