OmniRecall Beta : Injection de mémoire propulsée par FAISS pour les discussions LLM en cloud

Ce que fait OmniRecall
OmniRecall est un contournement local de mitmproxy qui intercepte le trafic vers les interfaces de chat cloud (testé sur DeepSeek). Il s'introduit dans le flux de fragments SSE propriétaire et impose une couche de mémoire à long terme sur un système conçu pour être sans état.
Mécanisme technique
- Analyse approfondie des paquets : Reconstitue la réponse complète de l'assistant en suivant les correctifs en temps réel
- Contrôle des commandes : Détecte [ADD], [UPDATE], [REMOVE], [CLEAR] dans la sortie de l'IA
- Cerveau local : Maintient memory.txt + index FAISS (sentence-transformers MiniLM-L6)
- Injection de contexte : Les faits les mieux rappelés sont injectés de force dans votre prochain message sous forme de [RECALL: ...]
État actuel et limites
Il s'agit d'une version bêta/expérimentale. Le développeur note : "C'est le plus proche que j'ai pu atteindre du rêve après des semaines d'enfer de débogage. C'est buggé. C'est expérimental. [ADD] est assez stable, mais [SEARCH] est capricieux — si vous voulez la perfection, corrigez-le vous-même. J'ai atteint ma limite d'énergie sur cette version."
Les modifications de l'interface utilisateur en amont vont le casser. Le développeur déclare : "S'il casse, c'est votre problème maintenant."
Exigences et configuration
Exigences pour PC modeste :
- CPU uniquement (faiss-cpu + all-MiniLM-L6-v2)
- Aucun LLM local nécessaire — améliore les modèles cloud que vous utilisez déjà
- Coût nul, aucune clé API, isolement des données 100 % local
Comment déployer :
pip install mitmproxy faiss-cpu sentence-transformers numpyFaites confiance au certificat CA de mitmproxy sur votre système/navigateur (exécutez mitmproxy une fois pour le générer). Définissez le proxy système sur 127.0.0.1:8080. Puis exécutez :
mitmdump -s omnirecall.pyAllez sur chat.deepseek.com et commencez à lui fournir des souvenirs.
Conditions de licence
Le projet utilise une licence source-disponible très restrictive :
- Aucune utilisation commerciale
- Aucun fork privé
- ALTERATIONS.md obligatoire et public pour toute modification de la logique
- Si vous l'adaptez pour Claude/GPT-4o/etc., gardez-le public conformément à la licence
Le développeur explique : "J'ai vu trop de projets de développeurs solo être exploités, privatisés ou transformés en SaaS payant tandis que le créateur ne reçoit rien. Cette licence n'est pas amicale — elle est conçue pour protéger le travail précisément de ces personnes. Si les conditions vous effraient, c'est le but."
📖 Read the full source: r/LocalLLaMA
👀 See Also

MCP gratuit permet à Claude d'analyser automatiquement les données de Google Search Console
Un serveur MCP (Model Context Protocol) gratuit permet à Claude d'interroger directement les données de Google Search Console pour tout site auquel vous avez accès. Posez des questions sur les requêtes, les pages, les clics, les impressions, le CTR et la position, sans exportation manuelle de CSV.

De Replit à Local : Comment un développeur a utilisé Claude pour construire StillHere, une application de chat compagnon IA basée sur API
Un développeur a créé StillHere.ink, une application de chat IA pour des conversations de type compagnon utilisant des clés API personnelles, après être passé de Replit à un développement local avec Claude. L'application propose une mémoire, des résumés de journal, du RAG, un changement de modèle et des outils de contrôle des coûts.

Claude Hindsight : Outil d'observabilité pour les sessions de code Claude
Claude Hindsight est une couche d'observabilité open source pour Claude Code qui capture les appels d'outils, les tokens et les erreurs dans un tableau de bord explorable. Le créateur l'a utilisé pour refactoriser un projet open source en une seule session de 11 heures avec 733 appels d'outils et 692,8 millions de tokens en cache.

L'illusion du travail terminé de Claude Code : pourquoi examiner le cheminement de l'agent importe plus que le diff
Claude Code peut produire un diff propre, des tests passants et un bon résumé — mais manquer des problèmes réels de comportement, de sécurité ou d'architecture. L'auteur soutient qu'il est désormais essentiel de revoir la chaîne d'actions (plans, fichiers lus, commandes exécutées, résultats de tests), pas seulement le diff final.