OmniRecall Beta : Injection de mémoire propulsée par FAISS pour les discussions LLM en cloud

✍️ OpenClawRadar📅 Publié: March 16, 2026🔗 Source
OmniRecall Beta : Injection de mémoire propulsée par FAISS pour les discussions LLM en cloud
Ad

Ce que fait OmniRecall

OmniRecall est un contournement local de mitmproxy qui intercepte le trafic vers les interfaces de chat cloud (testé sur DeepSeek). Il s'introduit dans le flux de fragments SSE propriétaire et impose une couche de mémoire à long terme sur un système conçu pour être sans état.

Mécanisme technique

  • Analyse approfondie des paquets : Reconstitue la réponse complète de l'assistant en suivant les correctifs en temps réel
  • Contrôle des commandes : Détecte [ADD], [UPDATE], [REMOVE], [CLEAR] dans la sortie de l'IA
  • Cerveau local : Maintient memory.txt + index FAISS (sentence-transformers MiniLM-L6)
  • Injection de contexte : Les faits les mieux rappelés sont injectés de force dans votre prochain message sous forme de [RECALL: ...]

État actuel et limites

Il s'agit d'une version bêta/expérimentale. Le développeur note : "C'est le plus proche que j'ai pu atteindre du rêve après des semaines d'enfer de débogage. C'est buggé. C'est expérimental. [ADD] est assez stable, mais [SEARCH] est capricieux — si vous voulez la perfection, corrigez-le vous-même. J'ai atteint ma limite d'énergie sur cette version."

Les modifications de l'interface utilisateur en amont vont le casser. Le développeur déclare : "S'il casse, c'est votre problème maintenant."

Ad

Exigences et configuration

Exigences pour PC modeste :

  • CPU uniquement (faiss-cpu + all-MiniLM-L6-v2)
  • Aucun LLM local nécessaire — améliore les modèles cloud que vous utilisez déjà
  • Coût nul, aucune clé API, isolement des données 100 % local

Comment déployer :

pip install mitmproxy faiss-cpu sentence-transformers numpy

Faites confiance au certificat CA de mitmproxy sur votre système/navigateur (exécutez mitmproxy une fois pour le générer). Définissez le proxy système sur 127.0.0.1:8080. Puis exécutez :

mitmdump -s omnirecall.py

Allez sur chat.deepseek.com et commencez à lui fournir des souvenirs.

Conditions de licence

Le projet utilise une licence source-disponible très restrictive :

  • Aucune utilisation commerciale
  • Aucun fork privé
  • ALTERATIONS.md obligatoire et public pour toute modification de la logique
  • Si vous l'adaptez pour Claude/GPT-4o/etc., gardez-le public conformément à la licence

Le développeur explique : "J'ai vu trop de projets de développeurs solo être exploités, privatisés ou transformés en SaaS payant tandis que le créateur ne reçoit rien. Cette licence n'est pas amicale — elle est conçue pour protéger le travail précisément de ces personnes. Si les conditions vous effraient, c'est le but."

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

La compétence Claude pour Devvit améliore la précision de génération de code de 73 % à 100 %.
Tools

La compétence Claude pour Devvit améliore la précision de génération de code de 73 % à 100 %.

Un développeur a créé une couche de prompt structurée SKILL.md pour Claude qui fournit un contexte pour la plateforme Devvit de Reddit, améliorant les résultats d'évaluation de 7/10 à 10/10 sur les tâches Devvit courantes en prévenant des bogues d'exécution spécifiques.

OpenClawRadar
Conduid.com référence plus de 23 000 serveurs MCP dans un annuaire consultable.
Tools

Conduid.com référence plus de 23 000 serveurs MCP dans un annuaire consultable.

Conduid.com agrège des serveurs MCP provenant de 11 sources, les déduplique et propose une recherche, des catégories et des scores de confiance basés sur l'activité GitHub, la qualité de la documentation et les signaux de maintenance.

OpenClawRadar
Gouverneur : Un plugin Claude Code pour réduire le gaspillage de tokens via la compression des sorties, l'allègement du contexte et le filtrage des outils
Tools

Gouverneur : Un plugin Claude Code pour réduire le gaspillage de tokens via la compression des sorties, l'allègement du contexte et le filtrage des outils

Governor est un plugin Claude Code qui réduit le gaspillage de tokens/contexte grâce à une sortie professionnelle compacte, la compression de fichiers mémoire, le filtrage des sorties d'outils et des garde-fous anti-dérive. Les benchmarks montrent une économie de 55,5% de tokens de sortie par rapport au témoin.

OpenClawRadar
Déployez OpenClaw sur VPS avec une CLI en une commande
Tools

Déployez OpenClaw sur VPS avec une CLI en une commande

Un utilisateur de Reddit affirme avoir développé une interface en ligne de commande (CLI) qui déploie OpenClaw sur un serveur privé virtuel (VPS) à 4,99 $/mois avec une seule commande, offrant une alternative économique à l'utilisation de Mac Minis.

OpenClawRadar