OmniRecall Beta: FAISS-gestützte Speicherinjektion für Cloud-LLM-Chats

Was OmniRecall macht
OmniRecall ist eine lokale mitmproxy-Umgehung, die den Datenverkehr zu Cloud-Chat-Schnittstellen abfängt (getestet mit DeepSeek). Es hackt sich in den proprietären SSE-Fragmentstrom und zwingt dem System, das für zustandslosen Betrieb konzipiert wurde, eine Langzeitspeicherschicht auf.
Technischer Mechanismus
- Deep-Packet-Parsing: Rekonstruiert die vollständige Assistenten-Antwort durch Verfolgung von Echtzeit-Patches
- Befehlssteuerung: Erkennt [ADD], [UPDATE], [REMOVE], [CLEAR] aus der KI-Ausgabe
- Lokales Gehirn: Verwaltet memory.txt + FAISS-Index (sentence-transformers MiniLM-L6)
- Kontextinjektion: Die am besten erinnerten Fakten werden als [RECALL: ...] in Ihre nächste Nachricht eingefügt
Aktueller Status & Einschränkungen
Dies ist eine Beta-/Experimentalfreigabe. Der Entwickler merkt an: "Das ist das Nächste, was ich nach Wochen Debugging-Hölle dem Traum kommen konnte. Es ist fehlerhaft. Es ist experimentell. [ADD] ist größtenteils stabil, aber [SEARCH] ist launisch – wenn Sie Perfektion wollen, reparieren Sie es selbst. Ich habe meine Energiegrenze für diesen Build erreicht."
Upstream-UI-Änderungen werden es brechen. Der Entwickler erklärt: "Wenn es kaputtgeht, ist das jetzt Ihr Problem."
Anforderungen & Einrichtung
Potato-PC-Anforderungen:
- Nur CPU (faiss-cpu + all-MiniLM-L6-v2)
- Kein lokales LLM erforderlich – erweitert die Cloud-Modelle, die Sie bereits nutzen
- Null Kosten, keine API-Schlüssel, 100 % lokale Datenisolierung
Bereitstellung:
pip install mitmproxy faiss-cpu sentence-transformers numpyVertrauen Sie dem mitmproxy-CA-Zertifikat auf Ihrem OS/Browser (führen Sie mitmproxy einmal aus, um es zu generieren). Setzen Sie den System-Proxy auf 127.0.0.1:8080. Dann ausführen:
mitmdump -s omnirecall.pyGehen Sie zu chat.deepseek.com und beginnen Sie, ihm Erinnerungen zu füttern.
Lizenzbedingungen
Das Projekt verwendet eine aggressiv restriktive quelloffene Lizenz:
- Keine kommerzielle Nutzung
- Keine privaten Forks
- Verpflichtende öffentliche ALTERATIONS.md für jegliche Logikänderungen
- Wenn Sie zu Claude/GPT-4o/irgendwas portieren, halten Sie es gemäß der Lizenz öffentlich
Der Entwickler erklärt: "Ich habe zu viele Solo-Entwicklerprojekte gesehen, die ausgeschlachtet, privatisiert oder in kostenpflichtige SaaS verwandelt wurden, während der Ersteller leer ausgeht. Diese Lizenz ist nicht freundlich – sie ist dazu gebaut, die Arbeit genau vor solchen Leuten zu schützen. Wenn die Bedingungen Sie abschrecken, das ist der Sinn."
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Manuell gesteuerte Entwicklung: Eine Methode zur Vermeidung selbstsicherer Abweichungen von Claude Code
Manuell gesteuerte Entwicklung (MDD) ist eine Methode, die selbstsichere Abweichung in Claude Code adressiert, bei der die KI fehlerhaften Code erzeugt, der seine eigenen Tests besteht. In einer Produktionsprüfung fand MDD 190 Probleme, schrieb 876 neue Tests in weniger als 8 Stunden und beseitigte Regelverstöße.

RAG Learning Academy in Claude Code mit 20 Spezial-Agenten erstellt
Ein Entwickler hat eine interaktive RAG-Lernakademie in Claude Code erstellt, die 20 spezialisierte Agenten, 17 Slash-Befehle und einen 9-moduligen Lehrplan umfasst, der das Wissenstand bewertet und standardmäßig Open-Source-Tools verwendet.

Apfel: Kostenloses CLI-Tool für den Zugriff auf Apples On-Device-LLM unter macOS
Apfel v0.6.13 ist eine Swift 6.3-Binärdatei, die Apples eingebautes LLM als CLI-Tool, OpenAI-kompatiblen Server und interaktiven Chat verfügbar macht. Es läuft zu 100 % auf dem Gerät ohne API-Schlüssel oder Kosten und nutzt das 4.096-Token-Modell, das mit macOS 26+ auf Apple Silicon Macs ausgeliefert wird.

Qure: Desktop-App zur Generierung von E2E-Tests aus aufgezeichneten Browser-Abläufen
Qure ist eine Desktop-Anwendung von JetBrains (derzeit in geschlossener Beta), die aus Aufnahmen im integrierten Browser vollständigen Web-Testcode generiert. Anstatt Testabläufe in Textform für KI-Agenten zu beschreiben, zeichnen Entwickler ihre manuellen QA-Szenarien durch Interaktion mit ihrem Produkt auf, und die KI erzeugt funktionierenden Testcode, der zu ihrer bestehenden Codebasis passt.