LightMem: Leichtgewichtiges Speichersystem für LLM-Agenten mit 10-fachen+ Leistungsgewinnen und 100-fach geringeren Kosten

LightMem: Eine praktische Speicherschicht für LLM-Agenten
LightMem ist ein leichtgewichtiges, modulares Speichersystem für LLM-Agenten, das die Herausforderungen langer, mehrstufiger Interaktionen angeht, bei denen der Kontext unübersichtlich und kostspielig wird, Modelle sich "in der Mitte verlieren" und bestehende Speichersysteme Latenz und Token-Kosten erhöhen.
Wie LightMem funktioniert
Das System erhält kompakte, themenbezogene und konsistente Erinnerungen durch drei Schlüsselmechanismen:
- Vorverarbeitung des sensorischen Gedächtnisses: Filtert redundante und wenig wertvolle Token vor der Speicherung
- Themenbewusstes Kurzzeitgedächtnis: Gruppiert Interaktionen nach Themen und fasst sie zu präzisen Speichereinheiten zusammen
- Langzeitkonsolidierung in Ruhephasen: Nutzt inkrementelle Einfügungen während der Laufzeit sowie Offline-Aktualisierungen in hoher Qualität ohne Latenzauswirkungen
Leistungsergebnisse
Im LongMemEval-Benchmark zeigt LightMem:
- Genauigkeitsverbesserung: bis zu ~10,9 %
- Token-Reduktion: bis zum 117-fachen
- API-Aufruf-Reduktion: bis zum 159-fachen
- Laufzeit-Reduktion: >12-fach
Aktuelle Updates und Funktionen
- Baseline-Bewertungsrahmen für verschiedene Speichersysteme (Mem0, A-MEM, LangMem) auf LoCoMo & LongMemEval
- Demo-Video und Tutorial-Notebooks für mehrere Szenarien
- MCP-Server-Integration für mehrfache Speicheraufrufe
- Vollständige LoCoMo-Datensatzunterstützung
- GLM-4.6-Integration mit reproduzierbaren Skripten
- Lokale Bereitstellung über Ollama, vLLM, Transformers mit automatischer Ladekapazität
Positionierung und Anwendungsfälle
LightMem ist als modulare Speicherschicht konzipiert, die sich in verschiedene Agenten-Stacks integrieren lässt, einschließlich:
- Langzeitkontext-Agenten
- Werkzeugnutzende Agenten
- Autonome Workflows
- Konversationssysteme
Das System bietet strukturierten Speicher, der skaliert, ohne die Token-Anzahl explodieren zu lassen, was es besonders nützlich für Entwickler macht, die mit Agenten-Frameworks, Speicher-/RAG-Systemen, Langzeitkontext-Modellen und angewandten LLM-Teams arbeiten.
Verfügbarkeit
Paper: https://arxiv.org/abs/2510.18866
Code: https://github.com/zjunlp/LightMem
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

ClawedBack: OpenClaw-Port läuft innerhalb von Claude Code
ClawedBack ist eine Clean-Room-Portierung von OpenClaw, die innerhalb von Claude Code läuft und First-Party-Prompt-Caching sowie Ratenbegrenzungen bietet. Es entspricht 19 von 23 der integrierten Tools von OpenClaw und ist vollständig ClawHub-kompatibel mit obligatorischen Sicherheitsscans für Importe.

7-Agenten-System in Claude Code ersetzt Sprint-Zeremonien für Solo-Entwickler
Ein PM, der zum Solo-Entwickler wurde, baute ein 7-Agenten-Team in Claude Code auf, das QA, PR-Review, Security, Architektur und Backlog-Pflege übernimmt – alles ausgelöst durch einen einzigen /review-Befehl.

OKed Plugin: OpenClaw fragt Ihr Telefon vor zerstörerischen Aktionen
Ein neues Plugin namens OKed greift in OpenClaws before_tool_call ein, um destruktive Befehle (E-Mails, Löschungen, Zahlungen) abzufangen und Genehmigungsanfragen auf Ihr Telefon oder Telegram zu senden.

Chrome-Erweiterung verbindet Google Messages über MCP mit Claude Code
Ein Entwickler hat eine Chrome-Erweiterung erstellt, die Google Messages Web mit Claude Code über MCP mit stdio und WebSocket-Transport verbindet. Die Erweiterung listet Chats auf, liest Nachrichten und verfasst Antworten, kann aber derzeit aufgrund der Angular zone.js-Isolation keine Nachrichten senden.