LightMem: Leichtgewichtiges Speichersystem für LLM-Agenten mit 10-fachen+ Leistungsgewinnen und 100-fach geringeren Kosten

✍️ OpenClawRadar📅 Veröffentlicht: 26. Februar 2026🔗 Source
LightMem: Leichtgewichtiges Speichersystem für LLM-Agenten mit 10-fachen+ Leistungsgewinnen und 100-fach geringeren Kosten
Ad

LightMem: Eine praktische Speicherschicht für LLM-Agenten

LightMem ist ein leichtgewichtiges, modulares Speichersystem für LLM-Agenten, das die Herausforderungen langer, mehrstufiger Interaktionen angeht, bei denen der Kontext unübersichtlich und kostspielig wird, Modelle sich "in der Mitte verlieren" und bestehende Speichersysteme Latenz und Token-Kosten erhöhen.

Wie LightMem funktioniert

Das System erhält kompakte, themenbezogene und konsistente Erinnerungen durch drei Schlüsselmechanismen:

  • Vorverarbeitung des sensorischen Gedächtnisses: Filtert redundante und wenig wertvolle Token vor der Speicherung
  • Themenbewusstes Kurzzeitgedächtnis: Gruppiert Interaktionen nach Themen und fasst sie zu präzisen Speichereinheiten zusammen
  • Langzeitkonsolidierung in Ruhephasen: Nutzt inkrementelle Einfügungen während der Laufzeit sowie Offline-Aktualisierungen in hoher Qualität ohne Latenzauswirkungen

Leistungsergebnisse

Im LongMemEval-Benchmark zeigt LightMem:

  • Genauigkeitsverbesserung: bis zu ~10,9 %
  • Token-Reduktion: bis zum 117-fachen
  • API-Aufruf-Reduktion: bis zum 159-fachen
  • Laufzeit-Reduktion: >12-fach
Ad

Aktuelle Updates und Funktionen

  • Baseline-Bewertungsrahmen für verschiedene Speichersysteme (Mem0, A-MEM, LangMem) auf LoCoMo & LongMemEval
  • Demo-Video und Tutorial-Notebooks für mehrere Szenarien
  • MCP-Server-Integration für mehrfache Speicheraufrufe
  • Vollständige LoCoMo-Datensatzunterstützung
  • GLM-4.6-Integration mit reproduzierbaren Skripten
  • Lokale Bereitstellung über Ollama, vLLM, Transformers mit automatischer Ladekapazität

Positionierung und Anwendungsfälle

LightMem ist als modulare Speicherschicht konzipiert, die sich in verschiedene Agenten-Stacks integrieren lässt, einschließlich:

  • Langzeitkontext-Agenten
  • Werkzeugnutzende Agenten
  • Autonome Workflows
  • Konversationssysteme

Das System bietet strukturierten Speicher, der skaliert, ohne die Token-Anzahl explodieren zu lassen, was es besonders nützlich für Entwickler macht, die mit Agenten-Frameworks, Speicher-/RAG-Systemen, Langzeitkontext-Modellen und angewandten LLM-Teams arbeiten.

Verfügbarkeit

Paper: https://arxiv.org/abs/2510.18866

Code: https://github.com/zjunlp/LightMem

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Pu.sh: 400-zeiliges Shell-Script-Coding-Agent-Toolkit von HN
Werkzeuge

Pu.sh: 400-zeiliges Shell-Script-Coding-Agent-Toolkit von HN

Pu.sh ist ein portabler Coding-Agent-Harness in 400 Zeilen Shell (sh, curl, awk), der Anthropic + OpenAI, 7 Tools, REPL, Checkpoint/Resume und Pipe-Modus unterstützt – mit 90 tests ohne API.

OpenClawRadar
Creation OS: Ein lokaler σ-gesteuerter LLM-Laufzeit, der Modelle sagen lässt „Ich weiß es nicht“ statt zu halluzinieren
Werkzeuge

Creation OS: Ein lokaler σ-gesteuerter LLM-Laufzeit, der Modelle sagen lässt „Ich weiß es nicht“ statt zu halluzinieren

Creation OS umhüllt lokale LLMs (BitNet, Qwen, Gemma, beliebige GGUF) mit einem σ-Gate, das mehrere Unsicherheitskanäle misst und pro Ausgabe ACCEPT, RETHINK oder ABSTAIN entscheidet. Keine Cloud, keine API. Die Genauigkeit bei TruthfulQA verbesserte sich durch selektive Regeneration um ~29%.

OpenClawRadar
Claude Code fügt Fernsteuerungsfunktion für die Verwaltung mobiler Sitzungen hinzu
Werkzeuge

Claude Code fügt Fernsteuerungsfunktion für die Verwaltung mobiler Sitzungen hinzu

Claude Code ermöglicht es Entwicklern nun, Aufgaben in ihrem Terminal zu starten und Sitzungen von mobilen Geräten aus über die Claude-App oder claude.ai/code weiter zu steuern, während Claude lokal auf ihrem Computer läuft.

OpenClawRadar
MAGELLAN: Ein 15-Agenten-Autonomes Wissenschaftliches Entdeckungssystem, das auf Claude Code aufbaut
Werkzeuge

MAGELLAN: Ein 15-Agenten-Autonomes Wissenschaftliches Entdeckungssystem, das auf Claude Code aufbaut

MAGELLAN ist ein 15-Agenten-System zur autonomen wissenschaftlichen Entdeckung, das vollständig auf Claude Code aufbaut. Es nutzt Opus für tiefgehende Schlussfolgerungen und Sonnet für strukturierte Aufgaben, generiert interdisziplinäre Hypothesen ohne menschliche Anleitung, mit 260 vorgeschlagenen Hypothesen, von denen 60% durch adversarische Validierung in 19 Sitzungen verworfen wurden.

OpenClawRadar