agentmemory V4 erreicht 96,2 % auf dem LongMemEval-Benchmark und übertrifft damit kommerzielle KI-Gedächtnissysteme.

agentmemory V4 ist ein Open-Source-Speichersystem für KI-Agenten, das gerade einen Weltrekordwert von 96,2 % auf LongMemEval erzielt hat, dem Standard-Benchmark für das Langzeitgedächtnis von KI-Agenten.
Benchmark-Leistung
Das System übertraf mehrere geförderte KI-Speicherunternehmen:
- PwC Chronos: 95,6 %
- Mastra: 94,87 %
- OMEGA: 93,2 % (roh)
- Supermemory: 85,86 %
- Emergence AI: 86 %
- Zep: 71,2 %
Entwicklungsdetails
Allein in 16 Tagen auf einem Mittelklasse-Gaming-PC (i3-12100F) mit Gesamtkosten von 1.000 US-Dollar entwickelt. Das System nutzt Claude Opus als Generator und GPT-4o als Bewerter, aber die Abrufarchitektur ist die Kerninnovation.
Technische Architektur
Das System kombiniert mehrere Abruftechniken in einem einzigen SQLite-basierten System:
- HNSW (Hierarchical Navigable Small World) für die approximative Suche nach nächsten Nachbarn
- BM25 für traditionelle Textabfrage
- Cross-Encoder für Relevanzbewertung
- Integration von Wissensgraphen
- Zeitliche Verankerung für zeitbewusste Speicherabrufe
Verfügbarkeit
Das System ist Open Source unter der MIT-Lizenz und verfügbar unter: github.com/JordanMcCann/agentmemory
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Marmy: Eine selbst gehostete Mobile App zur Verwaltung mehrerer KI-Codierungsagenten-Sitzungen
Marmy ist ein quelloffenes, selbst gehostetes Tool, das mit Claude Code erstellt wurde und es Ihnen ermöglicht, mehrere KI-Codierungs-Agenten-Sitzungen von Ihrem Telefon aus zu verwalten. Es verfügt über einen Rust-Agenten für Ihre Maschinen, eine iOS-App, Dateibrowser mit Syntaxhervorhebung, Push-Benachrichtigungen und eine Manager-Agenten-Architektur.

Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code
Agent Forge ist eine Claude Code-Fähigkeit, die vollständige Multi-Agenten-Pipelines aus Anwendungsfallbeschreibungen generiert. Es erstellt Prompt-Dateien, Orchestrator-Skripte, Datenflussverzeichnisse und GitHub Actions-Konfigurationen basierend auf Mustern, die in bestehenden Multi-Agenten-Systemen beobachtet wurden.

LogClaw: Open-Source AI SRE für automatische Ticket-Erstellung aus Logs
LogClaw ist eine Open-Source-Log-Intelligence-Plattform, die auf Kubernetes läuft, Logs über OpenTelemetry aufnimmt, Anomalien mithilfe signalbasierter zusammengesetzter Bewertung erkennt und automatisch Tickets mit Root-Cause-Analyse in etwa 90 Sekunden erstellt.

Open-Source Benchmark Runner zum Testen von OpenClaw-Agenten in realen Workflows
Ein neues Open-Source-Projekt ermöglicht es Ihnen, OpenClaw-Agenten anhand Ihrer eigenen privaten, praxisnahen Aufgaben zu bewerten, die in YAML definiert sind, mit Unterstützung zum Importieren tatsächlicher Agenten-Workspaces.