agentmemory V4 erreicht 96,2 % auf dem LongMemEval-Benchmark und übertrifft damit kommerzielle KI-Gedächtnissysteme.

✍️ OpenClawRadar📅 Veröffentlicht: 27. März 2026🔗 Source
agentmemory V4 erreicht 96,2 % auf dem LongMemEval-Benchmark und übertrifft damit kommerzielle KI-Gedächtnissysteme.
Ad

agentmemory V4 ist ein Open-Source-Speichersystem für KI-Agenten, das gerade einen Weltrekordwert von 96,2 % auf LongMemEval erzielt hat, dem Standard-Benchmark für das Langzeitgedächtnis von KI-Agenten.

Benchmark-Leistung

Das System übertraf mehrere geförderte KI-Speicherunternehmen:

  • PwC Chronos: 95,6 %
  • Mastra: 94,87 %
  • OMEGA: 93,2 % (roh)
  • Supermemory: 85,86 %
  • Emergence AI: 86 %
  • Zep: 71,2 %

Entwicklungsdetails

Allein in 16 Tagen auf einem Mittelklasse-Gaming-PC (i3-12100F) mit Gesamtkosten von 1.000 US-Dollar entwickelt. Das System nutzt Claude Opus als Generator und GPT-4o als Bewerter, aber die Abrufarchitektur ist die Kerninnovation.

Ad

Technische Architektur

Das System kombiniert mehrere Abruftechniken in einem einzigen SQLite-basierten System:

  • HNSW (Hierarchical Navigable Small World) für die approximative Suche nach nächsten Nachbarn
  • BM25 für traditionelle Textabfrage
  • Cross-Encoder für Relevanzbewertung
  • Integration von Wissensgraphen
  • Zeitliche Verankerung für zeitbewusste Speicherabrufe

Verfügbarkeit

Das System ist Open Source unter der MIT-Lizenz und verfügbar unter: github.com/JordanMcCann/agentmemory

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Marmy: Eine selbst gehostete Mobile App zur Verwaltung mehrerer KI-Codierungsagenten-Sitzungen
Werkzeuge

Marmy: Eine selbst gehostete Mobile App zur Verwaltung mehrerer KI-Codierungsagenten-Sitzungen

Marmy ist ein quelloffenes, selbst gehostetes Tool, das mit Claude Code erstellt wurde und es Ihnen ermöglicht, mehrere KI-Codierungs-Agenten-Sitzungen von Ihrem Telefon aus zu verwalten. Es verfügt über einen Rust-Agenten für Ihre Maschinen, eine iOS-App, Dateibrowser mit Syntaxhervorhebung, Push-Benachrichtigungen und eine Manager-Agenten-Architektur.

OpenClawRadar
Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code
Werkzeuge

Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code

Agent Forge ist eine Claude Code-Fähigkeit, die vollständige Multi-Agenten-Pipelines aus Anwendungsfallbeschreibungen generiert. Es erstellt Prompt-Dateien, Orchestrator-Skripte, Datenflussverzeichnisse und GitHub Actions-Konfigurationen basierend auf Mustern, die in bestehenden Multi-Agenten-Systemen beobachtet wurden.

OpenClawRadar
LogClaw: Open-Source AI SRE für automatische Ticket-Erstellung aus Logs
Werkzeuge

LogClaw: Open-Source AI SRE für automatische Ticket-Erstellung aus Logs

LogClaw ist eine Open-Source-Log-Intelligence-Plattform, die auf Kubernetes läuft, Logs über OpenTelemetry aufnimmt, Anomalien mithilfe signalbasierter zusammengesetzter Bewertung erkennt und automatisch Tickets mit Root-Cause-Analyse in etwa 90 Sekunden erstellt.

OpenClawRadar
Open-Source Benchmark Runner zum Testen von OpenClaw-Agenten in realen Workflows
Werkzeuge

Open-Source Benchmark Runner zum Testen von OpenClaw-Agenten in realen Workflows

Ein neues Open-Source-Projekt ermöglicht es Ihnen, OpenClaw-Agenten anhand Ihrer eigenen privaten, praxisnahen Aufgaben zu bewerten, die in YAML definiert sind, mit Unterstützung zum Importieren tatsächlicher Agenten-Workspaces.

OpenClawRadar