오픈소스 LLM 에이전트 메모리 시스템, 벤치마크에서 높은 점수 달성

✍️ OpenClawRadar📅 게시일: March 28, 2026🔗 Source
오픈소스 LLM 에이전트 메모리 시스템, 벤치마크에서 높은 점수 달성
Ad

공개 벤치마크를 갖춘 LLM 에이전트 메모리 시스템

한 개발자가 Claude Code와 OpenClaw를 위한 지속적 메모리 시스템을 구축하여 LLM 에이전트에게 세션 간 실제 문맥 연속성을 제공합니다. 이 시스템은 LoCoMo 벤치마크에서 90.8%(모든 공개 시스템을 능가), LongMemEval에서 89.1%의 점수를 달성했습니다.

아키텍처 및 프레임워크 호환성

아키텍처는 어댑터 기반으로, 현재 생명주기 이벤트에 연결되지만 핵심 구성요소(저장, 검색, 인텔리전스)는 프레임워크 독립적입니다. 검색 파이프라인은 FTS5, Qdrant KNN, 최신성, 그래프 탐색을 포함한 4채널 RRF 방식을 사용합니다. 인텔리전스 계층에는 의도 분류, 경험 패턴, 모든 에이전트 프레임워크에 연결 가능한 RL 정책 구성요소가 포함됩니다.

설정 및 기술 스택

빠른 설정을 위해 다음이 필요합니다:

ollama pull snowflake-arctic-embed2
bun install && bun run build && bun run setup
node dist/angel/index.cjs

기술 스택에는 TypeScript, SQLite(better-sqlite3), Qdrant, Ollama, esbuild, Vitest가 포함됩니다.

주요 설계 결정

  • SQLite를 진실 소스로, Qdrant를 가속화용으로 사용하는 이중 기록 시스템과 우아한 성능 저하 처리
  • 모든 작업이 예외를 발생시키지 않음 — 개별 실패가 파이프라인을 중단시키지 않음
  • 밀리초 수명의 임시 훅(캡처용)과 지속적 Angel(반성용)
  • RL 정책 모델은 순수 TypeScript로 구현(Float32Array 수학 연산, PyTorch 없음)
  • 백그라운드에서 콘텐츠 길이를 고려한 임베딩 백필

이 프로젝트는 29,000줄의 코드, 1,968개의 테스트를 포함하며, https://github.com/grigorijejakisic/Claudex에서 MIT 라이선스로 제공됩니다.

📖 Read the full source: r/openclaw

Ad

👀 See Also

파일럿: 클로드 코드로 완전히 구축된 브라우저 자동화 도구
Tools

파일럿: 클로드 코드로 완전히 구축된 브라우저 자동화 도구

비개발자가 Claude Code를 사용하여 Pilot을 구축했습니다. 이는 접근성 트리 탐색을 통해 AI가 브라우저를 제어할 수 있게 해주는 Chrome 자동화 도구입니다. 이 도구는 클릭 가능한 요소에 번호를 할당하여 Claude가 화면 위치를 추측하는 대신 '5번 클릭'과 같은 명령을 내릴 수 있게 합니다.

OpenClawRadar
Krasis LLM 런타임, Llama.cpp 대비 8.9배 빠른 프리필 및 4.7배 빠른 디코딩 속도 향상 보여
Tools

Krasis LLM 런타임, Llama.cpp 대비 8.9배 빠른 프리필 및 4.7배 빠른 디코딩 속도 향상 보여

Krasis LLM 런타임은 이제 프리필과 디코드를 모두 GPU에서 실행하며 각 단계에 맞는 최적화 전략을 적용하여, 단일 5090 GPU에서 Qwen3.5-122B 모델을 실행할 때 llama.cpp 대비 8.9배 빠른 프리필 속도와 4.7배 빠른 디코드 속도를 달성했습니다.

OpenClawRadar
StarSteady: AI 기반 구글 리뷰 응답 및 지역 비즈니스를 위한 SMS 요청
Tools

StarSteady: AI 기반 구글 리뷰 응답 및 지역 비즈니스를 위한 SMS 요청

StarSteady는 Google/Yelp 리뷰에 AI 생성 답변을 제공하고 고객에게 SMS 리뷰 요청을 보내는 개인 개발 SaaS로, 월 39달러부터 시작하며 5개의 답변과 5개의 SMS를 제공하는 무료 체험판이 있습니다.

OpenClawRadar
GLM 5 on Mac M3: 에이전트 코딩 성능 관찰
Tools

GLM 5 on Mac M3: 에이전트 코딩 성능 관찰

한 사용자가 Mac M3(512GB RAM)에서 MLX 4비트 양자화를 통해 GLM 5를 실행한 결과를 보고했습니다. 컨텍스트가 5만 토큰 미만일 경우 에이전트 코딩에 '상당히 사용 가능'하다고 평가했지만, 그 이상에서는 속도가 현저히 느려진다고 언급했습니다.

OpenClawRadar