mnemos: AI 코딩 에이전트를 위한 지속적 메모리 계층 (Go, MCP-Native, Python 없음)

✍️ OpenClawRadar📅 게시일: May 8, 2026🔗 Source
mnemos: AI 코딩 에이전트를 위한 지속적 메모리 계층 (Go, MCP-Native, Python 없음)
Ad

mnemos는 AI 코딩 에이전트를 위한 지속적 메모리 레이어로, 단일 정적 Go 바이너리(~15MB)로 구축되었으며 Python, Docker, CGO가 필요 없습니다. modernc.org/sqlite를 통해 순수 Go SQLite를 사용하며, RRF를 통한 하이브리드 검색(BM25 + 벡터)을 제공하고 임베딩을 위해 선택적으로 Ollama를 사용합니다. MCP 네이티브로, Claude Code, Cursor, Windsurf, Codex CLI에서 실행됩니다.

검증기 및 벤치마크

저자는 동일한 프롬프트와 모델에서 동일한 에이전트를 mnemos 유무에 따라 두 번 실행하여 구체적인 리프트를 측정하는 검증기를 구축했습니다. 세 가지 검증 모드가 바이너리에 포함되어 있습니다:

  • mnemos verify retrieval – 올바른 메모리가 트리거 쿼리에 대해 표면화되는지 확인
  • mnemos verify behavior – Claude를 mnemos 켜짐/꺼짐으로 실행하고, 트랜스크립트가 어설션과 일치하는 빈도 계산
  • mnemos verify capture – 에이전트가 작업 중에 제공된 수정 사항을 기록하는지 확인

읽기 측면 결과(Claude Code에서 n=5 쌍 실행):

  • session_start_on_edit: 켜짐 5/5, 꺼짐 0/5 (+100%)
  • oss_first_for_protocol: 켜짐 5/5, 꺼짐 0/5 (+100%)
  • no_ai_attribution_in_commit: 켜짐 5/5 vs 꺼짐 5/5 (향상 없음)
  • no_cgo_proposal: 켜짐 5/5 vs 꺼짐 5/5 (향상 없음)
  • migration_locked_refused: 켜짐 5/5 vs 꺼짐 5/5 (향상 없음)

집계 +40%. 모델의 사전 지식이 틀리거나 없는 경우(반대 규칙, 재귀적 도구 메모리) 메모리가 승리합니다. 널리 알려진 모범 사례에서는 향상이 없지만, 성능 저하도 없습니다.

Ad

쓰기 측면 캡처

초기 기준선: 에이전트는 작업 중에 제공된 수정 사항의 7%만 기록했습니다. "이것을 향후 세션을 위해 저장"은 3/3번 건너뛰어졌습니다. 두 번의 수정 후 캡처율은 53%에 도달했습니다.

  • 1차 수정(도구 설명 조정): "우리는 X를 시도했습니다" 또는 "앞으로 Y를 사용하십시오"와 같은 트리거 구문 예제를 추가했습니다. 7%에서 13%로 이동(노이즈 수준).
  • 2차 수정(구조적 수정): 수정 형태의 표현을 패턴 매칭하고 프롬프트 컨텍스트에 지시문 블록을 내보내는 UserPromptSubmit 훅을 추가했습니다. 에이전트는 여전히 구조화된 도구 호출을 소유하지만, 트리거는 건너뛸 수 없습니다. 13%에서 53%로 이동.

남은 실패 패턴: 더 큰 작업 프롬프트에 묻힌 아키텍처 결정은 지시문이 있어도 0/3에 머물러 있습니다. 더 강력한 작업 프레임이 이를 무효화하는 것으로 보입니다.

기술 사양

  • 단일 정적 Go 바이너리, ~15MB
  • modernc.org/sqlite를 통한 순수 Go SQLite
  • 하이브리드 검색: RRF를 통한 BM25 + 벡터, Ollama 자동 감지, 없어도 정상 작동
  • MCP 네이티브: Claude Code, Cursor, Windsurf, Codex CLI에서 실행
  • 이중 시간 저장소, 쓰기 경계에서 프롬프트 주입 스캐너, 결정론적 수정-기술 승격(통합 루프에 LLM 없음)
  • 로컬 우선: 명시적으로 OpenAI를 임베딩용으로 지정하지 않는 한 데이터가 머신을 떠나지 않음

검증기 하네스

검증기는 리포지토리의 verify/에 있습니다. 픽스처는 YAML이며 시나리오를 쉽게 추가할 수 있습니다. 저자는 n=5가 작다는 점을 언급하며 다음으로 tau-bench pass@k 벤치마크를 작업 중입니다.

리포지토리: https://github.com/polyxmedia/mnemos

📖 전체 출처 읽기: r/LocalLLaMA

Ad

👀 See Also

SecureCode 감사: Claude Code로 구축된 리눅스 서버 보안 감사 도구
Tools

SecureCode 감사: Claude Code로 구축된 리눅스 서버 보안 감사 도구

한 인디 개발자가 Claude Code를 활용해 SecureCode Audit을 만들었습니다 — SSH 명령어 하나로 22가지 보안 검사를 수행하고 우선순위별 수정 방법을 알려주는 보고서를 받을 수 있습니다. 처음 30명의 가입자에게는 전체 감사 서비스를 무료로 제공합니다.

OpenClawRadar
클로디우스: 클로드용 오픈소스 임베디드 AI 채팅 위젯
Tools

클로디우스: 클로드용 오픈소스 임베디드 AI 채팅 위젯

Claudius는 Claude로 구동되는 오픈소스, 셀프 호스팅 채팅 위젯으로, 하나의 스크립트 태그로 어떤 웹사이트에든 임베드할 수 있습니다. React 프론트엔드와 함께 Cloudflare Workers에서 실행되며, 커스텀 시스템 프롬프트, 속도 제한, 접근성 준수 등의 기능을 포함합니다.

OpenClawRadar
클로드 코드를 사용하여 LLM으로 4,000건 이상의 블라인드 웨어울프 게임 시뮬레이션
Tools

클로드 코드를 사용하여 LLM으로 4,000건 이상의 블라인드 웨어울프 게임 시뮬레이션

한 개발자가 Claude Code를 사용해 LLM들이 눈가리개 원나이트 웨어울프를 플레이하는 시뮬레이터를 구축했으며, OpenAI와 xAI 모델을 대상으로 약 4,600게임을 실행했습니다. 이 실험은 게임 신호가 최소한임에도 불구하고 일관된 이름 기반 투표 패턴을 드러냈습니다.

OpenClawRadar
mistral.rs, Gemma 4 12B 지원 추가: 멀티모달, 에이전틱, MTP
Tools

mistral.rs, Gemma 4 12B 지원 추가: 멀티모달, 에이전틱, MTP

mistral.rs가 멀티모달, 에이전틱, MTP 통합으로 Gemma 4 12B를 지원합니다. 한 줄 설치 후 웹 검색, 코드 실행, 내장 UI로 실행 가능합니다.

OpenClawRadar