memv MCP 서버: AI 에이전트를 위한 지속적 구조화 메모리

memv(오픈소스, Python)가 MCP 서버를 출시하여 Claude Desktop, Code, Cursor 또는 커스텀 호스트 등 모든 MCP 클라이언트에서 지속적이고 구조화된 메모리 레이어를 사용할 수 있게 되었습니다.
빠른 설정
pip로 설치하고 단일 명령어로 서버를 실행하세요:
pip install "memvee[mcp]" memv-mcp --db-url memory.db --llm-model openai:gpt-4o-mini
서버를 자신의 Python 프로세스에 내장할 수도 있습니다:
from memv.mcp.server import create_serverserver = create_server( db_url="memory.db", default_user_id="alice", embedding_client=my_embedder, llm_client=my_llm, ) server.run(transport="streamable-http")
5가지 MCP 도구
search_memory— 하이브리드 검색 (벡터 + BM25 + RRF)add_memory— 구조화된 메모리 직접 삽입add_conversation— 대화에서 메모리 추출 및 저장 (LLM 필요)list_memories— 사용자별 저장된 메모리 목록delete_memory— 소유권 확인 후 삭제
주요 기능
- LLM 선택 사항: 검색 및 직접
add_memory는 LLM 없이 동작하며,add_conversation추출만 LLM이 필요합니다. - 사용자별 격리: 모든 도구는 사용자 경계를 존중하며,
delete_memory에서 소유권을 확인합니다. - 동시 병합: 동일 사용자에 대한 여러 추출 작업이 하나로 병합됩니다.
- 예측-보정 추출: Nemori에서 영감을 받아 모든 것을 저장하지 않습니다.
- 이중 시간 모델: 모순되는 정보는 덮어쓰지 않고 만료됩니다.
- 하이브리드 검색: 벡터 검색, BM25 및 상호 순위 융합(RRF)을 결합합니다.
문서: https://vstorm-co.github.io/memv/advanced/mcp-server/
GitHub: https://github.com/vstorm-co/memv
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

로컬 대시보드에서 Claude Code 사용량을 토큰 비용, 도구 호출 및 세션 분석과 함께 추적합니다.
한 개발자가 Claude Code의 JSONL 세션 파일을 읽어 토큰 사용량, 예상 비용, 도구 호출 분석, 세션 기록을 시각화하는 로컬 대시보드를 구축했습니다. 이 도구는 Express API와 React 대시보드로 완전히 사용자의 컴퓨터에서 실행됩니다.

JANG 양자화 방법으로 대규모 모델의 MLX 성능 향상
JANG이라는 새로운 양자화 방법은 MiniMax-M2.5 및 Qwen 3.5와 같은 대규모 모델을 Apple의 MLX 프레임워크에서 실행할 수 있게 하며, 표준 MLX 양자화보다 훨씬 더 나은 성능을 제공합니다. 이 방법은 거의 네이티브 수준의 속도를 달성하면서도 더 높은 비트 양자화와 비슷한 정확도를 유지합니다.

ClawControl v1.7.1은 OpenClaw 클라이언트의 일상적인 사용 문제를 해결합니다.
ClawControl v1.7.1은 Windows, Mac, Linux, iOS, Android에서 사용 가능한 OpenClaw용 오픈 소스 클라이언트입니다. 이번 릴리스는 일상적인 OpenClaw 사용 중 발생하는 '왜 이런 현상이 발생할까?' 문제들을 해결하는 데 중점을 두었습니다.

OpenClaw 예산 가드 플러그인은 동시 예산 초과 지출을 방지합니다
새로운 OpenClaw 플러그인인 @runcycles/openclaw-budget-guard는 원자적 잔액 확인, 실행 전 예약, 멱등성 재시도를 구현하여 동시 예산 초과 문제를 해결합니다. Redis가 포함된 Cycles 서버가 필요하며 bash 명령어를 통해 설치할 수 있습니다.