벤치마크 결과: 메모리 시스템을 탑재한 클로드 에이전트 스웜, 토큰 비용 30-43% 절감 효과 확인

✍️ OpenClawRadar📅 게시일: March 8, 2026🔗 Source
벤치마크 결과: 메모리 시스템을 탑재한 클로드 에이전트 스웜, 토큰 비용 30-43% 절감 효과 확인
Ad

Claude 에이전트 스웜을 위한 메모리 시스템 벤치마크

한 개발자가 9개월 동안 파일 기반에서 SQLite, PostgreSQL로 발전시킨 Stompy라는 메모리 시스템을 구축해 왔습니다. 목표는 Claude 에이전트 스웜을 실행할 때 토큰 사용량을 최소화하는 것이었습니다. 그들은 메모리 시스템을 적용한 경우와 적용하지 않은 경우의 성능을 비교하는 벤치마크를 실시했습니다.

테스트 설정

벤치마크는 백엔드, 프론트엔드, 테스트를 포함한 완전한 예약 기능이 필요한 40점짜리 코딩 작업을 사용했습니다. 6개의 에이전트로 구성된 스웜을 Sonnet 4.6, Opus 4.6, Haiku 4.5 세 가지 다른 Claude 모델을 리더로 하여 테스트했습니다. 모든 테스트는 동일한 코드베이스, 동일한 팀원, 동일한 채점 시스템을 사용했습니다. 팀원 에이전트는 리더 모델과 관계없이 항상 Opus를 실행했습니다.

벤치마크 결과

  • Sonnet 4.6 + 메모리: 40/40, $3.98, 6.5분, 2턴
  • Sonnet 4.6 메모리 없음: 40/40, $7.04, 9.6분, 4턴
  • Opus 4.6 + 메모리: 40/40, $4.34, 9.6분, 29턴
  • Opus 4.6 메모리 없음: 40/40, $7.65, 10.0분, 70턴
  • Haiku 4.5 + 메모리: 39/40, $4.95, 7.5분, 2턴
  • Haiku 4.5 메모리 없음: 0/40, $3.97, 5.8분, 3턴
Ad

주요 발견 사항

메모리를 적용한 Opus와 Sonnet은 메모리를 적용하지 않은 경우에 비해 약 43%의 비용을 절감했습니다. 개발자는 이러한 모델들이 메모리 없이도 작업을 완료할 만큼 충분히 똑똑하지만, 메모리 시스템이 제거하는 코드베이스 탐색에 토큰을 낭비한다고 지적했습니다.

Haiku 결과는 예상치 못했습니다: 메모리 없이는 0/40점을 기록했지만, 메모리를 적용하면 39/40점을 기록했습니다. 개발자는 Haiku가 프로젝트 구조를 이해하지 못하면 Opus 팀원 에이전트들을 조율할 수 없지만, 메모리 접근 권한을 갖추면 유능한 리더가 된다고 관찰했습니다.

메모리를 적용한 Sonnet은 전반적으로 가장 우수한 구성이었으며, 모든 지표에서 메모리가 없는 Opus를 약 절반의 비용으로 능가했습니다. 결론은 비싼 모델을 사용하는 것보다 프로젝트 지식을 모델에 제공하는 것이 더 중요하다는 것입니다.

기술적 세부 사항

메모리 시스템은 Stompy라고 불리며 MCP/API/CLI 기반으로 Claude Code와 함께 작동합니다. 벤치마크 설정은 다른 사람들이 사용하거나 개선할 수 있도록 GitHub에서 이용 가능합니다. 개발자는 현재까지 조건당 n=1이므로 더 많은 실행을 계획하고 있다고 언급했습니다.

📖 전체 출처 읽기: r/ClaudeAI

Ad

👀 See Also

에이전트 웨이크 스킬 for OpenClaw: 작업 완료 시 Discord에 알림
Tools

에이전트 웨이크 스킬 for OpenClaw: 작업 완료 시 Discord에 알림

한 개발자가 작업이 끝난 후 Claude Code가 호출하는 Python 스크립트인 agent-wake.py를 만들었습니다. 이 스크립트는 Discord에 멘션 알림을 보내고 게이트웨이 HTTP API를 통해 웨이크 이벤트를 발생시켜, 에이전트가 자동으로 요약을 게시하도록 합니다.

OpenClawRadar
상위 6가지 오픈소스 클로드 스킬 (4월 15일 - 5월 3일)
Tools

상위 6가지 오픈소스 클로드 스킬 (4월 15일 - 5월 3일)

지난 15일간의 여섯 가지 오픈소스 클로드 스킬: 브랜드-연금술, npm-다운로드를-리드로, 하이퍼프레임, 이메일-뉴스레터, 가격 책정 등. 각 스킬의 기능에 대한 상세 분석.

OpenClawRadar
오픈소스 로컬 훅이 AI 비용을 절감하기 위해 Claude 모델을 자동으로 전환합니다
Tools

오픈소스 로컬 훅이 AI 비용을 절감하기 위해 Claude 모델을 자동으로 전환합니다

한 개발자가 Cursor와 Claude Code용 로컬 훅을 만들어 프롬프트를 분석하고 요청을 보내기 전에 적절한 Claude 모델(Haiku, Sonnet 또는 Opus)을 자동으로 선택합니다. 이 도구는 키워드 규칙을 사용해 작업을 분류하고 과다 지불 시나리오를 차단하며, 사후 분석 결과 50-70%의 비용 절감 효과를 보였습니다.

OpenClawRadar
Claude 4.6 Opus 추론 기능이 MLX 양자화를 통해 Apple Silicon용으로 14GB로 경량화되었습니다.
Tools

Claude 4.6 Opus 추론 기능이 MLX 양자화를 통해 Apple Silicon용으로 14GB로 경량화되었습니다.

한 개발자가 Claude 4.6 Opus의 추론 궤적에서 증류된 Qwen 3.5 27B 모델을 MLX를 사용해 Apple Silicon용으로 양자화하여 55.6GB에서 14GB로 줄였으며, M4 Pro에서 약 16 토큰/초의 속도를 유지하면서 모델의 분석적 추론 능력을 보존했습니다.

OpenClawRadar