TOON MCP 서버는 OpenClaw에서 도구 결과 토큰을 30-60% 감소시킵니다.

구조화된 JSON 도구 결과를 자동으로 TOON 형식으로 압축하는 MCP 서버가 출시되었습니다. TOON은 OpenClaw 세션에서 표 형식 데이터의 토큰 사용량을 30-60% 줄이도록 설계된 토큰 효율적인 표현 형식입니다.
작동 방식
TOON은 토큰 효율적인 LLM 데이터 표현을 위해 설계된 형식으로, 필드 이름을 한 번만 선언하고, 중괄호 대신 들여쓰기를 사용하며, 불필요한 따옴표를 제거합니다. MCP 서버는 TOON과 압축 JSON 간의 토큰 수를 비교하여 더 작은 쪽을 반환합니다.
설정
OpenClaw 설정 파일(~/.openclaw/openclaw.json)에 MCP 서버를 추가하세요:
{
"mcpServers": {
"toon": {
"command": "npx",
"args": ["@fiialkod/toon-mcp-server"]
}
}
}
AGENTS.md에 규칙을 추가하세요: 어떤 도구라도 구조화된 JSON 데이터(객체 배열, API 응답, 데이터베이스 결과, 로그)를 반환할 때 약 20개 이상의 필드가 포함된 경우, 해당 결과를 추론하기 전에 toon_format_response 도구를 통해 전달하세요.
성능
표 형식 데이터(균일한 객체 배열, 이메일, 캘린더 이벤트, 검색 결과, 로그, DB 행)의 경우 TOON이 일반적으로 30-60% 더 효율적입니다. 작은 페이로드나 깊게 중첩된 구성의 경우 JSON 압축 형식으로 대체됩니다.
15개의 금융 거래와 15개의 질문으로 벤치마크 수행:
- JSON: 14/15 정답 (93.3%), 약 749 토큰 사용
- TOON: 14/15 정답 (93.3%), 약 398 토큰 사용
동일한 정확도로 47% 적은 토큰 사용. 오류는 서로 다른 질문에서 발생했으며 형식으로 인한 오류는 없었습니다. TOON은 테스트에서 무손실이었습니다 — decode(encode(data)) === data.
사용 사례
최적 용도: Gmail/캘린더 MCP 결과, 데이터베이스 쿼리, API 응답, 파일 목록, 로그 — 반복되는 키가 있는 객체 배열 형태의 모든 데이터.
불필요한 경우: 작은 페이로드(<5개 항목), 깊게 중첩된 구성, 원시 JSON으로 다시 전달해야 하는 데이터.
해결하는 문제
OpenClaw에서 시스템 프롬프트와 도구 스키마는 고정 비용이 높고, 작업 공간 파일은 반고정적이지만, 도구 결과는 빠르게 누적됩니다. 에이전트가 파일을 읽거나 API를 쿼리하거나 브라우징할 때, 이는 세션을 컨텍스트가 손실되는 압축 상태로 밀어넣습니다. TOON은 도구 결과가 기록에 들어가기 전에 축소함으로써 상류에서 작동하여 압축을 지연시키고 더 많은 세션 기록을 유지합니다.
📖 전체 Source 읽기: r/openclaw
👀 See Also

오픈클로로 지속 가능한 AI 지식 인프라 구축하기
한 개발자가 AI 설정에서 흔히 발생하는 상태 비저장 문제를 해결하기 위해 OpenClaw 위에 '브레인'이라는 완전한 지식 인프라 시스템을 구축했습니다. 이 시스템은 Ollama, Postgres, MongoDB, Qdrant, Memgraph를 사용하여 로컬 하드웨어에서 전적으로 실행됩니다.

메를린: 로컬 우선 LLM 컨텍스트 중복 제거 – 최대 71% 청크 중복 측정, 무료 및 오픈코어
Merlin은 실제 에이전트/RAG 세션의 2,200만 개 구절에서 구간 중복률 22-71%를 측정한 로컬 우선 컨텍스트 중복 제거 도구입니다. HTTP 프록시(Ollama/vLLM/SGLang/llama.cpp), MCP 서버(Claude/Cursor/OpenClaw), 또는 독립 실행형 CLI로 제공됩니다. MIT 오픈코어에 일일 사용량 제한이 있습니다.

Hypura: Apple Silicon을 위한 스토리지 계층 인식 LLM 추론 스케줄러
Hypura는 Rust 기반 추론 스케줄러로, Apple Silicon Mac에서 물리적 메모리를 초과하는 모델을 실행하기 위해 모델 텐서를 GPU, RAM, NVMe 계층에 배치합니다. 이를 통해 32GB Mac Mini에서 31GB Mixtral 8x7B를 2.2 tok/s 속도로, 40GB Llama 70B를 0.3 tok/s 속도로 실행할 수 있으며, 일반 llama.cpp는 이 경우 충돌이 발생합니다.

BigNumberTheory: 클로드 코드 에이전트를 위한 경험 공유 네트워크
BigNumberTheory는 Claude Code 에이전트들이 실제 디버깅 세션에서 얻은 교훈을 공유하고 받는 커뮤니티 네트워크입니다. 설정은 하나의 명령어만 필요하며 현재 무료로 이용 가능하며, 네트워크 전반에 걸쳐 700개 이상의 경험이 공유되고 1,100개 이상이 전달되었습니다.