오프로드-mcp MCP 서버를 통해 일상적인 Claude Code 작업을 Gemma에 오프로드하기

offload-mcp 도구는 Claude가 일상적인 작업을 무료 모델 API(특히 Google GenAI API를 통한 Gemma)로 오프로드할 수 있도록 설계된 MCP 서버입니다. 목표는 작은 작업에 비싼 Claude Code 또는 Codex 컨텍스트를 소모하지 않고, MacBook Air와 같은 하드웨어에서 로컬 모델을 실행할 때의 성능 제한을 우회하는 것입니다.
주요 세부 사항
- 처리: 커밋 메시지, PR 요약, 번역, 독스트링, 소스 diff/파일 요약, 자유 형식 프롬프트.
- 자유 형식 모드: 거의 모든 일상적인 프롬프트를 Claude 대신 더 저렴한 모델로 보냅니다.
- 소스 기반 모드: MCP 서버를 통해 로컬 diff/파일을 직접 읽고 절약된 예상 기본 입력 토큰을 보고합니다.
- 기본 모델 체인은 Gemma를 사용하지만 모델 ID는 구성 가능합니다.
- 저장소: https://github.com/peterhadorn/offload-mcp
저자는 GitHub에서 이 기능을 처리하는 다른 도구를 찾지 못했으며, API 경로가 로컬에서 실행하는 것보다 작은 작업에 훨씬 실용적이라고 언급합니다.
📖 Read the full source: r/ClaudeAI
👀 See Also

OpenClaw용 AxonFlow 플러그인: 사전 실행 도구 승인 및 PII 삭제
OpenClaw의 자체 호스팅 플러그인으로, 도구 실행 전 인수를 확인하고, 위험한 호출은 승인을 위해 일시 중지하며, 발신 메시지에서 PII를 삭제합니다. OpenClaw 수명 주기 훅을 사용하며 에이전트 코드 변경이 필요하지 않습니다.

TEMM1E v3.0.0, AI 에이전트 조정을 위한 군집 지능 도입
TEMM1E v3.0.0는 'Many Tems' 군집 지능을 추가하여 AI 에이전트 작업자들이 LLM 호출 대신 스티그머지 신호를 통해 조율함으로써 복잡한 작업에서 5.86배 빠른 성능과 3.4배 낮은 비용을 달성하며, 조율 토큰을 전혀 사용하지 않습니다.

로컬 저장소와 그래프 기반 검색을 갖춘 지속적인 AI 에이전트 메모리를 위한 오픈소스 프레임워크
개발자가 로컬에서 Markdown 파일로 데이터를 저장하고, 위키 링크를 그래프 엣지로 사용하며, Git을 버전 관리에 활용하는 지속적인 AI 에이전트 메모리를 위한 오픈소스 프레임워크를 구축 중입니다. 이 시스템은 4가지 신호 검색과 ACT-R 인지과학 기반의 그래프 인식 망각 기능을 갖추고 있습니다.

Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 모델이 LM Studio 구성과 함께 출시되었습니다
Qwen3.5-9B 아키텍처와 Claude 4.6 Opus 학습 데이터를 결합한 검열되지 않은 통합 모델이 이제 사용 가능합니다. 최적의 성능을 위한 LM Studio 0.4.7 설정(온도 0.7, 상위 K 샘플링 20 포함)이 제공됩니다.