모델 라우팅을 통해 OpenClaw 비용을 60% 절감한 방법

비용 분석 및 세부 내역
웹사이트 데이터 분석, 블로그 콘텐츠, 코드 리뷰, 고객 지원을 위한 네 개의 에이전트를 운영하던 OpenClaw 사용자는 20일 동안 $420($21/일)을 지출하고 있음을 발견했습니다. 모든 에이전트는 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25인 Claude Opus만 독점적으로 사용하도록 구성되어 있었습니다.
20일 동안 모든 에이전트의 13,500회 호출을 기록한 후 작업을 복잡도별로 분류했습니다:
- 70%는 단순 작업: FAQ 답변, 기본 포맷팅, 한 줄 요약, 사소한 PR 요약
- 16%는 표준 작업: 긴 이메일 초안, 중간 수준 코드 리뷰, 여러 단락 요약
- 9%는 복잡 작업: 심층 코드 분석, 장문 콘텐츠, 다중 파일 컨텍스트
- 6%는 실제 추론 필요: 아키텍처 결정, 복잡한 디버깅, 다단계 논리
분석 결과, 더 저렴한 모델로도 품질 저하 없이 처리할 수 있는 작업의 70%에 프리미엄 Opus 가격을 지불하고 있음이 밝혀졌습니다.
모델 가격 비교
사용자는 현재 모델 가격을 조사했습니다:
- Claude Opus 4.6: 입력 토큰 100만 개당 $5.00/출력 토큰 100만 개당 $25.00 (프리미엄)
- Claude Sonnet 4.6: 입력 토큰 100만 개당 $3.00/출력 토큰 100만 개당 $15.00 (중간 등급)
- Claude Haiku 4.5: 입력 토큰 20만 개당 $1.00/출력 토큰 20만 개당 $5.00 (예산형)
- GPT-5.4: 입력 토큰 105만 개당 $2.50/출력 토큰 105만 개당 $15.00 (프리미엄)
- Gemini 3.1 Pro: 입력 토큰 100만 개당 $2.00/출력 토큰 100만 개당 $12.00 (중간 등급)
- Gemini 3 Flash: 입력 토큰 100만 개당 $0.50/출력 토큰 100만 개당 $3.00 (예산형)
- GLM-5: 입력 토큰 20만 개당 $0.72–1.00/출력 토큰 20만 개당 $2.30–3.20 (예산형)
- Kimi K2.5: 입력 토큰 25.6만 개당 $0.60/출력 토큰 25.6만 개당 $3.00 (예산형)
- MiniMax M2.5: 입력 토큰 100만 개당 $0.30/출력 토큰 100만 개당 $1.20 (초예산형)
구현 및 결과
이제 진정으로 복잡한 작업에만 Opus를 실행합니다. 나머지 모든 작업은 Sonnet, Haiku, Kimi K2.5 또는 Qwen으로 라우팅됩니다. 각 작업 유형에 적합한 모델을 찾는 데 약 일주일이 걸렸습니다.
테스트에서 얻은 주요 발견 사항:
- Claude Haiku는 고객 지원에 가장 신뢰할 만했습니다: 빠른 응답, 포맷팅 지침을 잘 따름, 답변을 간결하게 유지
- Haiku는 명시적인 프롬프트가 필요합니다 - Opus처럼 모호한 지침에서 어조나 스타일을 추론하지 않습니다
- 답변 구조를 정확히 명시하도록 시스템 프롬프트를 재작성하여 Haiku를 지원 업무에 확실하게 사용할 수 있게 했습니다
- Kimi K2.5는 더 저렴하고 다중 턴 대화에 긴 컨텍스트를 잘 처리합니다
사용자들은 단순 작업에서 차이를 느끼지 못했고, 비용은 20일 동안 $420에서 $168로 떨어졌습니다.
📖 Read the full source: r/openclaw
👀 See Also

OpenClaw 사용자가 43개 에이전트 제작 시스템 아키텍처 공유
1,000명 이상의 고객을 보유한 브랜딩 컨설팅 회사가 43개의 에이전트로 구성된 OpenClaw 시스템을 몇 달 동안 운영해 왔으며, 이 시스템은 명령, 인텔리전스, 콘텐츠, 기술, 영업 기능을 담당하는 전문 에이전트들로 구성된 계층적 아키텍처를 특징으로 합니다.

Opus가 플레이북의 하위 에이전트에게 위임하여 프론트엔드 정리를 처리
한 사용자가 한 페이지를 튜닝하고, ADR 플레이북에 수정 사항을 문서화한 후 Opus가 나머지 9페이지를 3개의 하위 에이전트에 분할하여 41개 파일을 거의 완벽한 Lighthouse 결과로 처리했습니다.

사례 연구: 다중 AI 에이전트를 활용한 프로덕션 C++ 라이브러리 구축
개발자가 Claude, ChatGPT, Gemini, Grok 등 네 개의 AI 에이전트를 각기 다른 역할로 활용하여 107개의 헤더 파일과 외부 의존성이 전혀 없는 헤더 전용 C++20 라이브러리인 FAT-P를 구축하는 데 수개월이 걸린 과정을 문서화했습니다. 이 시스템에는 상호 검토, AI가 작성한 거버넌스 문서, 실패 모드를 기록하기 위한 감점 추적기가 포함되었습니다.

비개발자가 Claude로 1년간 iOS 앱 개발한 실전 인사이트
소프트웨어 경험이 전혀 없는 비개발자가 1년 동안 Claude를 사용하여 BloomDay라는 완전한 iOS 생산성 앱을 구축했습니다. 이 앱에는 React Native와 Expo로 구축된 작업 추적, 습관 추적, 앰비언트 사운드가 있는 집중 모드, 가상 정원이 포함되어 있습니다.