모델 전환으로 OpenClaw Agent 비용 80% 절감하는 방법

Reddit 사용자가 2주 동안 모든 OpenClaw 에이전트 상호작용을 수동으로 기록하여 자금이 어디에 사용되는지 파악했습니다. 그 결과는 AI 에이전트 비용 최적화를 위한 명확한 청사진을 제공합니다.
분석
Telegram + Discord 에이전트를 14일 동안 사용한 결과, 토큰 사용량은 다음과 같이 분류되었습니다:
- Heartbeat (30분 폴링) — 사용량의 38%. Opus에서 실행 시 약 $6.75/M 토큰. 상태 확인에 완전히 불필요합니다.
- 파일 읽기 및 요약 — 사용량의 29%. 역시 Opus 사용. Flash로도 동일하게 처리 가능합니다.
- 실제 대화 — 사용량의 22%. 여기서는 모델 품질이 중요합니다.
- 복잡한 작업 — 사용량의 11%. Opus가 Flash보다 확실히 우수한 부분입니다.
전체적으로 지출의 67%가 DeepSeek V4 Flash ($0.14/M)로 Opus ($6.75/M, 토크나이저 적용 후)와 동일한 품질을 얻을 수 있는 작업에 사용되었습니다.
해결책: 기본값을 Flash로 설정, 필요한 경우만 업그레이드
openclaw.json에서 기본 모델을 deepseek/deepseek-v4-flash로 설정하세요:
"agents": {
"defaults": {
"model": {
"primary": "deepseek/deepseek-v4-flash"
}
}
}그런 다음 진짜 어려운 작업을 만나면 세션 중간에 /model anthropic/claude-opus-4-7 명령어를 사용하세요. 전환은 즉각적이며 재시작이 필요 없고 동일한 세션을 유지합니다. 작업이 끝나면 /model deepseek/deepseek-v4-flash를 입력하여 저렴한 모드로 돌아가세요.
결과
비용이 월 약 $170에서 $35로 감소했습니다. Heartbeat, 파일 읽기, 간단한 질문에 대한 품질 차이는 전혀 없었습니다.
사용자는 BetterClaw의 무료 티어(BYOK 포함)가 이제 작업별 API 지출을 보여주므로 Heartbeat 낭비를 즉시 발견할 수 있었을 것이라고 언급합니다. 하지만 핵심은 기본 모드를 Flash로 설정하고 필요할 때만 /model로 Opus로 업그레이드하는 것입니다.
📖 Read the full source: r/openclaw
👀 See Also

생각 구조 시각화를 위한 Claude 프롬프트: 의도, 현실, 격차
레딧 사용자가 Claude에게 대화의 구조적 패턴을 인식하고 반영하도록 요청하는 100단어 프롬프트를 공유했습니다. 이는 내용 자체가 아닌 의도(원하는 것), 현실(존재하는 것), 격차(해결되지 않은 것)로 분류된 패턴을 다룹니다.

클로드 사용자들은 워드 문서 대신 마크다운을 요청하면 세션이 더 빨라진다고 보고합니다
한 클로드 사용자가 마크다운을 요청하면 워드 문서보다 응답 시간과 토큰 사용량이 크게 줄어든다는 사실을 발견했습니다. AI는 기본적으로 마크다운을 출력하는 반면, .docx 파일을 생성하려면 파이썬 환경을 구동하고 변환 스크립트를 실행해야 합니다.

Ollama Cloud 모델 maxTokens 수정: 상한선은 16K, 구성 값 아님
Ollama 클라우드는 maxTokens 설정과 관계없이 출력을 16,384 토큰으로 제한합니다. EOF 오류를 피하려면 maxTokens를 14,000으로 설정하세요. 긴 출력을 재구성하거나 대규모 에이전트를 직접 제공업체로 라우팅하세요.

더 효과적인 AI 에이전트 지시를 위한 받아쓰기 도구 활용
한 개발자가 OpenClaw에 대한 지시사항을 타이핑에서 음성으로 전환하자, SaySo.ai를 받아쓰기 도구로 사용하여 더 자연스럽고 상세한 맥락을 제공함으로써 출력 품질이 향상되었다는 점을 발견했습니다.