OpenClaw LLM 콜드 모델 로딩 타임아웃 수정

문제: 차가운 모델이 60초에 타임아웃
사용자들은 OpenClaw에서 차갑게 로드된 로컬 모델이 일반 에이전트 타임아웃이 훨씬 더 높게 설정되어 있음에도 불구하고 약 60초 후에 지속적으로 실패한다고 보고했습니다. 이 문제는 Ollama를 통한 클라우드 모델과 때로는 OpenAI Codex에서도 발생했습니다.
일반적인 실패 패턴:
- 이미 예열된 모델은 작동함
- 차가운 모델은 약 60초 후에 중단됨
- 로그에 타임아웃 / embedded 장애 조치 / 상태: 408이 언급됨
- 대체 모델이 인수함
오해의 소지가 있는 구성
출처는 몇 가지 명백한 구성 옵션이 실제 해결책이 아니며 개발자를 잘못된 길로 이끌 수 있다고 경고합니다:
agents.defaults.timeoutSeconds.zshrc내보내기LLM_REQUEST_TIMEOUT- 즉시 LM Studio / Ollama 탓하기
근본 원인
이 문제는 OpenClaw가 모델이 첫 번째 스트리밍 토큰을 내보내기 전 기간에 대한 별도의 embedded-runner LLM 유휴 타임아웃을 가지고 있기 때문에 발생합니다.
소스 추적 위치:
src/agents/pi-embedded-runner/run/llm-idle-timeout.ts
기본값:
DEFAULT_LLM_IDLE_TIMEOUT_MS = 60_000
구성 경로는 다음에서 확인됩니다:
cfg?.agents?.defaults?.llm?.idleTimeoutSeconds
따라서 실제 구성 매개변수는 다음과 같습니다:
agents.defaults.llm.idleTimeoutSeconds
해결 방법
테스트 후, 작동하는 구성은 다음과 같습니다:
{
"agents": {
"defaults": {
"llm": {
"idleTimeoutSeconds": 180
}
}
}
}
테스트 결과, 이전에 약 60초에 실패했던 차가운 Gemma 호출이 해당 임계값을 넘어서 생존했으며 결국 즉각적인 장애 조치 없이 성공적으로 응답했습니다.
권장 영구 구성
{
"agents": {
"defaults": {
"timeoutSeconds": 300,
"llm": {
"idleTimeoutSeconds": 300
}
}
}
}
300초 권장 사항은 로컬 모델이 예측 불가능한 경우를 고려한 것으로, 잘못된 장애 조치가 진정으로 차가운 모델을 더 오래 기다리는 것보다 더 문제가 됩니다.
📖 전체 소스 읽기: r/openclaw
👀 See Also

클로드 AI 사용자, 일반적인 프롬프트 대신 컨텍스트 제공으로 더 나은 결과 얻어 (또는 더 자연스러운 표현: 클로드 AI 사용자들이 일반적인 질문보다 구체적인 상황 설명을 통해 더 좋은 결과를 얻고 있다)
레딧 토론에서 강조되듯, Claude AI로 실제 작업을 수행하는 사용자들은 검색 엔진처럼 다루기보다는 자신의 상황, 시도한 방법, 원하는 결과, 피해야 할 점에 대한 구체적인 맥락을 제공합니다.

대부분의 사람들이 클로드를 5% 용량으로만 사용합니다 – 해결 방법은 여기 있습니다
60시간 이상 클로드 오푸스 4.7에서 프롬프트를 테스트한 사용자가 5단계 레시피를 공유: 역할 할당, 구체적 맥락 로드, 제약 조건 설정, 출력 형식 정의, 강제 함수 추가.

신뢰할 수 있는 AI 기술 실행을 위한 프롬프트 구조 개선
한 개발자가 시장 분석 스킬이 수동 개입 없이 처음부터 끝까지 실행되도록 만든 두 가지 주요 프롬프트 수정 사항을 공유했습니다: 스킬이 반환해야 할 것과 수행해야 할 것을 명시적으로 분리하는 것, 그리고 즉흥적인 행동을 방지하기 위해 명시적인 실패 조건을 정의하는 것입니다.

AI를 그냥 복사하지 말고 — 자신의 의견을 쓰세요
개발자를 위한 직접적인 호소: AI 챗봇 답변을 그대로 복사하지 마세요. AI를 초안 작성 파트너로 활용한 후, 자신의 말로 다시 작성하세요.