OpenClaw突破33K上下文限制:如何修复
r/openclaw의 한 개발자는 OpenClaw에서 262K 컨텍스트 창을 구성했음에도 불구하고 지속적인 33K 토큰 컨텍스트 제한이 발생한다고 보고합니다. 이 문제는 Qwen3.8-27B를 포함하여 로컬에서 로드하는 모든 모델에 영향을 미치며, OpenClaw의 통제 범위를 벗어난 것으로 보입니다.
상황
사용자는 컨텍스트 창을 올바르게 설정했습니다:
openclaw config set agents.defaults.contextWindow 262144OpenClaw는 모델이 262144 토큰을 지원한다고 인정하지만, 약 33K 토큰 이후 응답이 저하되어 Telegram에서 /compact 또는 /new 명령을 자주 실행해야 합니다. ollama ps를 실행하면 모델의 기본 용량과 관계없이 33K 컨텍스트만 로드된 것을 확인할 수 있습니다.
근본 원인
문제는 OpenClaw가 아니라 Ollama에 있을 가능성이 높습니다. Ollama는 OLLAMA_CONTEXT_LENGTH 환경 변수나 Modelfile의 num_ctx 매개변수로 재정의하지 않는 한 기본 컨텍스트 크기(종종 4096 또는 8192)를 사용합니다. OpenClaw는 Ollama에 컨텍스트 길이를 전달하지 않으므로 Ollama는 작은 창으로 로드됩니다.
해결 방법
- OLLAMA_CONTEXT_LENGTH 설정: Ollama를 시작하기 전에 환경 변수를 262144로 설정하세요.
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfile 업데이트: 사용자 정의 모델을 사용하는 경우 매개변수를 추가하세요.
그리고 모델을 다시 생성하세요.PARAMETER num_ctx 262144 - Docker 확인: Ollama가 Docker에서 실행되는 경우
docker run -e OLLAMA_CONTEXT_LENGTH=262144를 통해 환경 변수가 전달되는지 확인하세요.
추가 참고 사항
수정 후 ollama ps로 로드된 컨텍스트를 확인할 수 있습니다. 새 크기가 표시되어야 합니다. 또한 일부 클라이언트가 지원하는 요청의 num_ctx와 함께 Ollama의 OpenAI 호환 엔드포인트를 사용하는 것도 고려해 보세요.
자세한 내용은 소스 토론을 확인하세요.
📖 전체 소스 읽기: r/openclaw
👀 See Also

레딧 사용자가 클로드 코드 프롬프팅의 흔한 실수와 해결책을 공유합니다
Node.js 백엔드 작업에 Claude를 사용하는 개발자가 수개월간 사용한 후, 검증 요구사항 누락과 Claude를 일회성 도구로 취급하는 것 등을 포함한 10가지 일반적인 프롬프팅 실수를 확인했습니다. 그들은 각 문제에 대한 해결책을 담은 시각적 가이드를 만들었습니다.
슬래시 에이전트 스타트업 토큰 60% 삭감: 봇 워크스페이스 정리하기
한 개발자가 LLM으로 작업 공간 파일을 감사하고 재구성하여 시작 토큰을 80k에서 31k로 줄였습니다. 블로트 제거, 정보 중복 제거, 도구 문서를 별도 파일로 구성했습니다.

토큰 마스터: AI 에이전트 비용을 30-70% 절약하는 아키텍처 개념
지능형 다중 모델 라우팅에 대한 상세한 아키텍처 접근법으로, 토큰 소비를 극적으로 줄일 수 있습니다.

애매한 프롬프트가 모델보다 진짜 문제다 — 50회 테스트 결과 프롬프트 품질이 모델 선택보다 중요함
한 Reddit 사용자가 ChatGPT 4, Claude Sonnet, Gemini 1.5 Pro에 동일한 열 가지 프롬프트를 각각 다섯 번씩(총 150개 출력) 실행한 결과, 세 모델 모두 비슷하게 사용 가능하거나 비슷하게 평범한 결과를 생성했습니다. 결정적인 요소는 모델이 아니라 프롬프트의 구체성이었습니다.