OpenClaw突破33K上下文限制:如何修复
r/openclaw의 한 개발자는 OpenClaw에서 262K 컨텍스트 창을 구성했음에도 불구하고 지속적인 33K 토큰 컨텍스트 제한이 발생한다고 보고합니다. 이 문제는 Qwen3.8-27B를 포함하여 로컬에서 로드하는 모든 모델에 영향을 미치며, OpenClaw의 통제 범위를 벗어난 것으로 보입니다.
상황
사용자는 컨텍스트 창을 올바르게 설정했습니다:
openclaw config set agents.defaults.contextWindow 262144OpenClaw는 모델이 262144 토큰을 지원한다고 인정하지만, 약 33K 토큰 이후 응답이 저하되어 Telegram에서 /compact 또는 /new 명령을 자주 실행해야 합니다. ollama ps를 실행하면 모델의 기본 용량과 관계없이 33K 컨텍스트만 로드된 것을 확인할 수 있습니다.
근본 원인
문제는 OpenClaw가 아니라 Ollama에 있을 가능성이 높습니다. Ollama는 OLLAMA_CONTEXT_LENGTH 환경 변수나 Modelfile의 num_ctx 매개변수로 재정의하지 않는 한 기본 컨텍스트 크기(종종 4096 또는 8192)를 사용합니다. OpenClaw는 Ollama에 컨텍스트 길이를 전달하지 않으므로 Ollama는 작은 창으로 로드됩니다.
해결 방법
- OLLAMA_CONTEXT_LENGTH 설정: Ollama를 시작하기 전에 환경 변수를 262144로 설정하세요.
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfile 업데이트: 사용자 정의 모델을 사용하는 경우 매개변수를 추가하세요.
그리고 모델을 다시 생성하세요.PARAMETER num_ctx 262144 - Docker 확인: Ollama가 Docker에서 실행되는 경우
docker run -e OLLAMA_CONTEXT_LENGTH=262144를 통해 환경 변수가 전달되는지 확인하세요.
추가 참고 사항
수정 후 ollama ps로 로드된 컨텍스트를 확인할 수 있습니다. 새 크기가 표시되어야 합니다. 또한 일부 클라이언트가 지원하는 요청의 num_ctx와 함께 Ollama의 OpenAI 호환 엔드포인트를 사용하는 것도 고려해 보세요.
자세한 내용은 소스 토론을 확인하세요.
📖 전체 소스 읽기: r/openclaw
👀 See Also

클로드 코드 헤드리스 모드와 --print 플래그
Claude Code는 --print 플래그를 사용하여 헤드리스 모드로 실행할 수 있으며, 이를 통해 프롬프트를 파이프로 입력하여 대화형 세션 없이 자동화된 출력을 얻을 수 있습니다. 이는 CI/CD 파이프라인, git 훅, bash 스크립트에 통합할 수 있게 해줍니다.

클로드 코드는 코드 생성기보다 코드 리뷰어로서 더 나은 성능을 보입니다.
한 개발자는 Claude Code가 처음부터 코드를 생성하는 것보다 기존 코드를 검토하는 데 사용할 때 더 현실적인 결과를 생산한다고 공유합니다. 주요 관행에는 현재 구현으로 세션을 시작하고, 프로젝트 컨텍스트 파일을 유지하며, 응답이 저하될 때 세션을 재시작하는 것이 포함됩니다.

돈을 낭비하고 보안 위험을 초래하는 다섯 가지 일반적인 OpenClaw 설정 실수
50개 이상의 OpenClaw 설정을 검토한 결과, 동일한 다섯 가지 문제가 반복적으로 나타납니다: 대부분의 작업에 Sonnet 대신 Opus를 기본 모델로 사용하는 것, 새 세션을 시작하지 않는 것, 소스 코드를 읽지 않고 스킬을 설치하는 것, 게이트웨이를 네트워크에 노출시키는 것, 첫 번째 에이전트를 수정하기 전에 두 번째 에이전트를 추가하는 것.

OpenClaw 플러그인 미니멀리즘: 핵심 도구로 95%의 작업 처리
OpenClaw를 프로덕션에서 운영하는 개발자가 보고한 바에 따르면, 불필요한 플러그인을 비활성화하고 중요한 플러그인을 간단한 스크립트로 대체한 결과, 시작 속도가 40% 빨라지고 메모리 사용량이 60% 감소했으며 4개월 동안 업데이트로 인한 문제가 전혀 발생하지 않았다고 합니다.