OpenClaw突破33K上下文限制:如何修复
r/openclaw의 한 개발자는 OpenClaw에서 262K 컨텍스트 창을 구성했음에도 불구하고 지속적인 33K 토큰 컨텍스트 제한이 발생한다고 보고합니다. 이 문제는 Qwen3.8-27B를 포함하여 로컬에서 로드하는 모든 모델에 영향을 미치며, OpenClaw의 통제 범위를 벗어난 것으로 보입니다.
상황
사용자는 컨텍스트 창을 올바르게 설정했습니다:
openclaw config set agents.defaults.contextWindow 262144OpenClaw는 모델이 262144 토큰을 지원한다고 인정하지만, 약 33K 토큰 이후 응답이 저하되어 Telegram에서 /compact 또는 /new 명령을 자주 실행해야 합니다. ollama ps를 실행하면 모델의 기본 용량과 관계없이 33K 컨텍스트만 로드된 것을 확인할 수 있습니다.
근본 원인
문제는 OpenClaw가 아니라 Ollama에 있을 가능성이 높습니다. Ollama는 OLLAMA_CONTEXT_LENGTH 환경 변수나 Modelfile의 num_ctx 매개변수로 재정의하지 않는 한 기본 컨텍스트 크기(종종 4096 또는 8192)를 사용합니다. OpenClaw는 Ollama에 컨텍스트 길이를 전달하지 않으므로 Ollama는 작은 창으로 로드됩니다.
해결 방법
- OLLAMA_CONTEXT_LENGTH 설정: Ollama를 시작하기 전에 환경 변수를 262144로 설정하세요.
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfile 업데이트: 사용자 정의 모델을 사용하는 경우 매개변수를 추가하세요.
그리고 모델을 다시 생성하세요.PARAMETER num_ctx 262144 - Docker 확인: Ollama가 Docker에서 실행되는 경우
docker run -e OLLAMA_CONTEXT_LENGTH=262144를 통해 환경 변수가 전달되는지 확인하세요.
추가 참고 사항
수정 후 ollama ps로 로드된 컨텍스트를 확인할 수 있습니다. 새 크기가 표시되어야 합니다. 또한 일부 클라이언트가 지원하는 요청의 num_ctx와 함께 Ollama의 OpenAI 호환 엔드포인트를 사용하는 것도 고려해 보세요.
자세한 내용은 소스 토론을 확인하세요.
📖 전체 소스 읽기: r/openclaw
👀 See Also

CLAUDE.md 부패 방지 방법: 규칙을 코드처럼 다루기
18개월간 실제 사용 경험을 바탕으로 한 개발자가 CLAUDE.md를 100줄 미만으로 유지하는 4가지 원칙을 공유합니다: 인덱스로 사용하기, 규칙과 출처 분리하기, 모든 PR 감사하기, 추가보다 삭제를 더 많이 하기.

/loop 명령어로 하룻밤 사이에 Claude API 6,000달러가 소진된 방법
한 개발자가 claude-opus-4-7에서 30분마다 실행되는 /loop 명령어를 방치했다가 프롬프트 캐싱 만료와 컨텍스트 증가로 하룻밤에 6,000달러를 소진한 사례 — AI 에이전트 자동화에 대한 경고 이야기입니다.

좋은 AI 지원 개발은 작업 수준이 아닌 시스템 수준에서 이루어진다
Reddit 사용자는 AI 에이전트 출력물을 수정하는 대신 제약 조건(예: UI 탐색을 강제하는 린터 규칙)을 설계하는 것이 버그 유형 전체를 영구적으로 방지한다고 설명합니다.

MTP 수용률: 50% 임계값이 투기적 디코딩 이점을 결정한다
추론적 디코딩(Speculative Decoding)을 통한 Gemma-4 26B 기반 MTP(다중 토큰 예측, Multi-Token Prediction)는 초안 토큰 수락률이 50%를 초과할 때만 성능 향상을 보여줌 — M4 Max Studio에서의 mlx-vlm 벤치마크 기준.