OpenClaw Atinge o Limite de 33K de Contexto: Como Corrigir Isso

✍️ OpenClawRadar📅 Publicado: August 18, 2026🔗 Source
Ad

Um desenvolvedor no r/openclaw relata um limite rígido de 33K tokens de contexto no OpenClaw, apesar de configurar uma janela de contexto de 262K. O problema afeta todos os modelos que ele carrega localmente, incluindo Qwen3.8-27B, e parece estar fora do controle do OpenClaw.

O que está acontecendo

O usuário configurou a janela de contexto corretamente:

openclaw config set agents.defaults.contextWindow 262144

O OpenClaw reconhece que o modelo suporta 262144 tokens, mas as respostas degradam após ~33K tokens, forçando comandos frequentes de /compact ou /new no Telegram. Executar ollama ps revela que o modelo só carrega um contexto de 33K, independentemente da capacidade nativa do modelo.

Causa raiz

O problema provavelmente está no Ollama, não no OpenClaw. O Ollama usa um tamanho de contexto padrão (frequentemente 4096 ou 8192) a menos que seja sobrescrito pela variável de ambiente OLLAMA_CONTEXT_LENGTH ou pelo parâmetro num_ctx no Modelfile. O OpenClaw não passa o tamanho de contexto para o Ollama, então o Ollama carrega com uma janela pequena.

Ad

Soluções

  • Definir OLLAMA_CONTEXT_LENGTH: Antes de iniciar o Ollama, defina a variável de ambiente para 262144.
    export OLLAMA_CONTEXT_LENGTH=262144
  • Atualizar o Modelfile: Se você estiver usando um modelo personalizado, adicione o parâmetro
    PARAMETER num_ctx 262144
    e recrie o modelo.
  • Verificar o Docker: Se o Ollama roda em Docker, garanta que a variável de ambiente seja passada via docker run -e OLLAMA_CONTEXT_LENGTH=262144.

Notas adicionais

Você pode verificar o contexto carregado com ollama ps — ele deve mostrar o novo tamanho após a correção. Considere também usar o endpoint compatível com OpenAI do Ollama com num_ctx na requisição, que alguns clientes suportam.

Para mais detalhes, confira a discussão na fonte.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

UI Orientado por Anotações: Como Projetar Templates no Figma e Deixar Claude Extrair Coordenadas
Tips

UI Orientado por Anotações: Como Projetar Templates no Figma e Deixar Claude Extrair Coordenadas

Pule a construção de um mecanismo de layout personalizado: crie PNGs planos no Figma, desenhe retângulos coloridos para os slots, alimente ambos ao Claude e obtenha definições de áreas editáveis com alvos de toque. Uma tarde em vez de semanas.

OpenClawRadar
Trabalhos Cron com Fallback de IA Podem Gerar Custos Inesperados de API Quando Ferramentas Trabalham
Tips

Trabalhos Cron com Fallback de IA Podem Gerar Custos Inesperados de API Quando Ferramentas Trabalham

Um usuário relatou que um cron job no OpenClaw que verificava uma caixa de entrada de e-mail a cada 10 minutos usando o himalaya consumiu cerca de US$ 60 em créditos de API quando a conexão IMAP começou a travar, acionando agentes Claude em cada execução com timeout, apesar das instruções para envolver IA apenas para e-mails recebidos.

OpenClawRadar
OpenClaw v2026.3.13 adiciona configuração de cacheRetention por agente para economia de custos com tokens da OpenAI.
Tips

OpenClaw v2026.3.13 adiciona configuração de cacheRetention por agente para economia de custos com tokens da OpenAI.

O OpenClaw v2026.3.13 adiciona a configuração cacheRetention por agente que habilita a retenção de cache de prompt de 24 horas da OpenAI, potencialmente reduzindo os custos de tokens de entrada em até 90% para agentes com ciclos de heartbeat maiores que 10 minutos.

OpenClawRadar
Corrigir Ollama Cloud Model maxTokens: Limite é 16K, não valor configuração
Tips

Corrigir Ollama Cloud Model maxTokens: Limite é 16K, não valor configuração

O Ollama cloud limita a saída em 16.384 tokens, independentemente da configuração de maxTokens. Defina para 14.000 para evitar erros de EOF. Reestruture saídas longas ou direcione para o provedor direto.

OpenClawRadar