Correção de Timeout do OpenClaw LLM para Carregamento de Modelo Frio

✍️ OpenClawRadar📅 Publicado: April 15, 2026🔗 Source
Correção de Timeout do OpenClaw LLM para Carregamento de Modelo Frio
Ad

Problema: Timeouts de Modelo Frio em 60 Segundos

Usuários relataram que modelos locais carregados a frio no OpenClaw falhavam consistentemente após aproximadamente 60 segundos, apesar de terem o timeout geral do agente configurado para um valor muito maior. Esse problema também ocorria com modelos em nuvem via Ollama e, às vezes, com o OpenAI Codex.

O padrão típico de falha:

  • Modelos funcionam se já estiverem aquecidos
  • Modelos frios param de funcionar por volta de ~60 segundos
  • Logs mencionam timeout / failover incorporado / status: 408
  • Modelo de fallback assume o controle

Configurações Enganosas

A fonte alerta que várias opções de configuração óbvias NÃO são a solução real e podem levar os desenvolvedores ao caminho errado:

  • agents.defaults.timeoutSeconds
  • exports do .zshrc
  • LLM_REQUEST_TIMEOUT
  • Culpar imediatamente o LM Studio / Ollama
Ad

Causa Raiz

O problema surge porque o OpenClaw tem um timeout de inatividade do LLM do embedded-runner separado para o período antes do modelo emitir o primeiro token transmitido.

Rastreamento da fonte encontrado em:

src/agents/pi-embedded-runner/run/llm-idle-timeout.ts

Valor padrão:

DEFAULT_LLM_IDLE_TIMEOUT_MS = 60_000

O caminho de configuração é resolvido a partir de:

cfg?.agents?.defaults?.llm?.idleTimeoutSeconds

Portanto, o parâmetro de configuração real é:

agents.defaults.llm.idleTimeoutSeconds

A Correção

Após testes, a configuração que funciona é:

{
  "agents": {
    "defaults": {
      "llm": {
        "idleTimeoutSeconds": 180
      }
    }
  }
}

Testes mostraram que uma chamada fria ao Gemma, que anteriormente falhava por volta de 60 segundos, sobreviveu além desse limite e eventualmente respondeu com sucesso sem failover imediato.

Configuração Permanente Recomendada

{
  "agents": {
    "defaults": {
      "timeoutSeconds": 300,
      "llm": {
        "idleTimeoutSeconds": 300
      }
    }
  }
}

A recomendação de 300 segundos leva em conta que modelos locais são imprevisíveis, onde failovers falsos são mais problemáticos do que esperar mais tempo por modelos genuinamente frios.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Agentes de Auditoria em Paralelo: Uma Abordagem Prática para Testes Codificados por Vibração com Claude
Tips

Agentes de Auditoria em Paralelo: Uma Abordagem Prática para Testes Codificados por Vibração com Claude

Um desenvolvedor construiu um sistema de teste de usuários com Claude usando 10 agentes de auditoria paralelos cobrindo detecção de alucinação, sentinela de API, teste de estresse de UI, anonimização de PII, SEO, conformidade legal, simulação comportamental, personas demográficas, teste de funil e verificação de fatos.

OpenClawRadar
Correção do proxy OpenClaw Discord para problemas de tempo limite da API REST
Tips

Correção do proxy OpenClaw Discord para problemas de tempo limite da API REST

Um usuário relata corrigir problemas de conexão do Discord OpenClaw onde o WebSocket conecta, mas as chamadas da API REST falham com erros "fetch failed UND_ERR_CONNECT_TIMEOUT". A solução envolve criar um arquivo proxy-preload.cjs e configurar as configurações globais de proxy undici.

OpenClawRadar
Problemas de Quantização do Cache KV em Agentes de Codificação Locais com Altos Comprimentos de Contexto
Tips

Problemas de Quantização do Cache KV em Agentes de Codificação Locais com Altos Comprimentos de Contexto

Uma análise do Reddit identifica a quantização agressiva do cache KV como a causa de loops infinitos de correção e saídas JSON malformadas em agentes de codificação locais como Qwen3-Coder e GLM 4.7 em contextos de 30k+ tokens, recomendando precisão mista ou contexto reduzido como soluções alternativas.

OpenClawRadar
20 Comandos do Claude Code que Todo Desenvolvedor Deve Conhecer
Tips

20 Comandos do Claude Code que Todo Desenvolvedor Deve Conhecer

Uma postagem no Reddit lista 20 comandos do Claude Code para interromper tarefas, gerenciar contexto, ramificar, controle remoto e atalhos de produtividade como /compact, /branch e /simplify.

OpenClawRadar