Executando o OpenClaw com LLM Local em um VPS da Contabo: Qwen 3:4B trava, soluções alternativas

✍️ OpenClawRadar📅 Publicado: August 21, 2026🔗 Source
Ad

Um usuário no r/openclaw está testando o OpenClaw com um LLM local em uma VPS da Contabo para reduzir custos com tokens. A configuração: 6 núcleos de CPU, 12 GB de RAM, 200 GB SSD, sem GPU, Ubuntu. Eles instalaram o Ollama e usaram o Codex para fazer o heartbeat funcionar com um modelo minúsculo, mas o Qwen 3:4B continua travando após um erro de compactação. Aqui está o que eles descobriram.

Limitações de hardware

A VPS não tem GPU, então o tamanho do modelo é limitado. O Contabo do usuário: 6 vCPUs, 12 GB de RAM, 200 GB NVMe. Isso é suficiente para modelos Ollama pequenos, mas o Qwen 3:4B (4B parâmetros) está no limite—especialmente durante a inferência, quando a memória aumenta.

Problemas com Qwen 3:4B

  • Primeiro erro: erro de compactação—provavelmente devido à pressão de memória ou problemas no sistema de arquivos.
  • Depois de resolver isso, o modelo simplesmente trava—sem saída, sem crash.
  • O Codex (agente de codificação por IA) disse que o Qwen deveria funcionar no servidor, mas na prática é instável.

O usuário desistiu e voltou a usar o Grok como LLM padrão, pois tem um bom plano com eles—mas quer uma opção local confiável.

Ad

O que funciona

O modelo Ollama minúsculo (provavelmente tinyllama ou phi3:mini) funciona bem e cuida do heartbeat sem chamadas de API externas. O usuário sugere usar um modelo local para raciocínio básico e reservar LLMs em nuvem, como Grok ou Claude, para tarefas complexas.

Dicas práticas

  • Comece com um modelo menor: llama3.2:1b ou phi3:mini (3.8B) podem rodar melhor que o Qwen 3:4B em 12GB de RAM.
  • Monitore a memória com htop ou free -m—se a swap for usada, o desempenho cai.
  • Defina OLLAMA_NUM_PARALLEL=1 para reduzir o uso de memória.
  • Considere adicionar um arquivo de swap se ainda não tiver: fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.

O tópico é um lembrete de que LLMs locais em VPSs de baixo custo são possíveis, mas exigem seleção cuidadosa do modelo. Se você não é programador (como o autor original, um cara de hipotecas), a curva de aprendizado é íngreme, mas a comunidade está disposta a ajudar.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Criador de IA no YouTube Relata Ganhos com Monetização e Mudança no Fluxo de Trabalho
Use Cases

Criador de IA no YouTube Relata Ganhos com Monetização e Mudança no Fluxo de Trabalho

Um desenvolvedor que usa o Claude Opus 4.6 para roteirização relatou ganhar US$ 12,20 com 28.400 visualizações em seu canal do YouTube gerado por IA, o que levou a uma mudança para a criação de conteúdo freelance para empresas.

OpenClawRadar
Pesquisadores Usam Projetos Claude para Revisão de Escopo Acadêmica: Pontos Fortes e Limitações
Use Cases

Pesquisadores Usam Projetos Claude para Revisão de Escopo Acadêmica: Pontos Fortes e Limitações

Pesquisadores utilizaram o Claude Projects para auxiliar em uma revisão de escopo revisada por pares de 39 estudos qualitativos de entrevista sobre as experiências de estudantes com IA generativa no ensino superior. A ferramenta demonstrou pontos fortes específicos no cruzamento de referências de temas e na sugestão de categorias analíticas, mas exigiu verificação rigorosa em relação aos dados de origem.

OpenClawRadar
Usuário do Reddit relata 30% de desperdício orçamentário com "imposto de reinicialização" de agentes de IA e compartilha solução de checkpointing
Use Cases

Usuário do Reddit relata 30% de desperdício orçamentário com "imposto de reinicialização" de agentes de IA e compartilha solução de checkpointing

Um desenvolvedor no r/LocalLLaMA descobriu que sua equipe estava gastando 30% do orçamento de IA em reinicializações quando os fluxos de trabalho falhavam no meio das tarefas. Eles implementaram pontos de verificação para cada chamada de ferramenta, o que reduziu imediatamente os custos da API ao eliminar o processamento redundante.

OpenClawRadar
Construindo uma Plataforma SaaS de Produção com Mais de 20 Mil Linhas de Código com Claude Code: Lições da Engenharia de Agentes em Escala
Use Cases

Construindo uma Plataforma SaaS de Produção com Mais de 20 Mil Linhas de Código com Claude Code: Lições da Engenharia de Agentes em Escala

Um desenvolvedor disponibilizou em código aberto o LastSaaS, um boilerplate SaaS pronto para produção construído inteiramente por meio de conversa com o Claude Code, apresentando backend em Go, frontend em React, autenticação multi-inquilino, faturamento via Stripe e um servidor MCP integrado. O projeto revela o que funciona e exige disciplina ao usar agentes de IA para desenvolvimento em larga escala.

OpenClawRadar