Executando o OpenClaw com LLM Local em um VPS da Contabo: Qwen 3:4B trava, soluções alternativas
Um usuário no r/openclaw está testando o OpenClaw com um LLM local em uma VPS da Contabo para reduzir custos com tokens. A configuração: 6 núcleos de CPU, 12 GB de RAM, 200 GB SSD, sem GPU, Ubuntu. Eles instalaram o Ollama e usaram o Codex para fazer o heartbeat funcionar com um modelo minúsculo, mas o Qwen 3:4B continua travando após um erro de compactação. Aqui está o que eles descobriram.
Limitações de hardware
A VPS não tem GPU, então o tamanho do modelo é limitado. O Contabo do usuário: 6 vCPUs, 12 GB de RAM, 200 GB NVMe. Isso é suficiente para modelos Ollama pequenos, mas o Qwen 3:4B (4B parâmetros) está no limite—especialmente durante a inferência, quando a memória aumenta.
Problemas com Qwen 3:4B
- Primeiro erro: erro de compactação—provavelmente devido à pressão de memória ou problemas no sistema de arquivos.
- Depois de resolver isso, o modelo simplesmente trava—sem saída, sem crash.
- O Codex (agente de codificação por IA) disse que o Qwen deveria funcionar no servidor, mas na prática é instável.
O usuário desistiu e voltou a usar o Grok como LLM padrão, pois tem um bom plano com eles—mas quer uma opção local confiável.
O que funciona
O modelo Ollama minúsculo (provavelmente tinyllama ou phi3:mini) funciona bem e cuida do heartbeat sem chamadas de API externas. O usuário sugere usar um modelo local para raciocínio básico e reservar LLMs em nuvem, como Grok ou Claude, para tarefas complexas.
Dicas práticas
- Comece com um modelo menor:
llama3.2:1bouphi3:mini(3.8B) podem rodar melhor que o Qwen 3:4B em 12GB de RAM. - Monitore a memória com
htopoufree -m—se a swap for usada, o desempenho cai. - Defina
OLLAMA_NUM_PARALLEL=1para reduzir o uso de memória. - Considere adicionar um arquivo de swap se ainda não tiver:
fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.
O tópico é um lembrete de que LLMs locais em VPSs de baixo custo são possíveis, mas exigem seleção cuidadosa do modelo. Se você não é programador (como o autor original, um cara de hipotecas), a curva de aprendizado é íngreme, mas a comunidade está disposta a ajudar.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Loja de E-commerce com IA se Recupera de Queda às 3h sem Intervenção Humana
Uma loja de e-commerce operada inteiramente por agentes de IA sofreu uma falha de produção às 3h da manhã quando um agente gerou uma exceção não tratada que derrubou o pipeline de pedidos. O sistema lidou com a recuperação de forma autônoma, sem acordar nenhum operador humano.

Usuários do OpenClaw relatam melhorias significativas após mudarem para OAuth da OpenAI com GPT-4
Um desenvolvedor que enfrentava problemas com os modelos Kimi k2.5 e Minimax2.7 no OpenClaw mudou para a conexão OAuth da OpenAI com GPT-4 e pensamento adaptativo, relatando melhorias imediatas de estabilidade e completando múltiplas tarefas de automação em 4-5 horas.

Companhia Matinal Automatizada com Geração de Papel de Parede de Citações Usando Remotion
Um desenvolvedor criou um companheiro matinal automatizado que extrai citações de 107 livros em um cofre do Obsidian, gera resumos personalizados com threads do Reddit e prompts de diário, e depois cria papéis de parede personalizados usando Remotion com seleção de design orientada por IA.

Policial Desenvolve Utilitário de Localização iOS LOC8 Usando Claude Code
Um policial desenvolveu o LOC8, um aplicativo iOS que exibe instantaneamente endereço da rua, cruzamento mais próximo, coordenadas GPS, altitude e precisão usando Claude Code. O aplicativo foi construído incrementalmente com foco em cenários de perseguição a pé para aplicação da lei, mas expandido para uso do público em geral.