Ejecutando OpenClaw con LLM Local en un VPS de Contabo: Qwen 3:4B se cuelga, Soluciones

✍️ OpenClawRadar📅 Publicado: 21 de agosto de 2026🔗 Source
Ad

Un usuario en r/openclaw está probando OpenClaw con un LLM local en un VPS de Contabo para reducir costos de tokens. Su configuración: 6 núcleos de CPU, 12 GB de RAM, 200 GB SSD, sin GPU, Ubuntu. Instaló Ollama y usó Codex para poner en marcha el heartbeat con un modelo pequeño, pero Qwen 3:4B se cuelga después de un error de compactación. Esto es lo que encontró.

Limitaciones de hardware

El VPS no tiene GPU, por lo que el tamaño del modelo es limitado. El Contabo del usuario: 6 vCPU, 12 GB de RAM, 200 GB NVMe. Eso es suficiente para modelos pequeños de Ollama, pero Qwen 3:4B (4B parámetros) está al límite, especialmente durante la inferencia donde la memoria se dispara.

Problemas con Qwen 3:4B

  • Primer error: error de compactación—probablemente por presión de memoria o problemas del sistema de archivos.
  • Después de resolverlo, el modelo simplemente se cuelga—sin salida, sin bloqueo.
  • Codex (el agente de codificación con IA) dijo que Qwen debería funcionar en el servidor, pero en la práctica es inestable.

El usuario se rindió y volvió a Grok como LLM predeterminado porque tiene una buena oferta—pero quiere una opción local confiable.

Ad

Lo que funciona

El modelo pequeño de Ollama (probablemente tinyllama o phi3:mini) funciona bien y maneja el heartbeat sin llamadas API externas. El usuario sugiere usar un modelo local para razonamiento básico y reservar LLMs en la nube como Grok o Claude para tareas complejas.

Consejos prácticos

  • Empieza con un modelo más pequeño: llama3.2:1b o phi3:mini (3.8B) pueden funcionar mejor que Qwen 3:4B en 12GB de RAM.
  • Monitorea la memoria con htop o free -m—si se usa swap, el rendimiento cae.
  • Establece OLLAMA_NUM_PARALLEL=1 para reducir el uso de memoria.
  • Considera agregar un archivo de swap si no lo tienes: fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.

El hilo es un recordatorio de que los LLM locales en VPS de bajos recursos son posibles pero requieren una selección cuidadosa del modelo. Si no eres programador (como el autor original, un tipo de hipotecas), la curva de aprendizaje es empinada, pero la comunidad está dispuesta a ayudar.

📖 Lee la fuente completa: r/openclaw

Ad

👀 Ver también

Optimizando Moltbot con integraciones clave
Casos de uso

Optimizando Moltbot con integraciones clave

Una evaluación de casi todas las integraciones de Moltbot revela qué herramientas realmente mejoran la productividad, destacando integraciones como Telegram y AgentPay.

OpenClawRadar
Desglose de costos del agente de IA: $12 mensual con modelos locales y APIs en la nube.
Casos de uso

Desglose de costos del agente de IA: $12 mensual con modelos locales y APIs en la nube.

Un desarrollador ejecutó un agente de IA durante un mes usando Mac Mini + Ollama para modelos locales y APIs en la nube, con un costo total de $12, donde el 80% fue uso local a $0 y el 20% uso en la nube a ~$12. Un solo bucle de reintento consumió $4.80 en 11 minutos, lo que llevó a implementar un cortacircuitos.

OpenClawRadar
Claude Opus Utilizado para Crear Partido Político de IA con CAPTCHA Inverso
Casos de uso

Claude Opus Utilizado para Crear Partido Político de IA con CAPTCHA Inverso

Un desarrollador creó kifd.org, un partido político ficticio de IA para Alemania, generado completamente por Claude Opus 4.6. El proyecto incluye prompts públicos del sistema para cada miembro del gabinete y un CAPTCHA inverso que requiere demostrar que eres una IA para unirte.

OpenClawRadar
Flujo de Trabajo de Informes de Usuario de OpenClaw con Minimax 2.7 para Edición de Markdown
Casos de uso

Flujo de Trabajo de Informes de Usuario de OpenClaw con Minimax 2.7 para Edición de Markdown

Un usuario describe el uso de Minimax 2.7 a través de Openrouter como una alternativa de menor costo a Claude Cowork para investigación y escritura en Markdown, integrando el sistema con OpenClaw, notas de voz de Telegram, Obsidian y Syncthing para un flujo de trabajo de edición semi-en vivo.

OpenClawRadar