Ejecutando OpenClaw con LLM Local en un VPS de Contabo: Qwen 3:4B se cuelga, Soluciones

✍️ OpenClawRadar📅 Publicado: 21 de agosto de 2026🔗 Source
Ad

Un usuario en r/openclaw está probando OpenClaw con un LLM local en un VPS de Contabo para reducir costos de tokens. Su configuración: 6 núcleos de CPU, 12 GB de RAM, 200 GB SSD, sin GPU, Ubuntu. Instaló Ollama y usó Codex para poner en marcha el heartbeat con un modelo pequeño, pero Qwen 3:4B se cuelga después de un error de compactación. Esto es lo que encontró.

Limitaciones de hardware

El VPS no tiene GPU, por lo que el tamaño del modelo es limitado. El Contabo del usuario: 6 vCPU, 12 GB de RAM, 200 GB NVMe. Eso es suficiente para modelos pequeños de Ollama, pero Qwen 3:4B (4B parámetros) está al límite, especialmente durante la inferencia donde la memoria se dispara.

Problemas con Qwen 3:4B

  • Primer error: error de compactación—probablemente por presión de memoria o problemas del sistema de archivos.
  • Después de resolverlo, el modelo simplemente se cuelga—sin salida, sin bloqueo.
  • Codex (el agente de codificación con IA) dijo que Qwen debería funcionar en el servidor, pero en la práctica es inestable.

El usuario se rindió y volvió a Grok como LLM predeterminado porque tiene una buena oferta—pero quiere una opción local confiable.

Ad

Lo que funciona

El modelo pequeño de Ollama (probablemente tinyllama o phi3:mini) funciona bien y maneja el heartbeat sin llamadas API externas. El usuario sugiere usar un modelo local para razonamiento básico y reservar LLMs en la nube como Grok o Claude para tareas complejas.

Consejos prácticos

  • Empieza con un modelo más pequeño: llama3.2:1b o phi3:mini (3.8B) pueden funcionar mejor que Qwen 3:4B en 12GB de RAM.
  • Monitorea la memoria con htop o free -m—si se usa swap, el rendimiento cae.
  • Establece OLLAMA_NUM_PARALLEL=1 para reducir el uso de memoria.
  • Considera agregar un archivo de swap si no lo tienes: fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.

El hilo es un recordatorio de que los LLM locales en VPS de bajos recursos son posibles pero requieren una selección cuidadosa del modelo. Si no eres programador (como el autor original, un tipo de hipotecas), la curva de aprendizaje es empinada, pero la comunidad está dispuesta a ayudar.

📖 Lee la fuente completa: r/openclaw

Ad

👀 Ver también

Paralelización Masiva de Código Claude: Lecciones de la Construcción de una Aplicación de 220K Líneas
Casos de uso

Paralelización Masiva de Código Claude: Lecciones de la Construcción de una Aplicación de 220K Líneas

Un desarrollador sin formación formal en programación creó una aplicación móvil full-stack utilizando Claude Code, ejecutando 3-4 instancias paralelas para procesar 4 mil millones de tokens en más de 500 archivos. Las técnicas clave incluyen documentos de traspaso, archivos CLAUDE.md, comandos personalizados con barra diagonal y auditorías sistemáticas del código base.

OpenClawRadar
Usuario Implementa Asistente de IA 'Elvis' en VPS para Tareas de Gestión de Proyectos
Casos de uso

Usuario Implementa Asistente de IA 'Elvis' en VPS para Tareas de Gestión de Proyectos

Un desarrollador pasó tres días configurando un asistente de IA llamado 'Elvis' en un VPS Linux, integrándolo con Microsoft Teams, JIRA, Asana y sistemas de correo electrónico. El asistente manejó con éxito tareas de gestión de proyectos, incluyendo leer correos electrónicos, extraer requisitos, actualizar solicitudes de cambio y coordinar con miembros del equipo.

OpenClawRadar
Ejecutar OpenClaw con Credenciales Completas de la Nube en Lugar de una Máquina Dedicada
Casos de uso

Ejecutar OpenClaw con Credenciales Completas de la Nube en Lugar de una Máquina Dedicada

Un desarrollador comparte su experiencia al darle a OpenClaw una cuenta de GCP completamente aislada con credenciales completas, permitiéndole operar en más de 40 proyectos de GitHub, desplegar alrededor de 30 contenedores Docker, y gestionar almacenamiento, bases de datos e infraestructura de soporte.

OpenClawRadar
Desarrollador Cambia de Cursor a Claude para Acceso Ilimitado a Opus
Casos de uso

Desarrollador Cambia de Cursor a Claude para Acceso Ilimitado a Opus

Un desarrollador migró de Cursor al plan Max de $100 de Claude para obtener uso ilimitado de Sonnet y Opus, encontrándolo más rentable que el gasto mensual de $120 de Cursor con créditos.

OpenClawRadar