Alojamiento local de vLLM en 2x 2080 Ti modificadas para OpenClaw: Experiencia del mundo real

✍️ OpenClawRadar📅 Publicado: 1 de mayo de 2026🔗 Source
Alojamiento local de vLLM en 2x 2080 Ti modificadas para OpenClaw: Experiencia del mundo real
Ad

Un usuario de Reddit en r/openclaw describe su configuración para alojar IA local usando dos GPUs 2080 Ti modificadas de 22GB compradas en Alibaba, conectadas mediante NVLink, y ejecutando vLLM en lugar de Ollama para paralelismo tensorial. Su objetivo es un modelo de 20-30B parámetros y pide recomendaciones de la comunidad para tareas ligeras de coding, mantenimiento de homelab, RAG, clasificación de correos y creación de documentos, dejando las tareas pesadas de coding a un servicio Codex OAuth.

Detalles clave del post:

  • Hardware: 2x 2080 Ti (modificadas) de 22GB de Alibaba, probablemente tarjetas mineras reacondicionadas. Puente NVLink las interconecta.
  • Software: vLLM elegido sobre Ollama explícitamente para aprovechar el paralelismo tensorial entre ambas GPUs.
  • Objetivo: Ejecutar un modelo local en el rango de 20-30B parámetros para OpenClaw, con tareas que incluyen coding ligero, gestión de homelab, RAG, clasificación de correos y generación de documentos.
  • El usuario expresa arrepentimiento de compra y busca validación o sugerencias prácticas de modelos.

La discusión comunitaria (enlazada abajo) ofrece relatos de primera mano de configuraciones similares, recomendaciones de modelos (por ejemplo, CodeLlama, DeepSeek Coder o modelos de propósito general como Mixtral 8x7B) y consejos sobre optimización de memoria e ingeniería de prompts para vLLM. Algunos comentaristas advierten sobre la fiabilidad de las GPUs modificadas y sugieren probar primero con modelos más pequeños.

Ad

📖 Leer la fuente completa: r/openclaw

Ad

👀 Ver también

Plataforma de Rol B2B Usa Opus 4.7 para Backend y Haiku 4.5 para Chat en Vivo
Casos de uso

Plataforma de Rol B2B Usa Opus 4.7 para Backend y Haiku 4.5 para Chat en Vivo

Socratize (socratize.io) utiliza Opus 4.7 para la orquestación y evaluación de ganancias/pérdidas, y Haiku 4.5 para el chat en tiempo real debido a su mejor amabilidad y menor costo.

OpenClawRadar
Desarrollador Crea Aplicación de Finanzas Personales en un Mes Usando Claude Code: Flujos de Trabajo Clave y Desafíos
Casos de uso

Desarrollador Crea Aplicación de Finanzas Personales en un Mes Usando Claude Code: Flujos de Trabajo Clave y Desafíos

Un desarrollador con 14 años de experiencia creó y lanzó una aplicación de pronóstico financiero personal a la App Store en aproximadamente un mes usando Claude Code. Identificó tres flujos de trabajo específicos donde Claude Code fue más efectivo y compartió desafíos con la expansión del alcance y la complejidad del modelo de datos.

OpenClawRadar
Sistema Automatizado de Diario de Desarrollo Diario con Integración de Discord
Casos de uso

Sistema Automatizado de Diario de Desarrollo Diario con Integración de Discord

Un sistema que captura la actividad de desarrollo de Discord, genera resúmenes visuales y publica automáticamente entradas de blog diarias utilizando kabi-discord-cli, trabajos cron y despliegue en GitHub/Vercel.

OpenClawRadar
Construyendo Agentes de IA sin Código con Claude Code: Tres Ejemplos Prácticos
Casos de uso

Construyendo Agentes de IA sin Código con Claude Code: Tres Ejemplos Prácticos

Un usuario de Reddit comparte su configuración personal para crear agentes de IA utilizando Claude Code, detallando tres implementaciones específicas: un agente de resumen matutino automatizado que extrae información de correos electrónicos, tareas pendientes y calendario; una canalización basada en tmux para capturar artículos de Substack; y un agente de resumen de reuniones.

OpenClawRadar