Skippy's LLM privado: Cómo resolví el tiempo de espera del subagente de Ollama en OpenClaw llamando a Ollama directamente

✍️ OpenClawRadar📅 Publicado: 19 de junio de 2026🔗 Source
Skippy's LLM privado: Cómo resolví el tiempo de espera del subagente de Ollama en OpenClaw llamando a Ollama directamente
Ad

El sistema de subagentes de OpenClaw tiene un problema persistente de tiempo de espera al usar modelos Ollama. El bucle de eventos de Node.js se bloquea durante la generación, los subagentes se cuelgan durante más de 60 segundos y no producen tokens. Múltiples problemas en GitHub lo confirman: #23827, #27883, #41871, #79032, #63736 — todos reportan el mismo patrón: curl directo funciona, los subagentes no.

La solución descrita por Skippy, un asistente de IA de un COO de OpenClaw, es omitir por completo el sistema de subagentes. En su lugar, ejecuta una segunda instancia de Ollama en el puerto 11435, desacoplada de la instancia principal de chat en el puerto 11434. La instancia principal gestiona el chat normal y las herramientas; la segunda instancia es un trabajador dedicado para análisis pesados (como revisar un clasificador Python de 432 líneas). La IA lo llama mediante un curl directo o un envoltorio Python: sin intermediación de puerta de enlace, sin bloqueo del bucle de eventos, sin contención de VRAM.

Ad
python3 analyze.py \
    --file /tmp/review_prompt.txt \
    --out /tmp/review.md \
    --system "Eres un revisor de código profundo." \
    --timeout 1200 \
    --max-tokens 32768 \
    --temperature 0.3

Flujo de trabajo: escribe el prompt de revisión más el código fuente completo en un archivo temporal, luego ejecuta el script de Python. El modelo de 27B se ejecuta en el puerto 11435, usando ~17.7 GB de VRAM en un Mac Studio M2 Ultra, mientras que el chat principal usa el modelo de 35B en el puerto 11434 (~19.8 GB de VRAM). Skippy informa que la solución funciona de manera confiable, sin más tiempos de espera.

Esta es una solución práctica para cualquiera que enfrente el error de tiempo de espera del subagente Ollama en OpenClaw, especialmente si tienes suficiente VRAM para ejecutar dos instancias del modelo.

📖 Lee la fuente completa: r/openclaw

Ad

👀 Ver también

La auditoría de tokens de Claude Code revela costos ocultos por la carga predeterminada de herramientas.
Consejos

La auditoría de tokens de Claude Code revela costos ocultos por la carga predeterminada de herramientas.

Un desarrollador analizó 926 sesiones de Claude Code y encontró 45,000 tokens cargados al inicio de cada sesión, con 20,000 tokens provenientes de definiciones de esquemas de herramientas del sistema. Habilitar la configuración ENABLE_TOOL_SEARCH redujo el contexto inicial de 45k a 20k tokens, ahorrando 14,000 tokens por turno.

OpenClawRadar
Diseño de Claude: 7 Consejos para Evitar Superar Tus Límites
Consejos

Diseño de Claude: 7 Consejos para Evitar Superar Tus Límites

Bloquea el brief primero en el chat normal de Claude, configura el sistema de diseño antes del primer prompt, adjunta referencias como capturas de pantalla, enlaza subdirectorios no repositorios enteros, usa deslizadores para pequeños ajustes, pega comentarios en línea como respaldo, iguala el formato de exportación al destino.

OpenClawRadar
Instrucciones Personalizadas Esenciales para Claude para Prevenir Molestias Comunes
Consejos

Instrucciones Personalizadas Esenciales para Claude para Prevenir Molestias Comunes

Un usuario de Reddit comparte tres instrucciones personalizadas específicas para abordar molestias comunes de Claude: requerir advertencias antes de comandos destructivos, evitar cambios de plan a mitad de respuesta y mantener los bloques de código exclusivamente para código funcional.

OpenClawRadar
¿Alto uso de CPU/RAM y reinicios de Gateway en OpenClaw? Desactiva IPv6 para Telegram
Consejos

¿Alto uso de CPU/RAM y reinicios de Gateway en OpenClaw? Desactiva IPv6 para Telegram

Establecer autoSelectFamily: false y dnsResultOrder: 'ipv4first' en la configuración del bot de Telegram detiene los errores ENETUNREACH, corrigiendo alto uso de CPU, congelaciones del bucle de eventos y reinicios de la puerta de enlace.

OpenClawRadar