Un plugin escrito por Claw añade soporte para el nivel de pensamiento Qwen 3.8 27B a OpenClaw
¿Ejecutas Qwen 3.8 27B en llama.cpp con OpenClaw 2026.6.9 pero te falta el control nativo del nivel de pensamiento? Un usuario de OpenClaw chocó con el mismo muro y dejó que su agente de IA escribiera un plugin para solucionarlo — totalmente generado, sin ser probado por ojos humanos.
Por qué necesitas este plugin
Qwen 3.8 controla los niveles de pensamiento mediante la plantilla de chat en lugar de un parámetro dedicado. El backend llama.cpp de OpenClaw en la versión 2026.6.9 no mapea esto de fábrica, por lo que los niveles de pensamiento se ignoran o se aplican incorrectamente. El plugin cubre ese vacío.
Qué hace
- Niveles de pensamiento por llamada a la API — inyecta correctamente el valor
enable_thinkingen la plantilla de chat para cada solicitud. - Nivel separado para heartbeats — configura un nivel de pensamiento diferente para las llamadas de heartbeat en segundo plano (el autor usa
xhigh). - Modo instructivo (pensamiento desactivado) — desactiva el pensamiento y aplica los parámetros de muestreo recomendados por unsloth para una salida óptima.
- Guarda de tiempo de espera opcional — fuerza la compactación al modo instructivo para evitar tiempos de espera durante cadenas de razonamiento largas.
Cómo obtenerlo
El plugin está publicado en GitLab:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Nota del autor: "Ni siquiera miré el código" — todo fue escrito por el propio agente de IA. Es una prueba de concepto de que los agentes pueden producir herramientas útiles y compartibles sin revisión humana.
Para quién es
Para cualquiera que ejecute Qwen 3.8 (o modelos similares) en llama.cpp a través de OpenClaw y quiera un control granular sobre los niveles de pensamiento por solicitud. Si dependes de heartbeats o necesitas el modo instructivo como respaldo, esto te ahorra el trabajo de conexión.
📖 Lee la fuente completa: r/openclaw
👀 Ver también

Agente de IA Crea Video Autónomamente Usando Remotion Sin Herramientas Predefinidas
Un desarrollador probó un agente de IA que creó de forma autónoma un breve video reel instalando Remotion, escribiendo código de composición, depurando problemas y entregando un archivo renderizado sin intervención humana.

Marco de Defensa en Capas para la Aplicación de Reglas de Código Claude
Un profesional de operaciones de TI construyó un marco de defensa de 8 capas para hacer cumplir las reglas de Claude Code después de descubrir que tanto los prompts de CLAUDE.md como los hooks de bloqueo podían ser evitados. El enfoque adapta el modelo de queso suizo de la investigación de accidentes para prevenir soluciones alternativas.

Scrapling integrado como columna vertebral de scraping de OpenClaw.
Scrapling, una biblioteca de código abierto que aprende la estructura de las páginas y se adapta a los cambios, se ha integrado en OpenClaw como su motor de scraping central. Es 774 veces más rápido que BeautifulSoup con Lxml y admite múltiples tipos de selectores con sesiones asíncronas.

Culpa: Motor de Reproducción Determinista de Código Abierto para Depuración de Agentes de IA
Culpa es una herramienta de código abierto que registra sesiones de agentes LLM con contexto de ejecución completo, permitiendo reproducción determinista utilizando respuestas grabadas como stubs en lugar de acceder a APIs reales. Funciona con las APIs de Anthropic y OpenAI mediante modo proxy o SDK de Python.