OpenClaw alcanza el límite de contexto de 33K: Cómo solucionarlo
Un desarrollador en r/openclaw reporta un límite persistente de 33K tokens en el contexto de OpenClaw, a pesar de configurar una ventana de contexto de 262K. El problema afecta a todos los modelos que carga localmente, incluido Qwen3.8-27B, y parece estar fuera del control de OpenClaw.
Qué está sucediendo
El usuario configuró la ventana de contexto correctamente:
openclaw config set agents.defaults.contextWindow 262144OpenClaw reconoce que el modelo soporta 262144 tokens, pero las respuestas se degradan después de ~33K tokens, lo que obliga a usar comandos /compact o /new frecuentes en Telegram. Ejecutar ollama ps revela que el modelo solo tiene un contexto de 33K cargado, independientemente de la capacidad nativa del modelo.
Causa raíz
El problema probablemente está en Ollama, no en OpenClaw. Ollama usa un tamaño de contexto predeterminado (a menudo 4096 o 8192) a menos que se sobrescriba mediante la variable de entorno OLLAMA_CONTEXT_LENGTH o el parámetro num_ctx en Modelfile. OpenClaw no pasa la longitud de contexto a Ollama, por lo que Ollama carga con una ventana pequeña.
Soluciones
- Establecer OLLAMA_CONTEXT_LENGTH: Antes de iniciar Ollama, establezca la variable de entorno a 262144.
export OLLAMA_CONTEXT_LENGTH=262144 - Actualizar Modelfile: Si está utilizando un modelo personalizado, agregue el parámetro
y vuelva a crear el modelo.PARAMETER num_ctx 262144 - Verificar Docker: Si Ollama se ejecuta en Docker, asegúrese de pasar la variable de entorno mediante
docker run -e OLLAMA_CONTEXT_LENGTH=262144.
Notas adicionales
Puede verificar el contexto cargado con ollama ps: debería mostrar el nuevo tamaño después de la corrección. También considere usar el endpoint compatible con OpenAI de Ollama con num_ctx en la solicitud, que algunos clientes soportan.
Para más detalles, consulte la discusión de la fuente.
📖 Lea la fuente completa: r/openclaw
👀 Ver también

Capa de Gobernanza para Agentes Claude: Límites de Seguridad Estrictos y Trazas en Vivo en Producción
Un usuario de la API de Claude construyó una capa de gestión ligera debajo del agente para agregar límites de seguridad estrictos, trazas en tiempo real, control humano en el bucle a través de Telegram y checkpointing automático, resolviendo fallos silenciosos y costos de tokens descontrolados en bucles de agentes de larga duración.

Usando Trabajos Cron de OpenClaw para Tareas Programadas en Lugar de Monitoreo de Latido
Una publicación de Reddit explica cómo usar la función de trabajos cron de OpenClaw para tareas programadas como resúmenes matutinos y triaje de correos, con la bandera crítica --session isolated para evitar la contaminación del contexto, y advierte sobre posibles errores en sesiones aisladas entre versiones.

Ejecutando un Agente de IA Totalmente Local en un Portátil con 6GB de VRAM: Una Guía Paso a Paso para Estudiantes
Explora cómo los estudiantes pueden aprovechar laptops con 6GB de VRAM para ejecutar agentes de IA localmente, sin depender de costosas APIs. Nuestra guía desglosa pasos y herramientas esenciales.

Inflación de tokens en marcos de agentes: una relación de entrada-salida de 500:1 es normal
Un usuario de un framework de agente auto-alojado reporta ~21k tokens de entrada por mensaje y una proporción de entrada a salida de 500:1 debido a definiciones de herramientas, prompt del sistema y memoria. La comunidad confirma que un contexto base de 15-25k es común para agentes que usan herramientas.