La Gestión de Contexto de OpenClaw Criticada por ser Intensiva en Tokens y con Fallas Arquitectónicas

Un usuario de Reddit ha publicado una crítica detallada de la arquitectura de OpenClaw, apuntando específicamente a su enfoque de gestión del contexto. La publicación argumenta que el framework maneja el estado de manera ineficiente al tratar la ventana de contexto del LLM como un "vertedero" mediante descargas de contexto perezosas y de todo o nada.
Cómo maneja el contexto OpenClaw
Según la fuente, OpenClaw carece de una gestión de estado adecuada y de aislamiento de estado efímero. Cada vez que el agente da un paso, la nueva acción se agrega ciegamente al historial global. En tres turnos, el prompt se infla con:
- El prompt global del sistema
- Todo el archivo de memoria a largo plazo del usuario
- Una lista de cada herramienta disponible
- La salida cruda del último comando
- Todas las acciones anteriores
El problema con los modelos más pequeños
La publicación describe lo que sucede al ejecutar OpenClaw en modelos más rápidos y económicos como las variantes Flash o Mini:
- Los modelos más pequeños sufren del síndrome de "perderse en el medio" cuando se ahogan en 50k+ tokens de salidas antiguas de terminal, registros de herramientas y prompts globales de personalidad
- Estos modelos literalmente olvidan el objetivo original
- O bien alucinan que la tarea ya está completa
- O quedan atrapados en un bucle infinito llamando exactamente la misma herramienta con exactamente los mismos argumentos
La dependencia de Claude Opus
La crítica se extiende a la dependencia de OpenClaw de modelos frontera:
- OpenClaw afirma que sus agentes son "altamente capaces", pero esta capacidad proviene de apoyarse en modelos frontera masivos como Claude Opus
- Claude Opus puede mirar un "incendio de basurero" de 80,000 tokens e ignorar exitosamente 79,500 tokens de basura histórica inútil para deducir el siguiente paso
- Esto crea la ilusión de que el framework está bien construido cuando en realidad, Opus está enmascarando incompetencia arquitectónica
- Los usuarios terminan pagando precios de API de nivel Opus para que un LLM de última generación actúe como un "filtro de basura glorificado" para un contexto mal diseñado
Recomendaciones arquitectónicas
La publicación aboga por una mejor ingeniería en lugar de la fuerza bruta:
- Una simple tarea de navegador o terminal de múltiples pasos no debería requerir un modelo de un billón de parámetros
- Si está correctamente diseñado, el bucle debería obligar al modelo a observar el entorno y alimentarlo exactamente con lo que necesita ver en este momento y absolutamente nada más
- Este enfoque podría lograr la misma tasa de éxito usando una fracción del cómputo en modelos más baratos y rápidos
📖 Read the full source: r/openclaw
👀 Ver también

La Necesidad de Gobernanza Relacional en Sistemas Multiagente
Los marcos de gobernanza actuales se centran en la identidad, los permisos y los interruptores de emergencia, pero no abordan la coordinación entre agentes. Las investigaciones muestran que las interacciones entre agentes requieren soluciones específicas más allá de las conversaciones entre humanos y agentes ampliadas.

Claude AI presenta actualizaciones del complemento Cowork con personalización empresarial y nuevos conectores.
Claude AI ha lanzado actualizaciones del complemento Cowork que permiten a los administradores empresariales crear mercados privados de complementos y agregar conectores para Google Workspace, Docusign, Apollo y otras herramientas. Una nueva vista previa de investigación permite a Claude trabajar en Excel y PowerPoint para análisis integrales y creación de presentaciones.

La memoria del agente no es un problema de almacenamiento: es un problema de autoridad
Un desarrollador argumenta que la memoria de los agentes falla no por errores de recuperación, sino porque todas las notas regresan con igual autoridad. La solución: un gráfico con roles, vencimiento y campos de activación.

Modelos locales vs en la nube: Qwen-3.6-27B, Gemma-4-31B, Claude Haiku, Codex-Spark en generación de código complejo
Un usuario probó Qwen-3.6-27B (q4_k_m) localmente en una RTX 5080 contra Gemma-4-31B, Claude Haiku 4.5 y Codex-Spark basados en API en una tarea compleja de código. Solo Codex-Spark produjo código completo (pero con errores de importación); todos los demás fallaron parcialmente. Costo: Gemma usó $0.112 por 803k tokens de entrada.