El complemento OpenClaw Context Meter muestra el porcentaje de uso del token de Telegram.

Qué hace
El complemento openclaw-context-meter muestra automáticamente el porcentaje de uso de tokens después de cada respuesta del bot de Telegram. Después de cada respuesta, envía un pequeño pie de página como: 📊 45k / 200k (22%). Cuando ocurre compactación (los tokens disminuyen significativamente), muestra: 📊 30k / 200k (15%) — compactado desde 150k.
El problema que resuelve
Anteriormente, no había una forma fácil de ver cuán llena está la ventana de contexto sin escribir constantemente /status. El complemento proporciona visibilidad automática del consumo de tokens.
Recorrido de desarrollo
v1 — El desastre de OOM: Inicialmente usó execSync("openclaw models list --json") para descubrir dinámicamente las ventanas de contexto del modelo. Esto generaba un proceso completo de OpenClaw (~2GB de RAM) cada vez que el complemento se cargaba. Con el complemento cargándose 4-5 veces al inicio (una vez por agente/runtime), esto causaba: 2GB de puerta de enlace + 5 × 2GB subprocesos = 12GB → OOM instantáneo. El asesino de OOM eliminó sshd y NetworkManager, haciendo que los servidores fueran completamente inaccesibles, creando un bucle de reinicio infinito.
v2 — La solución liviana: Ventanas de contexto codificadas para más de 40 modelos. Cero subprocesos, cero sobrecarga de memoria. Realización clave: nunca usar execSync en complementos de OpenClaw, ya que incluso una simple consulta CLI genera todo el runtime con todos los complementos y compilación TypeScript.
Por qué no se necesita bifurcación
El complemento originalmente bifurcó OpenClaw para parchear ganchos before_compaction/after_compaction, pero los cambios ascendentes hicieron esto innecesario:
- v2026.3.13+ — ascendente ahora pasa
sessionId+agentId+sessionKeyen el contexto del gancho de compactación - v2026.3.22+ — notificaciones integradas
🧹 Compactando contexto...(problema #38805) hicieron innecesario su código de compactación - v2026.3.22+ — comando integrado
/usage tokens|full|costpara visualización básica de tokens
El complemento ahora se enfoca en lo que aún falta: visualización del porcentaje de ventana de contexto.
Características
- Sin costo — usa ganchos
agent_end+message_sentsolamente, sin llamadas API adicionales - Sin subprocesos — las ventanas de contexto del modelo están codificadas (sin riesgo de OOM por
execSync) - Filtrado inteligente — omite turnos
tool_use, solo envía pie de página después de la respuesta de texto final - Con rebote — espera 1.5s después del último mensaje para evitar pie de página a mitad de transmisión
- Multiagente — funciona con múltiples agentes y cuentas de Telegram
- Detección de compactación — detecta caídas de tokens y muestra estadísticas antes/después
Limitaciones conocidas
- Algunos proveedores (como Qwen) devuelven
totalTokens: 0— el pie de página no se mostrará para esos modelos - Las ventanas de contexto codificadas podrían estar incorrectas para modelos más nuevos — extraídas de la fuente v2026.3.22
- Solo Telegram por ahora (envía pie de página a través de Bot API)
Instalación
cd ~/.openclaw/extensions
npm pack openclaw-context-meter
tar xzf openclaw-context-meter-*.tgz
mv package context-meter
rm openclaw-context-meter-*.tgzAgregar a openclaw.json:
{
"plugins": {
"allow": ["context-meter"],
"entries": {
"context-meter": {
"enabled": true
}
}
}
}Requiere OpenClaw >= 2026.3.22.
📖 Leer la fuente completa: r/openclaw
👀 Ver también

Reduciendo la Latencia del Agente Multimodal al Omitir el Historial de Capturas de Pantalla
Un desarrollador descubrió que omitir capturas de pantalla anteriores de las solicitudes de agentes multimodales y reemplazar los datos de imagen en base64 con cadenas "[imagen omitida]" reduce significativamente la latencia mientras mantiene el rendimiento. El experimento se realizó usando Claude y está documentado en GitHub.

Monarch v3: Paginación KV Inspirada en NES para una Inferencia de LLM 78% Más Rápida
Monarch v3 implementa paginación de memoria inspirada en NES para transformadores, logrando una inferencia 78% más rápida (de 17.01 a 30.42 tok/seg) en un modelo de 1.1B parámetros con un consumo de VRAM casi nulo. El algoritmo de código abierto divide la caché KV en regiones calientes y frías con mecanismos de compresión y promoción.

Hipocampo: Un Sistema de Memoria Persistente para Agentes de IA Utilizando Árboles de Compactación
Hipocampus aborda el problema de que los agentes de IA olviden el contexto entre sesiones mediante la implementación de un árbol de compactación que comprime el historial de conversación a través de cinco niveles: crudo → diario → semanal → mensual → raíz, con un índice de temas llamado ROOT.md.

Claude DevTools: Un Lector de Registros para Mejorar la Visibilidad del Código de Claude
Claude DevTools es una herramienta local y de código abierto que lee los archivos de registro existentes de Claude Code en ~/.claude/ para proporcionar visibilidad detallada de las sesiones, incluyendo operaciones de archivos con diferencias en línea, desglose de tokens, visualización de la ventana de contexto y árboles de ejecución completos de subagentes.