Context Gateway: Un Proxy de Código Abierto para Comprimir el Contexto de Agentes de IA

Qué hace Context Gateway
Context Gateway es un proxy agéntico que se sitúa entre los agentes de programación de IA (como Claude Code, OpenClaw o Cursor) y la API del LLM. Cuando las salidas de herramientas como lecturas de archivos o resultados de grep vierten miles de tokens en la ventana de contexto, el proxy comprime este contenido antes de que llegue al LLM. La motivación proviene de investigaciones que muestran que los puntos de referencia de contexto largo experimentan caídas pronunciadas en la precisión a medida que crece el contexto: la evaluación GPT-5.4 de OpenAI supuestamente cae del 97,2% con 32k tokens al 36,6% con 1M tokens.
Cómo funciona la compresión
El sistema utiliza modelos de lenguaje pequeños (SLM) que examinan los internos del modelo y entrenan clasificadores para detectar qué partes del contexto contienen la mayor señal. Cuando una herramienta devuelve una salida, la compresión ocurre condicionada por la intención de la llamada a la herramienta. Por ejemplo, si un agente llamó a grep buscando patrones de manejo de errores, el SLM mantiene las coincidencias relevantes y elimina el resto. Si el modelo necesita más tarde algo que fue eliminado, puede llamar a expand() para recuperar la salida original.
Características clave y configuración
- Compactación en segundo plano: Se activa al 85% de la capacidad de la ventana, con resúmenes precalculados para que no esperes la compactación
- Descripciones de herramientas de carga diferida: El modelo solo ve las herramientas relevantes para el paso actual
- Límites de gasto: Controla los costos con límites presupuestarios
- Panel de control: Haz seguimiento de sesiones actuales y pasadas
- Notificaciones de Slack: Recibe alertas cuando un agente está esperando por ti
- Agentes compatibles: Claude Code, Cursor, OpenClaw o configuraciones personalizadas
Comenzar
Instala con:
curl -fsSL https://compresr.ai/api/install | sh
Luego ejecuta context-gateway para iniciar un asistente TUI interactivo que te ayuda a:
- Elegir un agente (claude_code, cursor, openclaw o personalizado)
- Crear/editar configuración incluyendo modelo de resumen y clave API
- Habilitar notificaciones de Slack si es necesario
- Establecer umbral de activación para compresión (predeterminado: 75%)
La herramienta es de código abierto, construida principalmente en Go (90,9%) y mantenida por Compresr, una empresa respaldada por YC. Puedes revisar los registros de compactación en logs/history_compaction.jsonl para ver qué está sucediendo internamente.
📖 Leer la fuente completa: HN LLM Tools
👀 Ver también

Agente de IA Crea Video Autónomamente Usando Remotion Sin Herramientas Predefinidas
Un desarrollador probó un agente de IA que creó de forma autónoma un breve video reel instalando Remotion, escribiendo código de composición, depurando problemas y entregando un archivo renderizado sin intervención humana.

RTX 5060 Ti 16GB en Pruebas de LLM Local: Los Modelos de 30B Siguen Liderando en Codificación
Los benchmarks en una RTX 5060 Ti 16GB muestran que Unsloth Qwen3-Coder-30B UD-Q3_K_XL alcanza 76.3 tok/s en Ubuntu con una puntuación de calidad de 8.14, lo que lo convierte en el modelo de codificación recomendado por defecto. El Unsloth Qwen3.5-35B UD-Q2_K_XL alcanza 80.1 tok/s pero con puntuaciones de calidad más bajas.

skill-depot: Un sistema de memoria y habilidades local-first para agentes de IA compatibles con MCP
skill-depot es un sistema de recuperación que almacena el conocimiento del agente como archivos Markdown y utiliza incrustaciones vectoriales para buscar semánticamente y cargar selectivamente solo el contenido relevante. Se ejecuta 100% localmente sin claves API, funciona con cualquier agente compatible con MCP y se puede configurar con npx skill-depot init.

AIBrain agrega memoria persistente y automejora a Claude Code.
AIBrain es una herramienta que proporciona a Claude Code memoria persistente entre sesiones con búsqueda semántica y ciclos de auto-mejora. Incluye 53 flujos de trabajo, 44 habilidades, 9 servidores MCP y soporta redes malladas multiagente a través de Tailscale.