RelayCode Extensión de VS Code Enruta el Código de Claude a Través de RDUs Soberanos

OpenGPU ha lanzado RelayCode, una extensión de VS Code que actúa como un proxy local para agentes de codificación con IA. La herramienta intercepta solicitudes de Claude Code o GitHub Copilot y las redirige a través de la red Relay de OpenGPU hacia modelos de código abierto que se ejecutan en infraestructura soberana.
Detalles Clave
La extensión proporciona varias características específicas y características de rendimiento:
- Infraestructura: Las cargas de trabajo se redirigen a través de las unidades de flujo de datos reconfigurables (RDUs) de Infercom, descritas como cómputo soberano dedicado sin jurisdicción estadounidense y con cumplimiento de GDPR por diseño.
- Rendimiento: Los puntos de referencia muestran más de 250 tokens por segundo en DeepSeek-R1 (671B) y más de 400 tokens por segundo en MiniMax M2.5. El cambio de modelo es casi instantáneo (milisegundos) debido a la arquitectura de flujo de datos.
- Gestión de Contexto: La extensión gestiona automáticamente los ajustes de
CLAUDE_AUTOCOMPACTpara mantener a los agentes dentro de las ventanas de contexto del modelo sin fallos. - Privacidad: El código permanece en la máquina local; solo las solicitudes de inferencia llegan a la red de retransmisión sin retención de datos.
- Estado Actual: El equipo reporta aproximadamente 23 instalaciones y está buscando comentarios sobre la latencia de retransmisión de la comunidad.
- Acceso: Hay créditos promocionales disponibles para probar las velocidades de RDU de forma gratuita.
La herramienta se posiciona como una forma de reducir los costos de la API de Anthropic mientras se mantienen los flujos de trabajo de CLI de Claude, particularmente útil para trabajos de refactorización.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Madar: Compilador de Contexto Local para Claude Code / Cursor — 78% Menos Tokens en el Repositorio NestJS
Madar es un compilador de contexto local de código abierto para agentes de codificación. En un repositorio NestJS + BullMQ (~800 archivos), redujo los tokens de entrada de Claude Code en un 78% y el costo en un 63% para una tarea de explicación. Solo gráficos con alcance.

Cerebro: Un Sistema de Memoria de Errores Persistente para Claude Code mediante MCP
Brain es un servidor MCP de código abierto que le proporciona a Claude Code memoria persistente y entre proyectos para errores y soluciones. Captura el contexto de los errores, sugiere correcciones probadas con puntuaciones de confianza y construye una red de sinapsis ponderada que conecta errores, soluciones y módulos de código en todos los proyectos.

Mente Barril MCP: Memoria Persistente para Código Claude y Agentes Compatibles con MCP
Mind Keg MCP v0.1.1 es un servidor MCP de código abierto que proporciona memoria persistente para Claude Code y otros agentes compatibles con MCP. Almacena aprendizajes localmente mediante SQLite y los recupera mediante búsqueda semántica, permitiendo que los asistentes de codificación con IA recuerden el contexto entre sesiones.

GLM-5-Turbo Muestra una Baja Tasa de Error en Llamadas a Herramientas durante Pruebas de Usuario
El modelo z-ai/glm-5-turbo demuestra una tasa de error promedio del 0.57% en llamadas a herramientas durante las pruebas, significativamente menor que la tasa del ~3% del GLM-5. Un usuario reportó haberlo usado exitosamente con una herramienta CLI para escribir una novela de fantasía de 97,000 palabras con problemas mínimos.