Evadiendo el Aislamiento del Sandbox NemoClaw para el Agente Local Nemotron 9B

Solución Local para NemoClaw para Inferencia Totalmente Local
Un desarrollador ha documentado un método para eludir el aislamiento del sandbox de NVIDIA NemoClaw y ejecutar un agente de IA completamente local. NemoClaw, lanzado en GTC, es un sandbox empresarial para agentes de IA construido sobre OpenShell (k3s + Landlock + seccomp) que por defecto espera conexiones API en la nube y restringe severamente las redes locales.
Detalles de Implementación Técnica
El desarrollador quería una inferencia 100% local en WSL2 + RTX 5090 y atravesó el sandbox para alcanzar una instancia de vLLM. La solución involucró múltiples componentes:
- Configuración de iptables del host: Permitió el tráfico desde el puente Docker hacia vLLM en el puerto 8000
- Relé TCP del Pod: Relé Python personalizado en el espacio de nombres principal del Pod que conecta el veth del sandbox → puente Docker
- Inyección de iptables en el sandbox: Usó
nsenterpara inyectar una regla ACCEPT en la cadena OUTPUT del sandbox, eludiendo el REJECT predeterminado - Traducción de Llamadas a Herramientas: Construyó una Puerta de enlace personalizada que intercepta la respuesta SSE en streaming de vLLM, la almacena en búfer, analiza la salida de texto
<TOOLCALL>[...]</TOOLCALL>de Nemotron 9B y la reescribe entool_callscompatibles con OpenAI en tiempo real
Esta configuración permite que opencode dentro del sandbox utilice Nemotron como un agente completamente autónomo. Todo se ejecuta localmente sin que los datos salgan de la máquina. La configuración es volátil (los reinicios de WSL2 borran los hacks de iptables), pero permite que un modelo de 9B ejecute comandos de terminal dentro de un contenedor empresarial bloqueado.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Medición del gasto de tokens fuera de tarea en Claude Code: La métrica de 'intención no declarada'
Un desarrollador creó una métrica para cuantificar el cómputo invertido en rutas de ejecución no intencionadas en sesiones de Claude Code, descubriendo que el 22.8% de los tokens se destinaron a tareas fuera del objetivo.

Claude Code obtiene verificación de modelos TLA+ mediante el servidor MCP tla-mcp
tla-mcp es un nuevo servidor MCP que permite a Claude Code invocar al verificador de modelos TLA+ tla-rs como una herramienta de primera clase: valida especificaciones, ejecuta comprobaciones acotadas con trazas de contraejemplos y reproduce escenarios desde el chat.

CLI de código abierto utiliza Claude Haiku para automatizar la auditoría de gastos en Xero.
Un desarrollador ha lanzado una herramienta CLI de Python de código abierto que utiliza Claude Haiku 4.5 para automatizar la auditoría de gastos en Xero. La herramienta sigue un enfoque de 'código determinista primero, luego IA para llenar los vacíos', manteniendo los costos en unos pocos centavos por ejecución de auditoría.

El Registro AbsolutelySkilled Agrega 156 Habilidades Listas para Producción para Claude Code
Un desarrollador ha creado AbsolutelySkilled, un registro de 156 módulos de habilidades estructuradas para Claude Code que persisten entre sesiones. Cada habilidad incluye condiciones de activación, archivos de referencia, casos de prueba y antipatrones en archivos SKILL.md.