NemoClaw 샌드박스 격리 우회를 통한 로컬 Nemotron 9B 에이전트 실행

완전 로컬 추론을 위한 로컬 NemoClaw 우회 방법
한 개발자가 NVIDIA의 NemoClaw 샌드박스 격리를 우회하여 완전 로컬 AI 에이전트를 실행하는 방법을 문서화했습니다. GTC에서 출시된 NemoClaw는 OpenShell(k3s + Landlock + seccomp) 기반의 엔터프라이즈 AI 에이전트 샌드박스로, 기본적으로 클라우드 API 연결을 기대하며 로컬 네트워킹을 엄격히 제한합니다.
기술 구현 세부사항
해당 개발자는 WSL2 + RTX 5090에서 100% 로컬 추론을 원했으며, 샌드박스를 뚫고 vLLM 인스턴스에 도달했습니다. 솔루션에는 여러 구성 요소가 포함되었습니다:
- 호스트 iptables 구성: Docker 브리지에서 포트 8000의 vLLM으로의 트래픽 허용
- Pod TCP 릴레이: Pod의 메인 네임스페이스에서 샌드박스 veth → Docker 브리지를 연결하는 사용자 정의 Python 릴레이
- 샌드박스 iptables 주입:
nsenter를 사용하여 샌드박스의 OUTPUT 체인에 ACCEPT 규칙을 주입하여 기본 REJECT 우회 - 도구 호출 변환: vLLM의 스트리밍 SSE 응답을 가로채고 버퍼링하며, Nemotron 9B의
<TOOLCALL>[...]</TOOLCALL>텍스트 출력을 파싱하여 실시간으로 OpenAI 호환tool_calls로 재작성하는 사용자 정의 게이트웨이 구축
이 구성은 샌드박스 내의 opencode가 Nemotron을 완전 자율 에이전트로 사용할 수 있게 합니다. 모든 것이 로컬에서 실행되며 데이터가 기기를 떠나지 않습니다. 설정은 휘발성(WSL2 재부팅 시 iptables 해킹이 초기화됨)이지만, 9B 모델이 잠긴 엔터프라이즈 컨테이너 내에서 터미널 명령을 실행할 수 있게 합니다.
📖 전체 소스 읽기: r/LocalLLaMA
👀 See Also

ClawCloud 관리형 서비스로 Slack 팀을 위한 OpenClaw 배포가 간편해집니다
ClawCloud는 Slack 워크스페이스에 연결되는 OpenClaw의 관리형 배포 서비스를 제공하여 인프라를 처리하고 응답 지연 시간을 2초 미만으로 줄입니다. 한 사용자가 자체 호스팅에 3일이 걸리는 것과 비교해 20분 만에 설정했으며, 40명 규모 팀의 월 비용은 약 $30 정도라고 보고했습니다.

AskFirst API는 AI 에이전트에 인간 승인 계층을 추가합니다.
AskFirst는 AI 에이전트가 되돌릴 수 없는 조치를 취하기 전에 인간의 승인을 기다릴 수 있도록 하는 REST API입니다. 로컬 모델, 호스팅된 API 및 모든 프레임워크와 함께 작동하며 이메일 알림, 승인/거부 옵션 및 감사 로그를 제공합니다.

에이전트 시스템에서 결정론적 워크플로가 AI 기반 오케스트레이션보다 뛰어난 이유
에이전트 시스템을 1년간 구축한 경험을 가진 개발자가 AI 기반 오케스트레이션이 비결정적 라우팅, 오류 누적, 비용 폭발, 디버깅 불가능으로 인해 신뢰성 있게 실패했다고 밝혔습니다. 코드 기반 오케스트레이션을 사용한 결정적 워크플로우로 전환하여 오케스트레이션 실패를 제거했습니다.

Agent MCP Studio: Build Multi-Agent MCP Systems Entirely in a Browser via WASM
Agent MCP Studio lets you design, orchestrate, and export MCP agent systems from a single static HTML file using WebAssembly – no backend, no Docker, no server.