로컬 vLLM으로 NemoClaw 실행하기: 설정 노트 및 에이전트 엔지니어링 관찰

vLLM을 이용한 로컬 NemoClaw 설정
개발자가 WSL2에서 vLLM을 사용하여 로컬 Nemotron 9B v2 모델과 함께 NVIDIA의 샌드박스 AI 에이전트 플랫폼인 NemoClaw을 실행한 경험을 공유했습니다. 이 설정은 jieunl24의 NemoClaw 포크를 기반으로 합니다.
주요 기술 세부사항
추론 라우팅: NemoClaw의 추론 라우팅은 깔끔한 경로를 따릅니다: inference.local → gateway → vLLM. 그러나 초기 온보딩 버그로 인해 3계층 네트워크 해킹이 필요했으며, 이는 이후 PR #412를 통해 수정되었습니다.
파서 호환성: 내장된 vLLM 파서(qwen3_coder, nemotron_v3)는 Nemotron v2 모델과 호환되지 않습니다. 대신 NeMo 저장소의 NVIDIA 공식 플러그인 파서를 사용해야 합니다.
에이전트 엔지니어링 격차: 에이전트 플랫폼으로서의 OpenClaw는 견고한 인프라를 제공하지만 최소한의 프롬프트 엔지니어링만 포함하고 있습니다. '모델이 텍스트를 제공한다'와 '에이전트가 유용한 작업을 수행한다' 사이의 격차는 주로 모델 능력의 한계보다는 스캐폴딩에 관한 것입니다.
참고 자료
- 아키텍처, vLLM 파서 설정, 에이전트 엔지니어링 관찰을 다루는 블로그 게시물: https://github.com/soy-tuber/nemoclaw-local-inference-guide/blob/master/BLOG-openclaw-agent-engineering.md
- 추론.local 라우팅 및 네트워크 해킹 없이 설정하는 가이드 (V2): https://github.com/soy-tuber/nemoclaw-local-inference-guide
- 원본 NemoClaw 이슈 #315: https://github.com/NVIDIA/NemoClaw/issues/315
이 설정은 AI 에이전트 플랫폼의 실용적인 로컬 배포를 보여주며, 기술 구현 세부사항과 에이전트 엔지니어링의 지속적인 과제를 모두 강조합니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

mcp-india-stack: 인도 금융 API용 오픈소스 MCP 서버
mcp-india-stack는 GSTIN 검증, IFSC 조회, PAN 검증을 포함한 7개의 인도 금융 및 정부 API 도구에 대한 네이티브 접근을 Claude에 제공하는 오픈소스 MCP 서버입니다. 인증이 필요 없으며, 오프라인 우선 방식으로 작동하고, pip install을 통해 사용할 수 있습니다.

클로드 AI, YC 2026년 봄 모든 스타트업 평가 — 전체 파이프라인 상세
레딧 사용자가 YC Spring 2026 스타트업을 대상으로 Claude를 실행해 LinkedIn과 언론 기사를 스크랩하고 S~D 등급을 할당했습니다. 대부분의 스타트업이 B나 C 등급을 받았습니다.

NGX-OS: eBPF와 MCP 통합으로 AI를 위해 구축된 네트워크 운영 체제
NGX-OS는 AI 통합을 위해 처음부터 설계된 네트워크 운영 체제로, eBPF를 사용한 실시간 원격 측정과 MCP를 통해 번역 계층 없이 네트워크 상태 데이터에 직접 접근할 수 있는 LLM 접근을 제공합니다.

클로드 코드 플러그인은 모든 플러그인을 분석하고 인터랙티브 위키 보고서를 생성합니다.
vision-powers라는 새로운 Claude Code 플러그인이 출시되어, 어떤 플러그인 경로나 GitHub URL을 분석하고 아키텍처 다이어그램, 보안 감사, 기술 분류를 포함한 대화형 HTML 위키 보고서를 생성합니다. 설치 방법은 claude plugin add vision-powers@claude-code-zero입니다.