NVIDIA DGX Spark 커뮤니티, 재현 가능한 LLM 벤치마크를 위한 Spark Arena 출시

✍️ OpenClawRadar📅 게시일: March 1, 2026🔗 Source
NVIDIA DGX Spark 커뮤니티, 재현 가능한 LLM 벤치마크를 위한 Spark Arena 출시
Ad

NVIDIA DGX Spark 커뮤니티는 DGX Spark 하드웨어에서 오픈 웨이트 대규모 언어 모델을 위한 재현 가능한 벤치마킹 플랫폼인 Spark Arena를 설립하여, 이전에 존재했던 일관되지 않은 보고 문제를 해결했습니다.

배경과 문제점

NVIDIA는 2025년 10월 중순에 DGX Spark를 데스크탑 박스 형태로 출시하기 시작했으며, 통합 메모리를 통해 대규모 모델을 로컬에서 실행할 수 있어 추론을 위한 약 200B 파라미터 모델도 포함됩니다. 커뮤니티는 "모두가 부분적인 결과만 게시하고, 두 주 후에는 아무도 재현할 수 없다"는 반복적인 문제를 확인했습니다.

표준화된 방법론

2025년 10월 14일, u/ggerganov는 llama.cpp에 DGX Spark 성능 스레드를 게시하며 명확한 방법론을 제시했습니다: 여러 컨텍스트 깊이와 배치 크기에 걸쳐 프리필(pp)과 생성/디코드(tg)를 측정하며, llama.cpp CUDA 빌드와 llama-bench 및 llama-batched-bench를 사용합니다.

커뮤니티 솔루션

커뮤니티는 런타임 이미지 빌딩, 오케스트레이션 및 레시피 형식을 위한 표준화된 도구에 합의하여, 2026년 2월 11일에 Spark Arena를 출시했습니다.

현재 성능 선두주자

Spark Arena의 최고 디코드 토큰/초 결과:

  • gpt-oss-120b (vLLM, MXFP4, 2 노드): 75.96 토큰/초
  • Qwen3-Coder-Next (SGLang, FP8, 2 노드): 60.51 토큰/초
  • gpt-oss-120b (vLLM, MXFP4, 단일 노드): 58.82 토큰/초
  • NVIDIA-Nemotron-3-Nano-30B-A3B (vLLM, NVFP4, 단일 노드): 56.11 토큰/초

실질적 영향

이 표준화된 접근 방식은 개발자들에게 DGX Spark 하드웨어에서 오픈 웨이트 LLM을 선택하고 구성하기 위한 신뢰할 수 있는 성능 데이터를 제공하여, 모델 배포 및 최적화에 대한 더 나은 결정을 내릴 수 있게 합니다.

📖 전체 출처 읽기: r/clawdbot

Ad

👀 See Also

OpenClaw 4.2는 페어링 오류를 수정하고 내구성 있는 작업 흐름을 추가합니다.
News

OpenClaw 4.2는 페어링 오류를 수정하고 내구성 있는 작업 흐름을 추가합니다.

OpenClaw 4.2는 3월 31일경 업데이트한 사용자에게 영향을 미친 페어링 오류를 수정하고, 게이트웨이 연결 끊김 상황에서도 장시간 실행되는 작업이 유지될 수 있도록 하는 내구성 있는 작업 흐름을 도입합니다.

OpenClawRadar
버디가 클로드 에이전트로 직원 70%를 대체하는 30만 달러 이상의 역할을 거절 — 레딧, 도덕적·기술적 현실을 논쟁하다
News

버디가 클로드 에이전트로 직원 70%를 대체하는 30만 달러 이상의 역할을 거절 — 레딧, 도덕적·기술적 현실을 논쟁하다

Reddit 게시물이 워크플로우 매핑, Claude/GPT 에이전트 파이프라인 구축, 그리고 직원의 70%를 해고하는 'AI 전환 책임자' 역할을 거부한 친구에 대해 설명합니다. 게시자는 30만 달러 이상의 조건이 시간을 낭비하고 C-레벨의 망상이 무너지는 것을 지켜보기에 충분히 값지다고 주장합니다.

OpenClawRadar
중국 LLM의 현황: 시장 선도 기업, 오픈 모델 및 비즈니스 모델
News

중국 LLM의 현황: 시장 선도 기업, 오픈 모델 및 비즈니스 모델

레딧 분석은 중국 LLM 현황을 상세히 설명하며, 바이트댄스의 '두바오'를 독점 시장 선두주자로, '딥시크'를 가장 혁신적인 모델로 지목하고, 주요 기업들의 비즈니스 모델과 오픈 웨이트 모델에 집중하는 '육대 AI 소형 호랑이들'을 개괄합니다.

OpenClawRadar
Anthropic의 DoD 회의와 중국 AI 연구소의 Claude 추출
News

Anthropic의 DoD 회의와 중국 AI 연구소의 Claude 추출

Anthropic의 CEO가 미국 국방부 장관과 만나는데, 관계자들은 이 상황을 '제대로 하거나 떠나라'는 분위기라고 묘사했습니다. 한편 회사는 세 개의 중국 AI 연구소가 Claude의 능력을 대규모로 모델 증류하는 것을 적발했다고 보고했습니다.

OpenClawRadar