NVIDIA DGX Sparkコミュニティ、再現可能なLLMベンチマークのためのSpark Arenaを立ち上げ

NVIDIA DGX Sparkコミュニティは、DGX Sparkハードウェア上でのオープンウェイト大規模言語モデルの再現可能なベンチマークプラットフォーム「Spark Arena」を確立し、従来の一貫性のないレポートの問題に対処しました。
背景と課題
NVIDIAは2025年10月中旬に、ローカルで大規模モデル(約200Bパラメータモデルの推論を含む)を実行可能な統一メモリを備えたデスクトップボックスとしてDGX Sparkの出荷を開始しました。コミュニティは「誰もが部分的な結果を投稿し、2週間後には誰も再現できなくなる」という繰り返し発生する問題を特定しました。
標準化された方法論
2025年10月14日、u/ggerganovはllama.cppにDGX Spark性能スレッドを投稿し、明確な方法論を提示しました:複数のコンテキスト深度とバッチサイズにわたるプリフィル(pp)と生成/デコード(tg)を測定し、llama.cpp CUDAビルドとllama-benchおよびllama-batched-benchを使用します。
コミュニティによる解決策
コミュニティは、ランタイムイメージ構築、オーケストレーション、レシピ形式のための標準化ツールに合意し、2026年2月11日にSpark Arenaを立ち上げました。
現在の性能リーダー
Spark Arenaからのトップデコードトークン/秒結果:
- gpt-oss-120b(vLLM、MXFP4、2ノード):75.96 tok/s
- Qwen3-Coder-Next(SGLang、FP8、2ノード):60.51 tok/s
- gpt-oss-120b(vLLM、MXFP4、シングルノード):58.82 tok/s
- NVIDIA-Nemotron-3-Nano-30B-A3B(vLLM、NVFP4、シングルノード):56.11 tok/s
実用的な意義
この標準化されたアプローチは、DGX Sparkハードウェア上でオープンウェイトLLMを選択・設定するための信頼性の高い性能データを開発者に提供し、モデルのデプロイメントと最適化に関するより情報に基づいた意思決定を可能にします。
📖 全文を読む: r/clawdbot
👀 See Also

Z世代のAI反発:利用が懐疑を生み、受容には至らず
調査によると、Z世代はAIツールを採用しているが、AI中心の未来には反感を持っている。多くの人がAIを完全に避けるか、機能を無効にしており、雇用への不安、環境問題、社会的影響を理由に挙げている。

OpenAIはカリフォルニア州で年齢確認推進団体に秘密裏に資金提供していた
OpenAIは、AIにおける年齢確認要件を推進するカリフォルニアの団体「Parents and Kids Safe AI Coalition」に秘密裏に資金提供を行い、その関与を他の提唱団体から隠していた。同社は、Parents and Kids Safe AI Act法案を支持するために1000万ドルを約束した。

現在のLLMコスト比較:Deepseek、Qwen、MiniMax対OpenAI
Redditの分析によると、Deepseek-V3.2は100万トークンあたり0.26ドル/0.38ドルで、GPT-4の約10分の1のコストでありながら、GPT-5クラスのベンチマーク性能を提供しています。Qwen3.5とMiniMax-M2.5は、ClaudeやOpenAIに匹敵する競争力のある代替案を提供しています。

Cronの自動更新が設定検証エラーによりOpenClawを破損しました
OpenClawの自動更新を設定したcronジョブが、cliBackendsフィールドの設定検証問題に遭遇し、接続が失われました。問題のあるセクションを削除し、ゲートウェイを再起動することで修正されました。