ベンチマーク結果:Apple SiliconとAMD GPU(ROCmおよびVulkan)におけるQwen3.5モデルの比較

✍️ OpenClawRadar📅 公開日: March 26, 2026🔗 Source
ベンチマーク結果:Apple SiliconとAMD GPU(ROCmおよびVulkan)におけるQwen3.5モデルの比較
Ad

ハードウェアとソフトウェアのセットアップ

ベンチマークでは、3つのシステムを比較しました:Apple M5 Max(48GB統合メモリ)搭載のMacBook Pro、Apple M1 Max(64GB統合メモリ)搭載のMac Studio、そしてIntel Core Ultra 7 265Kプロセッサーと3つのAMD GPU(Radeon Pro W7900(48GB、RDNA 3)、Radeon AI PRO R9700(32GB、RDNA 4)、Radeon Pro W6800(32GB、RDNA 2))を搭載したFedora 43 GPUサーバーです。マザーボードはx8/x8/x4の電気的接続を提供し、W6800はチップセット接続のx4スロットに搭載されており、DMIリンクによってボトルネックが生じていました。

推論エンジンとモデル

Appleシステムではmlx-lm(バージョン0.31.1および0.31.0)を使用しました。Fedoraサーバーでは、llama.cppをHIP/ROCmビルド(b5065)とAMDVLK Vulkanビルド(b5065)の両方で実行しました。ROCmバージョンは7.2、AMDVLKバージョンは2025.Q2.1でした。Fedoraでのすべての実行は単一GPUを使用しましたが、122BモデルではW7900 + R9700を--split-mode layerで使用しました。

テストされたモデルは、Qwen3.5-35B-A3B MoE(3Bアクティブパラメータ、mlx-community 4-bitまたはunsloth Q4_K_M)、Qwen3.5-27B dense(27Bパラメータ、mlx-community 4-bitまたはunsloth Q4_K_M)、およびQwen3.5-122B-A10B MoE(10Bアクティブパラメータ、unsloth Q3_K_XL)でした。

Ad

ベンチマーク手法

このベンチマークは、薬剤疫学データ分析のユースケースを反映しています:抽出スクリプトの作成、臨床データに関する推論、規制ナラティブの生成、臨床テキストからの構造化データ抽出です。プロンプトは汎用的なLLMベンチマークではなく、ドメイン固有のものでした。

標準ベンチマークでは、8Kコンテキストと7つのプロンプトを使用しました:2つのプロンプト処理テスト(短い〜27トークンと長い〜2.9Kトークンの入力で、出力を最小限にし、プリフィル速度を分離)と5つの生成タスク(短いコーディング、中程度のコーディング、数学的推論、規制安全ナラティブ作成、構造化有害事象抽出)です。シングルユーザー、シングルリクエスト、温度0.3、/no_thinkで思考モードを無効化、リクエスト間でのプロンプトキャッシングなしでした。

コンテキストスケーリングベンチマークでは、同じモデルとGPUを使用し、段階的に大きなプロンプト(512から16K+トークン)で、合成有害事象リストから構成され、出力トークンは最大64のみとし、入力サイズに応じたプロンプト処理と生成のスケーリングを分離しました。

主な発見

ベンチマークでは、ROCmとAMDVLK Vulkanの興味深い発見が明らかになりました。コンテキストスケーリングテストでは、各バックエンドが最も効果的に機能する条件が示されました。ソースでは、利用可能な比較のほとんどが、M5 MaxノートパソコンとW7900ワークステーションのような構成の選択、またはVulkanよりもROCmをセットアップする手間が価値があるかどうかの判断に役立たないと指摘しています。

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

马里兰州居民为外州AI数据中心承担20亿美元电网升级费用——州政府向FERC提交投诉
News

马里兰州居民为外州AI数据中心承担20亿美元电网升级费用——州政府向FERC提交投诉

メリーランド州人民弁護士事務所は、PJM Interconnectionに対してFERCに苦情を申し立てた。PJMは220億ドルの送電網アップグレードのうち20億ドルをメリーランド州の顧客に割り当てており、住宅用顧客1人あたり約345ドルの負担となり、主に州外のAIデータセンターに利益をもたらすとしている。

OpenClawRadar
Claude Code v2.1.191:/rewind、CPU修正、MCP信頼性向上
News

Claude Code v2.1.191:/rewind、CPU修正、MCP信頼性向上

Claude Code v2.1.191 では、/rewind による会話の復元、ストリーミング時の CPU 使用率の約 37% 削減、エージェントの復活問題の修正、MCP のリトライ機能による信頼性向上などが追加されました。

OpenClawRadar
🦀
News

アトランティック誌報道、高まる反AI暴力と政治的バッシュ

バーニー・サンダースとスティーブ・バノンはいずれもAIを労働者への脅威と非難する。サム・アルトマンの自宅への火炎瓶攻撃やインディアナポリス市議会議員の銃撃事件は、反データセンター暴力の高まりを示している。

OpenClawRadar
Claude Code v2.1.183:より安全な自動モード、TUI修正、破壊的Gitコマンドのブロック
News

Claude Code v2.1.183:より安全な自動モード、TUI修正、破壊的Gitコマンドのブロック

Claude Code v2.1.183では、明示的に依頼しない限り破壊的なgitコマンドをブロックし、モデル非推奨警告を追加、Windows TerminalのTUI破損を修正しました。

OpenClawRadar