開発者がローカルコーディングタスクでQwen3.5 27Bと大規模モデルを比較テスト

開発者がローカルでのコーディングタスク向けに複数の大規模言語モデルをテストし、パフォーマンスとハードウェア要件を比較しました。テストは主にQwen3.5のバリアントとNemotronモデルに焦点を当て、GPT-5.4 Highとの比較も行いました。
テスト結果と発見
開発者がテストした具体的なモデルは以下の通りです:
- unsloth/Qwen3.5-27B-GGUF:UD-Q4_K_XL
- unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
- unsloth/Qwen3.5-122B-A10B-GGUF
- unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL
- unsloth/Qwen3.5-27B-GGUF:UD-Q8_K_XL
- unsloth/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF:UD-IQ4_XS
- unsloth/gpt-oss-120b-GGUF:F16
テストから得られた主な発見:
- Nemotron-3-Super-120Bは「非常に、非常に優れて」おり、GPT-5.4 Highと同等の性能
- Qwen3.5-27Bは開発タスクで良好な性能を発揮
- GPT-OSS-120BとQwen3.5-122Bは他の2つのモデルよりも性能が劣る
- Nemotron-3-Super-120Bは一貫してスペイン語(テスターの母国語)で応答し、他のモデルは英語で応答
パフォーマンス指標
開発者が提供した具体的なパフォーマンス数値:
- Nemotron-3-Super-120B: 80トークン/秒 (tg/s)、約2000プロンプト処理 (pp)、4x RTX 3090でvast.ai上で100kコンテキスト
- Qwen3.5-27B Q6: 803 pp、25 tg/s、vast.ai上で256kコンテキスト
ハードウェア要件
開発者が指摘したハードウェア制約:
- Qwen3.5-122Bは新しいマザーボードと追加の1-2枚のRTX 3090カードが必要で、コストが高すぎる
- Qwen3.5-27Bは既存の2x RTX 3090ハードウェアで追加投資なしで動作
- Nemotron-3-Super-120B用のハードウェアがあれば、そちらを使用するだろう
実装詳細
開発者は実際の開発タスクにQwen3.5-27B-GGUF:UD-Q6_K_XLをローカルで使用する計画で、テストに使用したllama.cppコマンドを提供しました:
./llama.cpp/llama-server -hf unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL --ctx-size 262144 --temp 0.6 --top-p 0.95 --top-k 20 --min-p 0.00 -ngl 999
開発者は、複雑なタスクには引き続きCODEXを使用するが、日常タスクのAPIサブスクリプションをローカルセットアップで置き換えられると述べています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

Claudeタグ: マルチプレイヤーAIコラボレーションのためのSlack上の@Claude
AnthropicがSlackでClaude Tagを発表 — チャンネルで@Claudeをメンションし、ツールを付与して非同期タスクを委任。プロダクトチームのコードの65%がClaudeによって生成。

ByteRoverメモリプラグイン for OpenClaw:セマンティック階層とのネイティブ統合
ByteRover Memory Plugin for OpenClawは、Markdownファイルに保存された3層アーキテクチャとセマンティック階層を介して、ネイティブで構造化された長期メモリを提供します。92.2%の検索精度を達成し、OpenClaw v2026.3.22以降が必要です。

Claude Codeがクラウド環境でANTHROPIC_API_KEYが設定されている場合に静かに失敗する
クラウド環境でANTHROPIC_API_KEYを設定すると、Claude Codeが正常に動作しなくなり、予期しないAPI使用料金が発生する可能性があります。ユーザーからは余分な使用量や応答不能な動作が報告されています。

Radicle 1.8.0 リリース:Git上に構築された分散型ピアツーピアコードフォージ
Radicle 1.8.0は、Git上で動作する自律的でピアツーピアのコードフォージであり、CLI、Web UI、デスクトップクライアントを備えています。リポジトリはNoiseXKとカスタムゴシッププロトコルを使用してピア間で複製され、中央サーバーは不要です。