Qwen3.6-27Bが単一の24GB GPUに収まり、SWE-benchで以前の397B MoEを上回る性能を達成

✍️ OpenClawRadar📅 公開日: April 29, 2026🔗 Source
Qwen3.6-27Bが単一の24GB GPUに収まり、SWE-benchで以前の397B MoEを上回る性能を達成
Ad

Qwen3.6-27Bが4月22日にリリースされました。これは27Bの高密度モデルで、Q4_K_M(約16.8GB)で1つの24GB GPUに収まり、SWE-bench Verifiedで77.2のスコアを記録し、以前の397B MoEモデル(76.2)を上回っています。コンシューマーハードウェアでローカルコーディングエージェントを実行する開発者にとって、これは有能なエージェントモデルの敷居を変えるものです。

主な仕様とアーキテクチャ

  • 262Kコンテキスト長
  • Apache 2.0ライセンス
  • Gated DeltaNet線形注意機構(4つのサブレイヤーのうち3つ)と残りにGated Attention
  • Thinking Preservationにより、ターン間で推論トレースを引き継ぎ、冗長なトークン生成を削減し、長いエージェントセッションでのKVキャッシュ効率を向上

ハードウェア要件

Q4_K_Mでは、モデルは約16.8GBのVRAMを使用し、1枚の24GBカード(例:RTX 3090/4090、A10G)に快適に収まります。対照的に、Qwen3-Coder-Next(80B MoE、3Bアクティブ)では、同じ量子化で45〜80GB必要であり、デュアルGPUセットアップまたは48GB以上のユニファイドメモリを搭載したApple Siliconに制限されます。

注意点と落とし穴

  • CUDA 13.2は使用しないでください。出力がガタガタになります。CUDA 13.1または12.xを使用してください。
  • すでに48GB以上のハードウェアでエージェントタスク用にCoder-Nextを実行しているユーザーにとって、切り替えは明らかに有益ではありません。
  • 古いまたは性能の低いローカルコーディングモデルで行き詰まっているシングルGPUユーザーにとって、Qwen3.6-27Bは現在、24GBクラスで最も有能なオプションです。

📖 出典全文: r/LocalLLaMA

Ad

👀 See Also

4ヶ月でClaude Code Intel向けMCPサーバーを構築しMRR 950ドル達成
News

4ヶ月でClaude Code Intel向けMCPサーバーを構築しMRR 950ドル達成

ある個人開発者がコードベースインテリジェンスのMCPサーバーを構築し、4ヶ月で54ユーザー、MRR $950を達成。本業の後に1日8〜10時間働き、広告もグロースハックもなし、RedditとMediumのみ。

OpenClawRadar
クロードの5席最低利用人数制限が、個人開業医にプライバシーのギャップを生む
News

クロードの5席最低利用人数制限が、個人開業医にプライバシーのギャップを生む

Anthropicのビジネス向けプライバシー保護には最低5シートが必要で、個人事業主は空席分を支払うか、不十分なプライバシー条件のコンシューマープランを利用せざるを得ません。このギャップは、Google WorkspaceやOpenAI Business Plansが単一シート価格でエンタープライズレベルのプライバシーを提供していることと対照的です。

OpenClawRadar
Agent.Email: AIエージェントがcurlでサインアップ、人間のOTPでクレーム
News

Agent.Email: AIエージェントがcurlでサインアップ、人間のOTPでクレーム

AgentMailのAgent.EmailはAIエージェントがcurl経由で自己登録できる実験的サービス。人間がOTPでアカウントを主張するまで、機能は制限される。

OpenClawRadar
Cowork VMサービスがWindows 11で失敗する原因はDCOMレジストリエントリの欠如です
News

Cowork VMサービスがWindows 11で失敗する原因はDCOMレジストリエントリの欠如です

ユーザーがCoworkのバグを診断し、Windows 11 HomeからProにアップグレードした環境でVMサービスが起動しない問題を特定しました。欠落しているDCOM APPID {15C20B67-12E7-4BB6-92BB-7AFF07997402}がHyper-Vとの通信を妨げており、Anthropicによる修正が必要です。

OpenClawRadar