Gemma 4 26B対Qwen 3.5 27B:RTX 4090でのローカル業務ワークフローベンチマーク

✍️ OpenClawRadar📅 公開日: April 17, 2026🔗 Source
Gemma 4 26B対Qwen 3.5 27B:RTX 4090でのローカル業務ワークフローベンチマーク
Ad

Redditユーザーが、プロシューマーワークステーションでのローカルビジネスオペレーターワークフローにおいて、Gemma 4 26BとQwen 3.5 27Bを包括的に比較するベンチマークを実施しました。

テスト環境

ベンチマークは以下のローカルワークステーションで実行されました:

  • RTX 4090 24GB
  • Intel i9-14900KF
  • 64GB RAM
  • Ubuntu 25.10
  • モデル管理にOllamaを使用

テスト方法

これはコーディングベンチマークや単一プロンプトテストではありませんでした。評価では以下を使用しました:

  • 18の有効な直接対決テスト
  • 全テストで同一の信頼できるオファードキュメント
  • 同一の制約、トーン要件、ルールセット
  • 出力は鋭く、現実的で、実用的で、高品質で、オペレーターレベルであることが要求
  • 捏造された統計、偽の保証、誇大宣伝、曖昧なAIコンサルタント的な内容は禁止

結果

最終スコア:Gemma 13勝、Qwen 5勝

主な発見

Gemmaの強み:

  • ユーザー体験を変える劇的な速度の速さ
  • ソースドキュメントの範囲内に留まる規律の高さ
  • 作り話を追加せずに出力を実用的に保つ一貫性
  • 勝利したテスト:要約ベンチマーク、オリジナルオペレーターベンチマーク、逆張りポジショニング、比喩テスト、発見的コール構築、反論対応、フック、ストーリー広告、複数キャンペーンラウンド、技術的設計図テスト、コピーバリデーションエンジンテスト

Qwenの強み:

  • より広範な統合と豊かな心理的枠組み構築の強さ
  • 優れた感情のニュアンスとより広い視点での第二段階の考察
  • 勝利したテスト:逸脱なしの拡張、クライアント選定と優先順位付け、感情的角度の階梯、前後の感情変容、JSONコンパイラテスト
Ad

実践的結論

テスト実施者の結論:Gemmaは実行に優れ、Qwenは拡張に優れている。 Gemmaは、常に見守りが必要なく、ビジネスサイドのソースに基づいたワークフローを実行する信頼できるモデルです。Qwenは、第二意見、より広範な枠組みの検討、またはより感情的にニュアンスのある見解に適しています。

テスト実施者の現在のローカルスタック:

  • Gemma 4 26B:デフォルトのテキストおよびビジネスモデル
  • Qwen3-Coder 30B:コーディングモデル
  • Qwen3-VL 30B:ビジョンモデル
  • GPT-OSS 20B:高速フォールバック

このベンチマークは、「どちらのモデルがより賢いか」ではなく、「どちらのモデルが実際に無意味な内容に逸脱せずに実作業を進めるのに役立つか」についてのものであることを明らかにしました。

📖 Read the full source: r/openclaw

Ad

👀 See Also

read-once: 冗長なファイル読み込みを防ぐClaudeコードフック
Tools

read-once: 冗長なファイル読み込みを防ぐClaudeコードフック

開発者が「read-once」というPreToolUseフックを作成しました。このツールは、Claude Codeがセッション中にすでに読み込んだファイルを追跡し、変更されていないファイルの再読み込みをブロックし、変更されたファイルには差分を使用します。このツールは、Claudeが同じファイル内容を繰り返し読み込むのを防ぐことで、セッションごとに数千トークンを節約します。

OpenClawRadar
cc-session-utils: Claudeコードセッションとコストを管理するTUIダッシュボード
Tools

cc-session-utils: Claudeコードセッションとコストを管理するTUIダッシュボード

開発者がcc-session-utilsをリリースしました。これはClaude Codeセッションファイルを管理し、使用コストを追跡するターミナルUIダッシュボードツールです。このツールは、~/.claudeディレクトリ内に蓄積されるセッションファイル、デバッグログ、孤立データの問題に対処します。

OpenClawRadar
Qwen 3.6 27B量子化ベンチマーク:実用的トレードオフでQ4_K_MがQ8_0を凌駕
Tools

Qwen 3.6 27B量子化ベンチマーク:実用的トレードオフでQ4_K_MがQ8_0を凌駕

BF16、Q4_K_M、Q8_0のGGUF量子化バリアントでQwen 3.6 27BをHumanEval、HellaSwag、BFCLで評価。Q4_K_MはBF16とほぼ同等のスコアを達成しつつ、RAM使用量48%削減、1.45倍の速度、68.8%のファイルサイズ削減を実現。

OpenClawRadar
オープンモンタージュ:AIコーディングアシスタント向けオープンソース・エージェント型映像制作システム
Tools

オープンモンタージュ:AIコーディングアシスタント向けオープンソース・エージェント型映像制作システム

OpenMontageは、Claude CodeのようなAIコーディングアシスタントを本格的な制作スタジオに変えるオープンソースの映像制作システムです。リサーチ、シーン構成、脚本作成、音声ナレーション、音楽選択、字幕生成、自動化パイプラインによる検証までを一貫して処理します。

OpenClawRadar