Gemma 4 26B対Qwen 3.5 27B:RTX 4090でのローカル業務ワークフローベンチマーク

✍️ OpenClawRadar📅 公開日: April 17, 2026🔗 Source
Gemma 4 26B対Qwen 3.5 27B:RTX 4090でのローカル業務ワークフローベンチマーク
Ad

Redditユーザーが、プロシューマーワークステーションでのローカルビジネスオペレーターワークフローにおいて、Gemma 4 26BとQwen 3.5 27Bを包括的に比較するベンチマークを実施しました。

テスト環境

ベンチマークは以下のローカルワークステーションで実行されました:

  • RTX 4090 24GB
  • Intel i9-14900KF
  • 64GB RAM
  • Ubuntu 25.10
  • モデル管理にOllamaを使用

テスト方法

これはコーディングベンチマークや単一プロンプトテストではありませんでした。評価では以下を使用しました:

  • 18の有効な直接対決テスト
  • 全テストで同一の信頼できるオファードキュメント
  • 同一の制約、トーン要件、ルールセット
  • 出力は鋭く、現実的で、実用的で、高品質で、オペレーターレベルであることが要求
  • 捏造された統計、偽の保証、誇大宣伝、曖昧なAIコンサルタント的な内容は禁止

結果

最終スコア:Gemma 13勝、Qwen 5勝

主な発見

Gemmaの強み:

  • ユーザー体験を変える劇的な速度の速さ
  • ソースドキュメントの範囲内に留まる規律の高さ
  • 作り話を追加せずに出力を実用的に保つ一貫性
  • 勝利したテスト:要約ベンチマーク、オリジナルオペレーターベンチマーク、逆張りポジショニング、比喩テスト、発見的コール構築、反論対応、フック、ストーリー広告、複数キャンペーンラウンド、技術的設計図テスト、コピーバリデーションエンジンテスト

Qwenの強み:

  • より広範な統合と豊かな心理的枠組み構築の強さ
  • 優れた感情のニュアンスとより広い視点での第二段階の考察
  • 勝利したテスト:逸脱なしの拡張、クライアント選定と優先順位付け、感情的角度の階梯、前後の感情変容、JSONコンパイラテスト
Ad

実践的結論

テスト実施者の結論:Gemmaは実行に優れ、Qwenは拡張に優れている。 Gemmaは、常に見守りが必要なく、ビジネスサイドのソースに基づいたワークフローを実行する信頼できるモデルです。Qwenは、第二意見、より広範な枠組みの検討、またはより感情的にニュアンスのある見解に適しています。

テスト実施者の現在のローカルスタック:

  • Gemma 4 26B:デフォルトのテキストおよびビジネスモデル
  • Qwen3-Coder 30B:コーディングモデル
  • Qwen3-VL 30B:ビジョンモデル
  • GPT-OSS 20B:高速フォールバック

このベンチマークは、「どちらのモデルがより賢いか」ではなく、「どちらのモデルが実際に無意味な内容に逸脱せずに実作業を進めるのに役立つか」についてのものであることを明らかにしました。

📖 Read the full source: r/openclaw

Ad

👀 See Also

OpenClawエージェント、カスタムスキルを通じて通話機能を獲得
Tools

OpenClawエージェント、カスタムスキルを通じて通話機能を獲得

ある開発者が、セルフホスト型OpenClawエージェント向けのカスタムスキルを作成し、電話通話機能を実現しました。これにより、ビルド完了やサーバー障害などのトリガーに基づいて、エージェントが通話を開始できるようになりました。この実装は、ウェブ検索やアラート設定を含む完全なチャット機能を備えた音声対話を提供します。

OpenClawRadar
80行のPythonスクリプトがClaudeを使って内部リンク提案を自動生成、リンク作業時間を2時間から8分に短縮
Tools

80行のPythonスクリプトがClaudeを使って内部リンク提案を自動生成、リンク作業時間を2時間から8分に短縮

Redditユーザーが80行のPythonスクリプトを作成。記事の下書きとサイトマップをClaudeに読み込ませ、関連する内部リンク先と推奨アンカーテキストを返すようにしたところ、記事1本あたりの手動リンク作業時間が2時間から8分に短縮された。

OpenClawRadar
MarkView:オープンソースツールでAI生成のMarkdownファイルをレンダリング・管理
Tools

MarkView:オープンソースツールでAI生成のMarkdownファイルをレンダリング・管理

MarkViewは、MermaidダイアグラムとKaTeX数式を表示するプライバシー重視のMarkdownレンダリングエンジンで、Webアプリ、ネイティブmacOSアプリ、Claude DesktopやCursorとの統合のためのMCPサーバーとして利用可能です。

OpenClawRadar
AgentMind:あなたのコーディング好みを学習し適用するClaudeコードプラグイン
Tools

AgentMind:あなたのコーディング好みを学習し適用するClaudeコードプラグイン

AgentMindは、あなたのコーディングパターンを観察し、ツールの選択やスタイルルールなどの好みを学習し、そのコンテキストを将来のセッションに自動的に注入するClaude Codeプラグインです。6段階のコアループと信頼度スコアリングを使用して、学習した好みをいつ適用するかを決定します。

OpenClawRadar