Claw製プラグインがOpenClawにQwen 3.8 27B思考レベル対応を追加
llama.cppとOpenClaw 2026.6.9でQwen 3.8 27Bを実行しているが、ネイティブの思考レベル制御が欠けていませんか?あるOpenClawユーザーが同じ壁にぶつかり、AIエージェントにプラグインを書かせて修正しました。完全に生成され、人間の目では未テストです。
このプラグインが必要な理由
Qwen 3.8は専用パラメータではなくチャットテンプレートを介して思考レベルを制御します。OpenClawのllama.cppバックエンド(バージョン2026.6.9)はこれを標準でマッピングしないため、思考レベルが無視されたり誤って適用されたりします。このプラグインはそのギャップを埋めます。
機能
- API呼び出しごとの思考レベル — 各リクエストのチャットテンプレートに
enable_thinking値を正しく注入します。 - ハートビート用の個別レベル — バックグラウンドのハートビート呼び出しに異なる思考レベルを設定できます(著者は
xhighを使用)。 - インストラクトモード(思考オフ) — 思考を無効にし、unslothが推奨するサンプリングパラメータを適用して最適な出力を実現します。
- オプションのタイムアウトガード — 長い推論チェーン中のタイムアウトを避けるために、インストラクトモードへの強制コンパクションを可能にします。
入手方法
プラグインはGitLabで公開されています:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
著者のコメント:「コードすら見ていません」— すべてはAIエージェント自身によって書かれました。これは、エージェントが人間のレビューなしで有用で共有可能なツールを生成できるという概念実証です。
対象読者
OpenClawを介してllama.cppでQwen 3.8(または類似モデル)を実行し、リクエストごとに思考レベルを細かく制御したい人。ハートビートに依存している場合や、フォールバックとしてインストラクトモードが必要な場合、このプラグインは配管作業の手間を省きます。
📖 原文を読む: r/openclaw
👀 See Also

Orchino: Windows向けローカルマルチエージェントオーケストレーションシステム(並列ブラウザーおよびUI自動化対応)
Orchinoは、UIを乗っ取ることなく並列ブラウザおよびWindowsタスクを実行するWindows向けローカルマルチエージェントオーケストレーションシステムです。デモでは、4つのエージェントが「FlipkartとAmazonでSonyイヤーバッドを検索し、結果をメール送信し、Notepadに保存する」というタスクを真の並列実行で29.5秒で完了させました。

ベンチマークによると、コンテキストエンジンにより、SWE-benchでのAIコーディングエージェントのコストが3分の1に削減されました。
Claude Opus 4.5をSWE-bench Verifiedで使用した4つのコーディングエージェントのベンチマークでは、コンテキストエンジンが73%の合格率を$0.67/タスクで達成し、他のエージェントは同程度または低い性能に対して最大$1.98/タスクのコストがかかりました。

LLMエージェントが視覚フィードバックを用いて完全なGodot 4ダンジョンクローラーを構築
ある開発者が、MCPツールを使用してLLMエージェントをGodot 4に接続し、ダンジョンクローラーFPSを構築するための単一のプロンプトを与えました。エージェントは、ゲームを実行し、スクリーンショットを撮影し、視覚的な問題を修正することで、3つの部屋、照明、戦闘、敵、進行システムを備えた完全なプロトタイプを作成しました。

Gemma 4 26B対Qwen 3.5 27B:RTX 4090でのローカル業務ワークフローベンチマーク
ある開発者がRTX 4090ワークステーションでGemma 4 26BとQwen 3.5 27Bを18の実践的なビジネスオペレータータスクでテストしました。Gemmaが13勝5敗で勝利し、日常の実行作業ではより高速で規律正しい結果を示した一方、Qwenはより広範な戦略的思考で優れていました。