Qwen3 27B、現実のツール呼び出しでGemma 4 26Bを上回る:ローカルAIビデオパイプライン向け

✍️ OpenClawRadar📅 公開日: May 13, 2026🔗 Source
Ad

週末、All About AIは詳細なチュートリアルを公開し、完全ローカルのFireshipスタイル動画自動化パイプラインを紹介しました。主な発見:ツール呼び出しの信頼性は、テストした2つのモデルで大きく異なりました。

ツール呼び出し:Qwen3 27B vs Gemma 4 26B

Gemma 4 26Bはツール呼び出しループに繰り返し陥り、不要な推論にトークンを浪費しました。Qwen3(具体的にはQwen 3.6 27B?)は、同じオーケストレーションを無駄な思考トークンなしでクリーンに処理しました。ベンチマーク数値と実際のエージェントワークフローのパフォーマンスには大きな差があり、ツール呼び出しループは時間とGPUメモリの両方を消費します。

ツール呼び出しスタック(OpenClaw、Aider、カスタムループ)を使用している場合、モデルの選択は合成ベンチマークが示す以上に重要です。著者は、特定のスタックにおけるQwen3のツール呼び出しとDeepSeek V4の失敗率の数値を明示的に求めています。

画像生成:Said Image Turbo

画像については、パイプラインはHugging FaceのSaid Image Turboを使用しました。オープンウェイトでAPIコストはかかりません。ミーム風のカードには適していますが、ポートレートショットにはFluxやSeedreamを使用する必要があります。

オーケストレーション:174KコンテキストのOpenCode

パイプライン全体はOpenCodeでオーケストレーションされました。コンテキストウィンドウは174Kトークンに達し、ToDoリストは1回のパスで完全には完了しませんでした。オペレーターは途中で離席し、部分的な結果を見て戻ってきました。これは、自律型AIツールの現状を正直に描写したものです。

リモート実行

27Bモデルをローカルで実行できない場合、Qwen3は複数の推論プロバイダーで利用可能であり、GPUを前もって用意しなくても同じウェイトとツール呼び出し動作を得られます。

📖 全文ソース: r/LocalLLaMA

Ad

👀 See Also

ハイブリッドAIアーキテクチャ:オープンソースコンポーネントと独自推論モデルの統合
News

ハイブリッドAIアーキテクチャ:オープンソースコンポーネントと独自推論モデルの統合

実用的なハイブリッドAIアーキテクチャが登場しつつあり、89%の組織がコストを50%以上削減するためにオープンソースコンポーネントを活用しています。一方で、複雑な推論タスクには独自モデルが対応しています。オープンソースフレームワークは、ライセンス交渉なしに透明性とファインチューニング機能を提供します。

OpenClawRadar
Claudeはピーク時間外の使用制限を2週間の間、2倍にします。
News

Claudeはピーク時間外の使用制限を2週間の間、2倍にします。

Anthropicは、すべてのプランにおいてピーク時間外のClaude利用制限を一時的に2倍にしています。平日の太平洋時間午前5時から11時/グリニッジ標準時午後12時から6時以外は2倍の利用が可能で、週末は終日2倍の利用が可能です。

OpenClawRadar
🦀
News

Google DeepMindのAIポインター:ジェミニとの相互作用のためのマウスの再考

Google DeepMind、コンテキストを理解するGeminiを搭載したAIマウスポインタを発表。画像を指して「道順を教えて」などのコマンドが可能で、ChromeやGooglebookに統合。

OpenClawRadar
米国防総省、米軍の中核システムとしてPalantirのAIを採用へ
News

米国防総省、米軍の中核システムとしてPalantirのAIを採用へ

ロイター通信が入手したメモによると、米国防総省は米軍の中核システムとしてPalantirの人工知能技術を採用する計画だという。この記事はHacker Newsに投稿され、47ポイントと2件のコメントを獲得した。

OpenClawRadar