Qwen3 27B、現実のツール呼び出しでGemma 4 26Bを上回る:ローカルAIビデオパイプライン向け
週末、All About AIは詳細なチュートリアルを公開し、完全ローカルのFireshipスタイル動画自動化パイプラインを紹介しました。主な発見:ツール呼び出しの信頼性は、テストした2つのモデルで大きく異なりました。
ツール呼び出し:Qwen3 27B vs Gemma 4 26B
Gemma 4 26Bはツール呼び出しループに繰り返し陥り、不要な推論にトークンを浪費しました。Qwen3(具体的にはQwen 3.6 27B?)は、同じオーケストレーションを無駄な思考トークンなしでクリーンに処理しました。ベンチマーク数値と実際のエージェントワークフローのパフォーマンスには大きな差があり、ツール呼び出しループは時間とGPUメモリの両方を消費します。
ツール呼び出しスタック(OpenClaw、Aider、カスタムループ)を使用している場合、モデルの選択は合成ベンチマークが示す以上に重要です。著者は、特定のスタックにおけるQwen3のツール呼び出しとDeepSeek V4の失敗率の数値を明示的に求めています。
画像生成:Said Image Turbo
画像については、パイプラインはHugging FaceのSaid Image Turboを使用しました。オープンウェイトでAPIコストはかかりません。ミーム風のカードには適していますが、ポートレートショットにはFluxやSeedreamを使用する必要があります。
オーケストレーション:174KコンテキストのOpenCode
パイプライン全体はOpenCodeでオーケストレーションされました。コンテキストウィンドウは174Kトークンに達し、ToDoリストは1回のパスで完全には完了しませんでした。オペレーターは途中で離席し、部分的な結果を見て戻ってきました。これは、自律型AIツールの現状を正直に描写したものです。
リモート実行
27Bモデルをローカルで実行できない場合、Qwen3は複数の推論プロバイダーで利用可能であり、GPUを前もって用意しなくても同じウェイトとツール呼び出し動作を得られます。
📖 全文ソース: r/LocalLLaMA
👀 See Also

開発者がCursor Composer 2とKimi 2.6からエンタープライズワークロード向けにQwen3.6:35b-a3bに切り替え
ある開発者が、500〜70万行規模のエンタープライズスイートを日常業務で扱うためにQwen3.6:35b-a3bを使用しており、Kimi 2.6やDeepSeek 4 Pro/Flashよりも優れたパフォーマンスを示し、OpenRouterでのコストは約100万トークンあたり0.08ドルだと報告している。

テネシー州の女性、AI顔認識システムの誤りにより6か月間収監される
50歳のテネシー州の祖母、アンジェラ・リップスは、ファーゴ警察が顔認識ソフトウェアを使用して彼女をノースダコタ州の銀行詐欺事件の容疑者と誤認したため、約6か月間拘置所で過ごしました。犯行時に彼女が現場から約1,200マイル離れた場所にいたことを示す銀行記録が証明された後、クリスマスイブに釈放されました。

AnthropicはClaudeのサブスクリプションとサードパーティーツールの使用を分離します
Anthropicは、4月4日からClaude Pro/TeamサブスクリプションがOpenClawの使用をカバーしなくなり、サードパーティ製ハーネスの使用には別途従量課金が必要になると発表しました。OpenClaw経由でClaudeを引き続き使用するには、アカウント設定で「追加使用量」を有効にする必要があります。

OpenClaw 2026.3.24: ブリッジ設定の削除、ハートビートトークンの節約、ループ検出
OpenClaw 2026.3.24では、openclaw.jsonから非推奨となったブリッジ設定セクションが削除され、heartbeat設定にisolatedSession: trueが追加されて実行あたりのトークンコストが約10万から2,000〜5,000に削減されました。また、imageGenerationModel、tools.loopDetection、channels.modelByChannel、組み込みモデルエイリアス、pdfModelなどの新機能が導入されています。