Qwen3.5 35B-A3B MoEは、中程度のハードウェア上で27ステップのエージェントワークフローをローカルで実行します。

ローカルエージェントワークフローの実演
r/LocalLLaMAで開発者が、Qwen3.5 35B-A3B MoEを使用して複雑なエージェントワークフローをローカルで正常に実行したと報告した。このモデルは、ミッドレンジハードウェア上で27ステップの動画処理チェーンを自律的に実行した。
ワークフローの詳細
タスクは、単一の自然言語プロンプトから動画を処理することだった:
- 動画をアップロード
- Whisperで文字起こし
- 字幕を編集
- カスタムスタイルで字幕を動画に焼き付け
ワークフローは27の連続したツール呼び出しで構成され、extract_audio、transcribe、read_file、edit_file、burn_subtitlesに加えて検証ステップを含んでいた。モデルは各ステップを計画、実行、検証し、必要に応じて自己修正を行った。
技術仕様
ハードウェア:
- Lenovo ThinkPad P53モバイルワークステーション
- Intel i7-9850Hプロセッサ
- Quadro RTX 3000(6GB VRAM)
- 48GB DDR4 2666MT/s RAM
ソフトウェアスタック:
- llama.cpp + whisper.cppによる完全ローカル実装
- クラウドAPIは使用せず
モデル設定:
- Q4_K_M量子化のQwen3.5 35B-A3B MoE
- トークンごとに約3Bのアクティブパラメータを持つMoEアーキテクチャ
- レイヤーをオフロードして6GB VRAMに収まり実行可能
- 完全な35Bパラメータの知識ベース
パフォーマンス結果
完全なワークフローは約10分で実行され、ほとんどの時間は推論に費やされた。開発者は、27ステップのチェーン中にエラーゼロ、人間の介入ゼロだったと指摘した。MoEアーキテクチャは、アクティブパラメータ数を低く保ちながら完全なモデル能力を維持することで、ミッドレンジハードウェアでの実行を可能にした。
これは、ローカルエージェントワークフローが、特に速度のためにアクティブパラメータ数と能力のために完全なパラメータ数のバランスを取るMoEモデルによって、コンシューマーグレードのハードウェアで実用的になりつつあることを示している。
📖 Read the full source: r/LocalLLaMA
👀 See Also

CRMおよびCMS統合のためのカスタムOpenClawスキル
ある開発者が、自社のCRMとCMSシステムと連携するカスタムOpenClawスキルを構築し、人間の監視のもとでリード生成とコンテンツ下書きを自動化した経験を共有しました。このセットアップの実装には1日を要しました。

Claude AIがAlexaのサポート外コマンド処理の代替頭脳として活用
ある開発者が、Alexaが処理できないコマンドに対してClaude AIがフォールバックプロセッサとして機能するシステムを構築しました。軽量なレイヤーで、ヒンディー語の処理、CCTVストリーミング、非スマートデバイスの制御に対応しています。システムはTV制御にWebSocket、セットトップボックスにDLNA、CCTVにはRTSP→HLS変換を使用しています。

OpenClaw、Neon、Resendで構築された自動化コールドメールシステム
開発者が、オーケストレーションAIエージェントとしてOpenClaw、サーバーレスPostgresとしてNeon、メールAPIとしてResendを使用して、完全自動化されたコールドメールシステムを構築しました。このシステムは5000通以上のメールを送信し、リード追跡、自動送信、返信検出、iMessageによる通知を管理しています。

ユーザーワークフロー:計画にはClaude.aiを、実装にはClaude Codeを使用
ある開発者が、詳細な計画とアーキテクチャの議論にはClaude.aiを、実装にはClaude Codeを使用していると説明していますが、2つのツール間で共有状態がないため、手動でのファイル転送が必要だと指摘しています。