ローカルLLMエージェントとComfyUIの統合による自然言語バッチ画像生成

✍️ OpenClawRadar📅 公開日: April 2, 2026🔗 Source
ローカルLLMエージェントとComfyUIの統合による自然言語バッチ画像生成
Ad

r/LocalLLaMAの開発者が、ローカルのOpenClawエージェントとComfyUIを統合し、自然言語によるバッチ画像生成を可能にした方法を共有しました。このセットアップにより、ユーザーは平易な英語で画像リクエストを記述でき、エージェントが手動のUI操作なしにComfyUIパイプライン全体を処理します。

統合の仕組み

フローは以下の順序で進行します:

  • エージェントが画像リクエストを受信
  • 意図を構造化された入力(プロンプト、寸法、ステップ数、シード値)に解析
  • ツールとしてcomfyuiスキルを呼び出し
  • スキルが入力からComfyUIワークフローJSONを構築
  • ローカルのComfyUI HTTP API(/prompt)にPOST送信
  • 2秒ごとに/historyをポーリングしてレンダリング完了を確認
  • /viewから出力パスを取得
  • 結果をエージェントに返却
  • エージェントがユーザーに確認

技術的な実装詳細

この統合では、ComfyUIのノードIDベースのJSONワークフロー形式を使用しています。スキルは、エージェントの入力をベースワークフローテンプレート(KSampler、CLIPTextEncodeなど)内の特定のノードIDにマッピングします。これは「ワークフローのノード構造に依存するため、統合の中で最も脆弱な部分ですが、標準的なセットアップでは確実に動作します」と説明されています。

スキルには、ジョブを受け付ける前に/object_infoにpingを送信してComfyUIが実際に準備完了状態(単に到達可能なだけでなく)であることを確認する起動検証が含まれています。これにより、チェックポイントがまだ読み込み中のときにジョブが実行されずにキューイングされるのを防ぎます。

Ad

エラー処理の改善

すべてのAPI呼び出しは、生のHTTPエラーではなく、エージェントが読み取り可能なエラーを返すようにラップされています。例えば、「127.0.0.1:8188で接続が拒否されました」は「ComfyUIが実行されていないようです。--listenを付けて起動し、再度お試しください」に変換されます。これにより、特にリモート作業時にデバッグが容易になります。

現在の制限事項

この統合では、以下の機能はまだサポートされていません:

  • 高度なマルチノードワークフロー(ControlNet、LoRAスタッキング)
  • WebSocketを介したリアルタイム進捗ストリーミング
  • Windows以外のプラットフォームでのクロスプラットフォームテスト

このスタック全体は、OpenClaw(セルフホスト型エージェントフレームワーク)+ ComfyUI + Node.jsスキルスクリプトを使用してローカルで実行され、クラウドコンポーネントは一切使用されていません。

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Swarm Orchestra v2プラグイン、エージェント間メッセージングを追加しClaudeコードエージェントチームの混乱を解消
Tools

Swarm Orchestra v2プラグイン、エージェント間メッセージングを追加しClaudeコードエージェントチームの混乱を解消

Swarm Orchestraは、Claude Codeの実験的なTeamCreate機能の問題を解決するプラグインです。この機能はエージェントの暴走を引き起こす可能性があります。バージョン2では、PreToolUseフックによるエージェント間メッセージングと、/teammateスキルによる自己設定機能が追加されました。

OpenClawRadar
Krasis: 大規模MoEモデルのためのハイブリッドCPU/GPUランタイム、RTX 5080で3,324 tok/sのプリフィルを達成
Tools

Krasis: 大規模MoEモデルのためのハイブリッドCPU/GPUランタイム、RTX 5080で3,324 tok/sのプリフィルを達成

Krasisは、大規模なMoEモデルを実行するためのハイブリッドCPU/GPUランタイムで、GPUでプリフィルを処理し、CPUでデコードを行うことで、RTX 5080でQwen3-Coder-Next 80B Q4モデルに対して3,324トークン/秒のプリフィル速度を達成しています。VRAMに収まらないモデルを実行可能にする一方で、モデルサイズの約2.5倍のシステムRAMを必要とします。

OpenClawRadar
オープンソースのLLMエージェント向け自動メモリシステム、94%の再現精度を達成
Tools

オープンソースのLLMエージェント向け自動メモリシステム、94%の再現精度を達成

開発者が、明示的な「これを保存して」というコマンドを必要とせずに、セッションを超えて事実を自動的に抽出、分類、永続化するLLMベースエージェント用の自動メモリシステムをオープンソース化しました。このシステムは、ベクトルデータベースの代わりに構造化マークダウンファイルを使用し、52のチェックポイントからなるリコールベンチマークで94.2%の精度を達成しました。

OpenClawRadar
無料のOpenClawコスト計算ツールが、実行前の構成費用を表示します。
Tools

無料のOpenClawコスト計算ツールが、実行前の構成費用を表示します。

開発者が、実行前にOpenClawの設定コストを計算する無料のオープンソースブラウザツールを構築しました。このツールは、主要モデル、フォールバックチェーン、ハートビートバーン、課金モードごとに費用を内訳します。

OpenClawRadar