ComfyUI Skill Permite a los Agentes de IA Encolar y Procesar por Lotes Renderizados de Imágenes mediante Lenguaje Natural

Un desarrollador ha lanzado una habilidad para ComfyUI que permite a los agentes de programación IA encolar, procesar por lotes y gestionar renderizados de imágenes directamente desde el chat. En lugar de cambiar manualmente a la interfaz de ComfyUI, los usuarios pueden pedir a su agente que maneje la construcción del flujo de trabajo, el envío de trabajos y el seguimiento hasta su finalización.
Cómo Funciona
La habilidad opera a través de una secuencia específica:
- El usuario le pide imágenes al agente
- El agente llama a la habilidad de ComfyUI como una herramienta
- La habilidad construye el JSON del flujo de trabajo a partir de las entradas del usuario
- Envía una solicitud POST a la API HTTP local de ComfyUI
- Realiza seguimiento hasta que se complete el renderizado
- Devuelve la ruta de salida al agente
Capacidades de Lenguaje Natural
Lo que distingue esto de un script básico de API es la capa de lenguaje natural. Los usuarios pueden emitir comandos como:
- "Haz 50 variaciones de este concepto con diferentes semillas, guárdalas en mi carpeta de conceptos"
- "Compara estos 4 prompts lado a lado a 1024x1024"
- "Renderiza todos estos a 20, 30 y 40 pasos para que pueda elegir el punto óptimo"
El agente traduce estas solicitudes en JSON real del flujo de trabajo de ComfyUI y maneja la gestión de colas, devolviendo las rutas de archivo cuando se completan los renderizados.
Configuración e Implementación
La habilidad es completamente local—nada sale de tu máquina—y funciona con lo que ya tengas cargado en ComfyUI. Para implementarla:
- Coloca la habilidad en la carpeta skills/ de tu espacio de trabajo de OpenClaw
- Actualiza el endpoint en SKILL.md
- Reinicia el gateway
El repositorio de código abierto está disponible en: https://github.com/Zambav/comfyui-skill-public
📖 Read the full source: r/openclaw
👀 Ver también

CAL: Capa de Optimización de Contexto de Código Abierto para Agentes de LLM
CAL (Context Assembly Layer) es una biblioteca de Python que reduce el uso de tokens de la API de Claude en un 83% mediante la selección y compresión inteligente del contexto. Está disponible a través de pip install y tiene licencia MIT.

AlterSpec v1.0: Aplicación de Políticas en Tiempo de Ejecución para Agentes de IA
AlterSpec v1.0 es un motor de ejecución de cumplimiento de políticas de código abierto que se sitúa entre los agentes de IA y sus herramientas, evaluando las acciones frente a políticas definidas en YAML antes de su ejecución. Proporciona decisiones de permitir/denegar/revisar, firma criptográfica de políticas y registro de auditoría.

Revisión del Rendimiento de Omnicoder-9B: Velocidad frente a Problemas de Llamada a Herramientas
Omnicoder-9B, un modelo enfocado en codificación ajustado en Qwen3.5 9B con salidas de Opus 4.6, GPT 5.4, GPT 5.3 Codex y Gemini 3.1 Pro, muestra un rendimiento sólido en hardware de gama media pero tiene problemas de llamada a herramientas en IDEs.

docvault: Genera Documentación de API Local para Reducir Alucinaciones de IA
docvault es una herramienta que genera referencias de API en formato markdown a partir del código fuente para ayudar a Claude y otros LLMs a dejar de alucinar firmas de funciones. Funciona para crates de Rust y paquetes de Python, genera un archivo markdown de dos niveles e incluye un plugin de Claude Code para operación sin intervención manual.