ComfyUI-Fähigkeit ermöglicht KI-Agenten das Einreihen und Stapelrendern von Bildern über natürliche Sprache

Ein Entwickler hat eine ComfyUI-Fähigkeit veröffentlicht, die KI-Codierungsagenten ermöglicht, Bildrenderings direkt aus dem Chat zu planen, zu stapeln und zu verwalten. Anstatt manuell zur ComfyUI-Oberfläche zu wechseln, können Benutzer ihren Agenten bitten, die Workflow-Erstellung, Auftragseinreichung und Abfrage bis zur Fertigstellung zu übernehmen.
Wie es funktioniert
Die Fähigkeit arbeitet in einer bestimmten Abfolge:
- Benutzer bittet den Agenten um Bilder
- Agent ruft die ComfyUI-Fähigkeit als Werkzeug auf
- Fähigkeit erstellt Workflow-JSON aus Benutzereingaben
- Sendet POST-Anfrage an lokale ComfyUI-HTTP-API
- Fragt ab, bis das Rendering abgeschlossen ist
- Gibt den Ausgabepfad an den Agenten zurück
Natürliche Sprachfähigkeiten
Was dies von einem einfachen API-Skript unterscheidet, ist die natürliche Sprachschicht. Benutzer können Befehle wie diese erteilen:
- "Erstelle 50 Variationen dieses Konzepts mit verschiedenen Seeds und speichere sie in meinem Konzepte-Ordner"
- "Vergleiche diese 4 Prompts nebeneinander bei 1024x1024"
- "Rendere alle davon mit 20, 30 und 40 Schritten, damit ich den optimalen Punkt auswählen kann"
Der Agent übersetzt diese Anfragen in tatsächliche ComfyUI-Workflow-JSON und übernimmt die Warteschlangenverwaltung, gibt Dateipfade zurück, wenn die Renderings abgeschlossen sind.
Einrichtung und Implementierung
Die Fähigkeit ist vollständig lokal – nichts verlässt Ihren Computer – und funktioniert mit allem, was Sie bereits in ComfyUI geladen haben. Zur Implementierung:
- Legen Sie die Fähigkeit in Ihren OpenClaw-Arbeitsbereichsordner skills/ ab
- Aktualisieren Sie den Endpunkt in SKILL.md
- Starten Sie das Gateway neu
Das Open-Source-Repository ist verfügbar unter: https://github.com/Zambav/comfyui-skill-public
📖 Read the full source: r/openclaw
👀 Siehe auch

Außerhalb des Stromnetzes: Nutzung von Telefonhardware für Offline-AI-Anwendungen
Off Grid ist eine Open-Source-App, die die Hardware Ihres Telefons für Offline-AI-Aufgaben wie Textgenerierung und Spracherkennung nutzt.

Erkundung von LiveDocs: Ein KI-natives Datenanalyse-Notebook
LiveDocs bietet eine reaktive Notebook-Umgebung, die es Datenteams ermöglicht, mehrstufige Analysen durchzuführen und die Analyse von Anfang bis Ende mit Hilfe eines KI-Agenten aufrechtzuerhalten.

Claude Skills Hub: Durchsuchbares Repository für 789+ Claude Code Skills und 10 autonome Agenten
Claude Skills Hub (clskills.in) bietet eine zentralisierte Suchoberfläche für 789+ Claude Code Skill-Dateien in 71 Kategorien sowie 10 autonome KI-Agenten, die mehrere Skills zu vollständigen Workflows verknüpfen. Das Open-Source-Projekt sammelt Skills aus mehreren Community-Sammlungen und ermöglicht Downloads mit einem Klick.

Code-Graph-MCP: Open-Source-MCP-Server reduziert Claude-Code-Token-Verbrauch um 40-60%
code-graph-mcp ist ein MCP-Server, der Codebasen in einen AST-Wissensgraphen indexiert und dabei mehrere grep/read-Aufrufe durch einzelne strukturierte Abfragen ersetzt. Der Entwickler berichtet von 40-60 % Einsparungen bei den gesamten Sitzungstokens und 80 % weniger Tool-Aufrufen pro Navigationsaufgabe.