ComfyUI-Fähigkeit ermöglicht KI-Agenten das Einreihen und Stapelrendern von Bildern über natürliche Sprache

Ein Entwickler hat eine ComfyUI-Fähigkeit veröffentlicht, die KI-Codierungsagenten ermöglicht, Bildrenderings direkt aus dem Chat zu planen, zu stapeln und zu verwalten. Anstatt manuell zur ComfyUI-Oberfläche zu wechseln, können Benutzer ihren Agenten bitten, die Workflow-Erstellung, Auftragseinreichung und Abfrage bis zur Fertigstellung zu übernehmen.
Wie es funktioniert
Die Fähigkeit arbeitet in einer bestimmten Abfolge:
- Benutzer bittet den Agenten um Bilder
- Agent ruft die ComfyUI-Fähigkeit als Werkzeug auf
- Fähigkeit erstellt Workflow-JSON aus Benutzereingaben
- Sendet POST-Anfrage an lokale ComfyUI-HTTP-API
- Fragt ab, bis das Rendering abgeschlossen ist
- Gibt den Ausgabepfad an den Agenten zurück
Natürliche Sprachfähigkeiten
Was dies von einem einfachen API-Skript unterscheidet, ist die natürliche Sprachschicht. Benutzer können Befehle wie diese erteilen:
- "Erstelle 50 Variationen dieses Konzepts mit verschiedenen Seeds und speichere sie in meinem Konzepte-Ordner"
- "Vergleiche diese 4 Prompts nebeneinander bei 1024x1024"
- "Rendere alle davon mit 20, 30 und 40 Schritten, damit ich den optimalen Punkt auswählen kann"
Der Agent übersetzt diese Anfragen in tatsächliche ComfyUI-Workflow-JSON und übernimmt die Warteschlangenverwaltung, gibt Dateipfade zurück, wenn die Renderings abgeschlossen sind.
Einrichtung und Implementierung
Die Fähigkeit ist vollständig lokal – nichts verlässt Ihren Computer – und funktioniert mit allem, was Sie bereits in ComfyUI geladen haben. Zur Implementierung:
- Legen Sie die Fähigkeit in Ihren OpenClaw-Arbeitsbereichsordner skills/ ab
- Aktualisieren Sie den Endpunkt in SKILL.md
- Starten Sie das Gateway neu
Das Open-Source-Repository ist verfügbar unter: https://github.com/Zambav/comfyui-skill-public
📖 Read the full source: r/openclaw
👀 Siehe auch

**Claude Code Routines: Planen und Ausführen von Agenten-Aufgaben wie mit Cron, inkl. logischer Entscheidungsfindung** Oder kürzer und prägnanter: **Claude Code Routines: Agenten-Aufgaben wie mit Cron planen – mit logischer Entscheidungsfindung**
Mit Claude Code Routines können Sie Agentenaufgaben planen, ohne eine Sitzung offen halten zu müssen. Ein Reddit-Nutzer teilt konkrete Beispiele: nächtliche Commit-Überprüfung, wöchentlicher Abhängigkeitscheck, tägliche Fehlerlog-Analyse – mit KI-Schlussfolgerungen statt roher Skriptausgabe.

Claude Academy: Ein kostenloses Coding-Bootcamp, das in Claude Desktop läuft
Ein Entwickler hat Claude Academy aufgebaut, einen kostenlosen Programmier-Bootcamp, der vollständig innerhalb des Code-Tabs von Claude Desktop läuft. Das System verwendet drei Befehle, um 64 strukturierte Lektionen zu den Grundlagen der Webentwicklung zu vermitteln, mit Fortschrittsverfolgung und dem Bauen echter Projekte.

GAN-Fähigkeit für Claude Code: Adversarial KI-Tool zur Ideenverfeinerung
Eine Claude Code-Fähigkeit namens /gan nutzt gegnerische KI-Rollen, um Ideen durch abwechselnde Diskriminator- und Generator-Phasen zu kritisieren und zu verbessern, mit Funktionen wie Intensitätsmodi, mehrsprachiger Ausgabe und erzwungener Rollenauswahl, die durch Selbstiteration entwickelt wurden.

Neue strukturierte Daten-API bietet Abonnementpreise für LLM-Agenten
Ein Entwickler hat eine strukturierte Daten-API veröffentlicht, die Abonnementpreise über Streaming-Plattformen, Ride-Sharing-Dienste, Dating-Apps und andere abonnementbasierte Plattformen hinweg normalisiert. Die API bietet konsistente JSON-Schemata, regionenabhängige Preisangaben, wo verfügbar, und MCP-kompatible Endpunkte für LLM-Agenten zur Nutzung ohne Web-Scraping.