Wie Clawdbot 6 KI-Agenten mit einer produktionsstabilen Work Queue koordiniert

Das Team von Clawdbot teilte seine Arbeitswarteschlangen-Architektur mit, die 6 KI-Agenten koordiniert, die einen KI-gesteuerten Shop betreiben. Sie stellten fest, dass das Koordinationsproblem schwieriger war als die individuelle Agentenlogik, wobei das System mehrere Iterationen durchlief, bevor es Produktionsstabilität erreichte.
Kernsystem-Funktionen
Die Arbeitswarteschlange implementiert mehrere Schlüsselmechanismen:
- Atomare Aufgabenübernahme: Verhindert, dass zwei Agenten dieselbe Aufgabe übernehmen
- Zustandsautomat: Aufgaben durchlaufen Zustände: ausstehend → bereit → in Bearbeitung → Prüfung → abgeschlossen
- Wiederholungslogik: 3 Fehlversuche mit Backoff, dann dauerhafter Fehler, um endlose Wiederholungsschleifen zu vermeiden
- Aufgabenketten: Abschluss einer Elternaufgabe erzeugt automatisch Kinderaufgaben über ein next_tasks-Feld
- Heartbeat-Überwachung: Verwaiste Übernahmen (durch Agentenabstürze) werden nach Timeout automatisch zurückgesetzt
- Daemon-Orchestrator: Prüft alle 60 Sekunden und startet Agenten für bereite Aufgaben
Produktionserfahrungen
Das Team merkt an, dass die Handhabung von Fehlermodi nicht offensichtlich war, bis sie reale Produktionsvorfälle zum Lernen hatten. Sie haben einen vollständigen Architekturbericht mit Erkenntnissen aus dem Produktionsbetrieb veröffentlicht.
Das System koordiniert mehrere gleichzeitig arbeitende Agenten: Design-, Code-, Marketing- und Betriebsagenten. Das Team ist offen für Diskussionen über Kompromisse, insbesondere bezüglich der Fehlermodibehandlung, die aus den Produktionserfahrungen hervorging.
📖 Quelle lesen: r/clawdbot
👀 Siehe auch

Relay CLI-Tool speichert Claude-Sitzungskontext bei Ratenbegrenzung
Relay ist ein Rust-CLI-Tool, das Claude's .jsonl-Sitzungstranskripte von der Festplatte liest und vollständige Momentaufnahmen Ihrer Sitzung erstellt, einschließlich Konversation, Tool-Aufrufe, Todos, Git-Status und Fehlern. Es generiert Kontextaufforderungen, um Sitzungen nach dem Zurücksetzen von Ratenbegrenzungen fortzusetzen.

MCP-Server: Vergleich von lokalen und Cloud-LLMs mit Debattierfunktion
Der MCP-Server ermöglicht Entwicklern, lokale Modelle über Ollama neben verschiedenen Cloud-LLMs abzufragen, und bietet Funktionen wie einen Vergleich nebeneinander und eine strukturierte Debattenfunktion.

CC-Ledger: Verfolgen Sie Claude-Code-Kosten pro Sitzung und PR mit lokalem SQLite
CC-Ledger ist ein Rust-Binärprogramm, das in Claude Code eingreift und jede Anfrage in einer lokalen SQLite-Datenbank protokolliert. Erfassen Sie ausufernde Sitzungen live und erhalten Sie Kostenaufschlüsselungen pro PR, ohne einen API-Schlüssel zu benötigen. Enthält macOS-Menüleiste, Web-Dashboard und CLI-Ansichten.

Driftwatch V3 veröffentlicht: KI-gestütztes Tool zur Überwachung von Codebasen
Driftwatch V3 ist jetzt als öffentliches Repository verfügbar, nach einem 5-6-tägigen Build mit etwa 9.000 Codezeilen und 160 US-Dollar an API-Guthaben. Das Browser-Tool verfolgt Probleme in Markdown-Dateien, markiert widersprüchliche Anweisungen und bietet Kostenverfolgung mit Empfehlungen.