Comment Clawdbot coordonne 6 agents IA avec une file d'attente de production stable

L'équipe de Clawdbot a partagé son architecture de file d'attente de travail qui coordonne 6 agents IA gérant une boutique opérée par IA. Ils ont constaté que le problème de coordination était plus difficile que la logique individuelle des agents, le système ayant traversé plusieurs itérations avant d'atteindre une stabilité de production.
Fonctionnalités principales du système
La file d'attente de travail met en œuvre plusieurs mécanismes clés :
- Réclamation atomique de tâches : Empêche deux agents de saisir la même tâche
- Machine à états : Les tâches passent par des états : en attente → prêt → en cours → révision → terminé
- Logique de nouvelle tentative : 3 échecs avec backoff, puis échec permanent pour éviter les boucles de nouvelle tentative incontrôlées
- Chaînes de tâches : L'achèvement d'une tâche parent génère automatiquement des tâches enfants via un champ next_tasks
- Suivi de pulsation cardiaque : Les réclamations obsolètes (suite à des plantages d'agents) sont réinitialisées automatiquement après un délai d'attente
- Orchestrateur démon : Interroge toutes les 60 secondes et lance des agents pour les tâches prêtes
Leçons de production
L'équipe note que la gestion des modes de défaillance n'était pas évidente jusqu'à ce qu'ils aient de vrais incidents de production pour en tirer des leçons. Ils ont publié un compte-rendu complet de l'architecture avec les leçons tirées de son exploitation en production.
Le système coordonne plusieurs agents travaillant simultanément : agents de design, de code, de marketing et d'opérations. L'équipe est ouverte à la discussion sur les compromis, en particulier concernant la gestion des modes de défaillance qui est ressortie de l'expérience en production.
📖 Lire la source complète : r/clawdbot
👀 See Also

Pipeline de Contenu Multi-Agent pour le Code Claude avec Portes de Qualité
Un développeur a créé un pipeline de contenu à six agents pour Claude Code qui sépare les tâches de recherche, rédaction, édition et SEO avec des contrôles qualité entre les étapes. Le système s'arrête pour une approbation manuelle avant publication et permet des réexécutions individuelles des agents.

Lumia : Système d'Assistance IA Local en Un Clic avec Mémoire Persistante
Lumia est un système modulaire qui fonctionne localement en utilisant Ollama et des modèles locaux pour créer des compagnons IA persistants avec une mémoire épisodique, une mémoire émotionnelle, des croyances, des désirs, une identité, une modélisation des relations et des cycles de réflexion.

rawq : Outil CLI Local pour la Recherche Sémantique de Code par Agent IA
rawq est un outil CLI open-source qui aide les agents d'IA à trouver du code pertinent en utilisant la recherche sémantique avec un modèle local de 33MB via ONNX runtime et la recherche lexicale BM25 via tantivy. Lors des tests, les agents d'IA utilisant rawq ont consommé 4 fois moins de tokens et ont terminé les tâches 2 fois plus vite comparé aux outils de lecture/recherche aveugles.

Intégration d'Agents LLM Locaux avec ComfyUI pour la Génération d'Images par Lots en Langage Naturel
Un développeur explique comment il a connecté son agent OpenClaw local à ComfyUI, permettant des commandes en langage naturel pour des flux de travail de génération d'images par lots. L'intégration utilise une compétence d'agent personnalisée qui traduit les requêtes en anglais en JSON de flux de travail ComfyUI et gère la communication API.