Délimiter la couche de gouvernance pour le développement d'IA multi-agents

Delimit est une couche de gouvernance qui gère la coordination entre plusieurs agents d'IA de codage pour prévenir les conflits lorsqu'ils travaillent sur la même base de code. L'outil aborde les problèmes courants des multi-agents comme le fait que les agents écrasent le travail des autres ou que les réviseurs comprennent mal les décisions intentionnelles.
Fonctionnalités clés
- Mémoire partagée qui persiste entre les sessions et les modèles
- Système de registre qui suit chaque décision d'agent
- Détection de collision qui empêche deux agents de modifier le même fichier simultanément
- Crochets pré-commit qui bloquent les déploiements à moins que les audits de sécurité ne soient validés
- Agent coordinateur qui achemine le travail entre les agents et suit les changements
Détails pratiques
Le système fonctionne avec Claude Code, Codex, Cursor et Gemini CLI. Il est open source avec une licence MIT et inclut une GitHub Action qui a été invitée dans le pipeline CI d'un dépôt avec 28K étoiles. Les tests montrent plus de 2 600 tests réussis.
Pour l'essayer : npx delimit-cli demo (s'exécute en 30 secondes)
Dépôt GitHub : https://github.com/delimit-ai/delimit-mcp-server
L'outil a été développé pour résoudre des problèmes spécifiques de coordination multi-agents où différents agents gèrent différents aspects du développement (Claude Code écrit les fonctionnalités, Codex révise les PR pour la sécurité, Gemini valide l'architecture).
📖 Lire la source complète : r/ClaudeAI
👀 See Also

JetBrains présente un plugin pour le code Go moderne avec les agents IA Junie et Claude Code
JetBrains a publié un plugin pour les agents d'IA Junie et Claude Code, améliorant leur capacité à générer du code Go moderne en respectant les dernières fonctionnalités et bonnes pratiques de Go.

Antigravité 2.0 domine le benchmark architectural 3D OpenSCAD – ModelRift teste 6 LLM sur le Panthéon
ModelRift a testé 6 LLM pour construire le Panthéon en OpenSCAD. Antigravity a obtenu 4,5/5 en qualité architecturale, battant le baseline Codex 5.5. Cursor 3.5 était le plus rapide mais le plus faible.

Mesure des dépenses de tokens hors tâche dans Claude Code : la métrique 'Intention non déclarée'
Un développeur a créé une métrique pour quantifier le calcul dépensé sur des chemins d'exécution non intentionnels dans des sessions Claude Code, constatant que 22,8 % des tokens étaient consacrés à un travail hors sujet.
Recette OpenClaw-RL de Reef : des mises à jour de poids notées derrière une barrière de publication
La recette d'évolution des poids OpenClaw-RL de Reef traite 72 problèmes GSM8K comme 72 tâches, utilise Qwen3-4B pour les rôles de politique et de modèle de récompense de processus, avec Qwen3-32B comme étudiant, et s'exécute sur sept GPU. Elle a atteint son critère de trois passes consécutives à la session 14.