Relay : Plan de contrôle open-source pour les agents IA OpenClaw

Qu'est-ce que Relay
Relay est une application de bureau Electron open source qui sert de plan de contrôle pour les agents d'IA OpenClaw. Si OpenClaw est l'environnement d'exécution, Relay fonctionne comme votre centre de commande local, offrant les mêmes schémas de flux de travail que Claude Cowork mais fonctionnant sur votre propre infrastructure avec votre choix de modèles.
Architecture et composants
Le système suit une séparation claire entre les plans de contrôle et d'exécution :
- Relay (Plan de contrôle) : Application de bureau où vous définissez les tâches, examinez les livrables et approuvez les actions
- Passerelle OpenClaw (Plan d'exécution) : Environnement d'exécution qui fonctionne sur votre infrastructure (locale, VPS ou URL personnalisée) et exécute les tâches
La communication entre Relay et OpenClaw se fait via des connexions WebSocket/API.
Fonctionnalités clés de la source
- Dispatch et chat : Donnez des tâches en langage naturel, l'agent planifie les étapes, examinez les livrables finalisés
- Gouvernance : Portes d'approbation pour les opérations sur fichiers, commandes shell et envois de données ; piste d'audit exportable ; suivi des coûts par tâche
- Configuration : Planifiez des tâches récurrentes, parcourez et modifiez la mémoire de l'agent, gérez les connecteurs (Slack, Notion, GitHub, Jira, etc.), définissez les dossiers de travail du projet
- Flexibilité des modèles : Achemine les tâches vers n'importe quel backend LLM, y compris Claude, GPT-4, Llama, Gemini, Mixtral ou des points de terminaison personnalisés
- Souveraineté des données : Traite les fichiers sur votre infrastructure plutôt que sur les serveurs d'Anthropic
Exemple de flux de travail
La source fournit un exemple concret d'un briefing quotidien planifié :
- Dans Relay : Créez un planning pour "Quotidien 8h", configurez les connecteurs (Slack + Notion)
- OpenClaw exécute : Cron se déclenche à 8h, l'agent lit les fichiers du projet, récupère les fils Slack et les pages Notion, appelle votre LLM choisi, écrit le briefing en mémoire
- Le briefing apparaît dans Relay pour examen, approbation ou redirection
Cas d'utilisation cibles
Relay répond à trois limitations structurelles de Claude Cowork : les préoccupations de souveraineté des données pour les industries réglementées, le verrouillage du modèle (uniquement Claude) et les lacunes de conformité où les activités ne sont pas capturées dans les journaux d'audit standard. Cela le rend particulièrement pertinent pour les organisations ayant des politiques de données strictes ou celles ayant besoin d'utiliser plusieurs fournisseurs LLM.
📖 Lire la source complète : HN AI Agents
👀 See Also

Test pratique du modèle de Tencent : performant pour les workflows agents, faible pour le codage complexe
Le modèle de Tencent obtient un 8/10 pour les tâches agentiques avec un faible taux d'hallucination, mais échoue sur le code complexe comme les schémas de l'API Notion. À éviter pour la logique backend.

Protocole de Mémoire d'Agent (AMP) : Spécification Ouverte pour la Mémoire Interopérable des Agents IA au-dessus de MCP
AMP définit une interface standard pour la mémoire persistante des agents compatibles MCP avec six verbes principaux : encoder, rappeler, oublier, consolider, épingler et statistiques. Comprend une suite de tests de conformité et une implémentation de référence.

Routerly : Passerelle LLM auto-hébergée avec politiques de routage en temps réel et contrôle budgétaire
Routerly est une passerelle LLM gratuite, open-source et auto-hébergée qui offre une sélection de modèles en temps réel basée sur des politiques de routage comme le moins cher, le plus rapide ou le plus performant, ainsi que des limites budgétaires par projet avec suivi par token. Elle est compatible OpenAI pour une utilisation immédiate avec des outils comme Cursor, LangChain et Open WebUI.

Freestyle lance des Sandboxes pour les agents de codage IA avec un fork en direct
Freestyle propose des environnements de test cloud pour les agents de codage IA qui démarrent en ~500 ms et incluent un forking en direct avec une pause <400 ms, permettant des clones complets de machines virtuelles incluant l'état mémoire. Ils exécutent Debian complet avec virtualisation matérielle sur une infrastructure bare metal.