Stagent : Couche opérationnelle open-source pour le SDK Agent Claude avec gouvernance locale et orchestration de flux de travail

Ce que fait Stagent
Stagent est un espace de coordination open-source, local-first, qui repose sur le SDK Agent Claude et l'API Claude. Il standardise la manière dont vous acheminez, supervisez et mesurez le travail des agents sur les deux environnements d'exécution sans les remplacer. Le problème central qu'il résout : vous ne devriez pas avoir besoin d'un tableur pour suivre ce que font vos agents IA, ce qu'ils coûtent, ou s'ils ont l'autorisation d'exécuter des commandes dangereuses.
Fonctionnalités clés et architecture
Le système comprend 15 interfaces produit : tableau de bord d'accueil, tableau d'exécution, boîte de réception, surveillance, registre des coûts, chat, scanner d'environnement, et plus encore. Il fournit 6 modèles d'orchestration de workflow : séquence, branchement parallèle/regroupement, point de contrôle, planificateur-exécuteur, boucle autonome et essaim multi-agents. Il existe plus de 52 profils d'agents réutilisables, incluant des personnalités spécialisées comme réviseur de code, chercheur, rédacteur de documents, gestionnaire de patrimoine et planificateur de voyages, regroupés en tant que compétences Claude Code avec des politiques d'outils et des instructions comportementales.
La gouvernance avec intervention humaine comprend des autorisations "autoriser une fois", "toujours autoriser" et "refuser". Chaque demande d'outil passe par une file d'attente de notifications, avec AskUserQuestion qui sollicite toujours une réponse, quelles que soient les autorisations enregistrées. Les garde-fous budgétaires fournissent des plafonds de dépenses quotidiens/mensuels qui bloquent tout nouvel appel au fournisseur lorsqu'ils sont dépassés, avec des avertissements à 80 % et l'achèvement gracieux des travaux déjà en cours.
Le registre des coûts multi-environnements suit la vélocité des tokens, la concentration des modèles, la répartition par environnement d'exécution et les pistes d'audit par tâche pour Claude et Codex dans une vue unique. Les exécutions planifiées prennent en charge les prompts récurrents ou ponctuels avec sélection de profil d'agent, limites de déclenchement et fenêtres d'expiration.
Implémentation technique
L'ensemble du produit a été construit en utilisant Claude Code avec Opus, du schéma de base de données aux composants d'interface utilisateur. L'architecture est local-first avec zéro dépendance externe, utilisant SQLite en mode WAL avec Drizzle ORM (16+ tables). Tout s'exécute sur votre machine sans cloud ni télémétrie.
Le système d'approbation utilise la table de notifications comme une file de messages. Lorsqu'un agent demande un outil dangereux, canUseTool interroge la table de notifications jusqu'à ce qu'un humain réponde, permettant la gouvernance sans websockets ni files d'attente externes.
Les modèles de workflow incluent des boucles autonomes qui exécutent les agents de manière itérative, chaque itération voyant la sortie précédente (inspiré du concept de "laboratoire de recherche à un GPU" de Karpathy), des essaims multi-agents utilisant un modèle Maire→Ouvriers→Raffinerie avec concurrence limitée (2-5 ouvriers) et nouvelle tentative au niveau de l'étape, et un branchement parallèle/regroupement qui divise les questions de recherche entre branches et synthétise les résultats.
Le catalogue de modèles signifie que vous ne configurez jamais manuellement les workflows. Vous choisissez un modèle (revue de code, recherche approfondie, planification de sprint), remplissez les variables, et le modèle résout automatiquement les profils, les prompts et les étapes conditionnelles.
Le scanner d'environnement découvre tous vos artefacts Claude Code et Codex CLI — compétences, hooks, serveurs MCP, permissions, fichiers de mémoire — et présente un score de santé unifié, les analyses typiques prenant 10-50 ms.
Pile technologique
Next.js 16, React 19, TypeScript, Tailwind v4, shadcn/ui, SQLite, Drizzle ORM, SDK Agent Claude, Codex App Server.
📖 Read the full source: r/ClaudeAI
👀 See Also

MCP permet à Claude d'analyser automatiquement les données de Google Search Console
Un nouveau MCP gratuit connecte Claude directement à Google Search Console, permettant d'interroger en langage naturel les données de performance de recherche comme les requêtes, les pages, les clics et le CTR, sans export CSV manuel.

Faire avancer les choses : Système de méta-prompting pour les agents d'IA de codage
Get Shit Done est un système de méta-invites, d'ingénierie de contexte et de développement piloté par spécifications qui fonctionne avec Claude Code, OpenCode, Gemini CLI, Codex, Copilot et Antigravity. Il traite la dégradation de contexte en fournissant des invites structurées et des flux de travail de vérification.

Pali v0.1 : Infrastructure de mémoire open source pour LLM avec des benchmarks reproductibles
Pali est une infrastructure de mémoire open source pour les LLM, construite en Go sous forme d'un binaire unique avec des API multi-locataires, une récupération hybride et des extensions plug-and-play. La version v0.1 inclut une suite de benchmarks avec des résultats reproductibles montrant les métriques de performance pour différentes configurations.

GitVelocity : L'IA évalue 50 000 PR et révèle des informations sur la complexité du code
GitVelocity utilise Claude pour évaluer les pull requests fusionnées sur une échelle de 0 à 100 selon six dimensions : portée, architecture, implémentation, risque, qualité et performance/sécurité. Après avoir analysé plus de 50 000 PR dans les langages TypeScript, Python, Rust, Go, Java et Elixir, l'équipe a découvert des tendances surprenantes concernant la taille des PR, la couverture des tests et l'adoption de l'IA.