MartinLoop : Plan de contrôle open source pour agents de codage IA avec plafonds budgétaires et pistes d'audit

✍️ OpenClawRadar📅 Publié: May 11, 2026🔗 Source
Ad

MartinLoop est un plan de contrôle open source pour les agents de codage IA qui répond aux modes de défaillance courants : réessayer la même approche erronée, terminer des tâches sans preuve, brûler des tokens silencieusement, apporter des modifications non vérifiables et échouer de manière difficile à classer. Il fournit des limites budgétaires strictes, des enregistrements JSONL, des pistes d'audit inspectables, une classification des échecs, une validation par tests et des exécutions de benchmarks reproductibles.

Fonctionnalités clés :

  • Limites budgétaires strictes — plafonner automatiquement les dépenses des agents.
  • Enregistrements JSONL — chaque étape est journalisée dans un format structuré.
  • Pistes d'audit inspectables — tout ingénieur peut examiner les actions de l'agent.
  • Classification des échecs — catégoriser la raison d'un échec (ex. boucle infinie, mauvaise approche).
  • Achèvement validé par tests — les agents doivent réussir des tests définis avant de déclarer la tâche terminée.
  • Benchmarks reproductibles — standardiser l'évaluation entre agents.

Le projet se positionne comme un CI/CD pour agents autonomes. Le cœur est open source sur GitHub : https://github.com/Keesan12/Martin-Loop. Une démo est disponible sur https://martinloop.com/demo.

Ad

Utile pour les équipes utilisant Claude Code, Codex, Cursor, les agents de type Devin ou les boucles d'agents personnalisées qui ont besoin de gouvernance, de budgets, d'évaluations et d'auditabilité sur leurs workflows de codage IA.

📖 Source : r/ClaudeAI

Ad

👀 See Also

NerfGuard : un classifieur qui oriente les demandes de codage vers des modèles moins chers, réduisant les coûts de 3 fois
Tools

NerfGuard : un classifieur qui oriente les demandes de codage vers des modèles moins chers, réduisant les coûts de 3 fois

NerfGuard utilise un classifieur rapide pour acheminer les requêtes des agents de codage vers le modèle et la profondeur de raisonnement les moins chers, permettant ainsi une utilisation 3x supérieure pour le même budget. Inclut des optimisations de tokens.

OpenClawRadar
Pu.sh : Un harnais d'agent de codage en script shell de 400 lignes issu de HN
Tools

Pu.sh : Un harnais d'agent de codage en script shell de 400 lignes issu de HN

Pu.sh est un harnais d'agent de codage portable en 400 lignes de shell (sh, curl, awk), supportant Anthropic + OpenAI, 7 outils, REPL, point de contrôle/reprise, et mode pipe — avec 90 tests sans API.

OpenClawRadar
ClawRelay : Proxy LLM compatible OpenAI natif pour macOS avec basculement automatique
Tools

ClawRelay : Proxy LLM compatible OpenAI natif pour macOS avec basculement automatique

ClawRelay exécute un serveur HTTP compatible OpenAI sur macOS 15+ avec un basculement automatique entre les fournisseurs de LLM. Il prend en charge OpenAI, Groq, Nvidia NIMs, Ollama et tout service disposant d'un point de terminaison /v1/chat/completions.

OpenClawRadar
Examen des performances d'Omnicoder-9B : Vitesse contre problèmes d'appel d'outils
Tools

Examen des performances d'Omnicoder-9B : Vitesse contre problèmes d'appel d'outils

Omnicoder-9B, un modèle axé sur le codage affiné sur Qwen3.5 9B avec des sorties d'Opus 4.6, GPT 5.4, GPT 5.3 Codex et Gemini 3.1 Pro, montre de solides performances sur du matériel de milieu de gamme mais présente des problèmes d'appel d'outils dans les IDE.

OpenClawRadar