MartinLoop : Plan de contrôle open source pour agents de codage IA avec plafonds budgétaires et pistes d'audit
MartinLoop est un plan de contrôle open source pour les agents de codage IA qui répond aux modes de défaillance courants : réessayer la même approche erronée, terminer des tâches sans preuve, brûler des tokens silencieusement, apporter des modifications non vérifiables et échouer de manière difficile à classer. Il fournit des limites budgétaires strictes, des enregistrements JSONL, des pistes d'audit inspectables, une classification des échecs, une validation par tests et des exécutions de benchmarks reproductibles.
Fonctionnalités clés :
- Limites budgétaires strictes — plafonner automatiquement les dépenses des agents.
- Enregistrements JSONL — chaque étape est journalisée dans un format structuré.
- Pistes d'audit inspectables — tout ingénieur peut examiner les actions de l'agent.
- Classification des échecs — catégoriser la raison d'un échec (ex. boucle infinie, mauvaise approche).
- Achèvement validé par tests — les agents doivent réussir des tests définis avant de déclarer la tâche terminée.
- Benchmarks reproductibles — standardiser l'évaluation entre agents.
Le projet se positionne comme un CI/CD pour agents autonomes. Le cœur est open source sur GitHub : https://github.com/Keesan12/Martin-Loop. Une démo est disponible sur https://martinloop.com/demo.
Utile pour les équipes utilisant Claude Code, Codex, Cursor, les agents de type Devin ou les boucles d'agents personnalisées qui ont besoin de gouvernance, de budgets, d'évaluations et d'auditabilité sur leurs workflows de codage IA.
📖 Source : r/ClaudeAI
👀 See Also

NerfGuard : un classifieur qui oriente les demandes de codage vers des modèles moins chers, réduisant les coûts de 3 fois
NerfGuard utilise un classifieur rapide pour acheminer les requêtes des agents de codage vers le modèle et la profondeur de raisonnement les moins chers, permettant ainsi une utilisation 3x supérieure pour le même budget. Inclut des optimisations de tokens.

Pu.sh : Un harnais d'agent de codage en script shell de 400 lignes issu de HN
Pu.sh est un harnais d'agent de codage portable en 400 lignes de shell (sh, curl, awk), supportant Anthropic + OpenAI, 7 outils, REPL, point de contrôle/reprise, et mode pipe — avec 90 tests sans API.

ClawRelay : Proxy LLM compatible OpenAI natif pour macOS avec basculement automatique
ClawRelay exécute un serveur HTTP compatible OpenAI sur macOS 15+ avec un basculement automatique entre les fournisseurs de LLM. Il prend en charge OpenAI, Groq, Nvidia NIMs, Ollama et tout service disposant d'un point de terminaison /v1/chat/completions.

Examen des performances d'Omnicoder-9B : Vitesse contre problèmes d'appel d'outils
Omnicoder-9B, un modèle axé sur le codage affiné sur Qwen3.5 9B avec des sorties d'Opus 4.6, GPT 5.4, GPT 5.3 Codex et Gemini 3.1 Pro, montre de solides performances sur du matériel de milieu de gamme mais présente des problèmes d'appel d'outils dans les IDE.