Bernstein : Un orchestrateur similaire à Kubernetes pour les agents d'IA de codage, avec vérification et politiques de modèle.

Bernstein est un orchestrateur pour agents d'IA de codage que son créateur décrit comme "Kubernetes pour agents de codage". Contrairement aux outils plus simples qui lancent des agents en parallèle dans des arbres de travail, Bernstein aborde ce que le développeur appelle "les 95 % restants" du problème.
Fonctionnalités clés
Le système comprend plusieurs composants critiques :
- Vérification : Un composant "concierge" vérifie indépendamment les sorties des agents après chaque tâche. Il exécute des tests, vérifie les différences et analyse le code produit, car "les agents mentent" - ils peuvent prétendre que les tests réussissent quand ce n'est pas le cas ou dire qu'ils ont validé des fichiers alors qu'ils ne l'ont pas fait.
- Moteur de politique de modèles : Fournit des listes d'autorisation/interdiction par fournisseur, des contraintes de résidence des données, un routage préférentiel et des plafonds de coût. Le créateur compare cela à "des politiques réseau K8s mais pour les fournisseurs de LLM".
- Planification déterministe : Utilise du Python pur pour la planification au lieu de LLM, créant un flux de contrôle déterministe sans aucun jeton LLM dépensé pour la coordination. Un bandit epsilon-greedy apprend le routage au fil du temps.
- Conception indépendante des agents : Inclut 13 adaptateurs pour Claude Code, Codex, Gemini CLI, Cursor, Qwen, Aider, Amp, Roo Code, Goose, Kilo, Kiro, OpenCode et des agents génériques. Claude Code a l'intégration la plus approfondie.
- Fonctionnalités d'échelle : Avec plus de 500 000 lignes et environ 5000 tests, Bernstein comprend des disjoncteurs, la détection d'anomalies de coût, la détection de boucles, la détection d'interblocages, la recherche de données personnelles, des journaux d'audit chaînés HMAC, des permissions progressives et une quarantaine pour les sorties suspectes.
- Auto-développement : Peut se développer lui-même en utilisant
bernstein --evole.
Détails techniques
Le créateur note que le lancement d'agents dans des arbres de travail est "le hello world de cet espace" et que la plupart des frameworks multi-agents utilisent un LLM pour planifier d'autres LLM, ce qui est "lent, coûteux et non déterministe". L'approche de Bernstein utilise du Python pur pour un flux de contrôle déterministe.
Le projet a été testé à grande échelle avec plus de 500 000 lignes de code et environ 5000 tests. Le développeur a construit des fonctionnalités comme des disjoncteurs et la détection d'anomalies parce que "des choses ont cassé et c'étaient les correctifs".
Le créateur est un développeur solo d'Israël qui mentionne "construire sous les roquettes (littéralement)" et que le projet l'a dépassé, cherchant des contributeurs.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

devopsiphai : Audits de santé opérationnelle des compétences en code Claude open-source à travers 6 phases
devopsiphai est une compétence Claude Code open-source qui audite l'opérabilité des projets de production en utilisant un processus en 6 phases et le cadre ARC, produisant des notes alphabétiques et un TODO.md structuré avec des tâches estimées en effort.

devcontainer-mcp : Offrez un environnement de développement dédié aux agents IA, pas le vôtre
devcontainer-mcp est un serveur MCP qui expose 45 outils permettant aux agents IA de créer, gérer et travailler dans des conteneurs de développement, soutenus par Docker, DevPod ou GitHub Codespaces — tout en gardant la machine hôte propre.

Tokenmeter : Application Windows gratuite pour suivre l'utilisation des tokens de Claude Code hors ligne
Tokenmeter est une application Windows gratuite et open-source qui lit les fichiers .jsonl locaux de Claude Code pour afficher l'utilisation des tokens, les coûts estimés, les économies de cache et une carte thermique d'activité sur 90 jours — le tout hors ligne.

Machine Virtuelle Logique : Un Système Basé sur des Invites pour Stopper les Effondrements de Raisonnement des LLM
Un chercheur a développé un prompt de Machine Virtuelle Logique (LVM) qui force les LLM à s'arrêter et à signaler des modes d'effondrement spécifiques lorsqu'ils rencontrent des paradoxes ou des dérives de raisonnement, basé sur une seule loi de stabilité : K(σ) ⇒ K(β(σ)). Le prompt est indépendant du substrat et fonctionne sur des modèles comme Grok et Claude.