Bernstein : Un orchestrateur similaire à Kubernetes pour les agents d'IA de codage, avec vérification et politiques de modèle.

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
Bernstein : Un orchestrateur similaire à Kubernetes pour les agents d'IA de codage, avec vérification et politiques de modèle.
Ad

Bernstein est un orchestrateur pour agents d'IA de codage que son créateur décrit comme "Kubernetes pour agents de codage". Contrairement aux outils plus simples qui lancent des agents en parallèle dans des arbres de travail, Bernstein aborde ce que le développeur appelle "les 95 % restants" du problème.

Fonctionnalités clés

Le système comprend plusieurs composants critiques :

  • Vérification : Un composant "concierge" vérifie indépendamment les sorties des agents après chaque tâche. Il exécute des tests, vérifie les différences et analyse le code produit, car "les agents mentent" - ils peuvent prétendre que les tests réussissent quand ce n'est pas le cas ou dire qu'ils ont validé des fichiers alors qu'ils ne l'ont pas fait.
  • Moteur de politique de modèles : Fournit des listes d'autorisation/interdiction par fournisseur, des contraintes de résidence des données, un routage préférentiel et des plafonds de coût. Le créateur compare cela à "des politiques réseau K8s mais pour les fournisseurs de LLM".
  • Planification déterministe : Utilise du Python pur pour la planification au lieu de LLM, créant un flux de contrôle déterministe sans aucun jeton LLM dépensé pour la coordination. Un bandit epsilon-greedy apprend le routage au fil du temps.
  • Conception indépendante des agents : Inclut 13 adaptateurs pour Claude Code, Codex, Gemini CLI, Cursor, Qwen, Aider, Amp, Roo Code, Goose, Kilo, Kiro, OpenCode et des agents génériques. Claude Code a l'intégration la plus approfondie.
  • Fonctionnalités d'échelle : Avec plus de 500 000 lignes et environ 5000 tests, Bernstein comprend des disjoncteurs, la détection d'anomalies de coût, la détection de boucles, la détection d'interblocages, la recherche de données personnelles, des journaux d'audit chaînés HMAC, des permissions progressives et une quarantaine pour les sorties suspectes.
  • Auto-développement : Peut se développer lui-même en utilisant bernstein --evole.
Ad

Détails techniques

Le créateur note que le lancement d'agents dans des arbres de travail est "le hello world de cet espace" et que la plupart des frameworks multi-agents utilisent un LLM pour planifier d'autres LLM, ce qui est "lent, coûteux et non déterministe". L'approche de Bernstein utilise du Python pur pour un flux de contrôle déterministe.

Le projet a été testé à grande échelle avec plus de 500 000 lignes de code et environ 5000 tests. Le développeur a construit des fonctionnalités comme des disjoncteurs et la détection d'anomalies parce que "des choses ont cassé et c'étaient les correctifs".

Le créateur est un développeur solo d'Israël qui mentionne "construire sous les roquettes (littéralement)" et que le projet l'a dépassé, cherchant des contributeurs.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

La compétence Claude Code combine les approches de DeepMind Aletheia et d'Anthropic harness.
Tools

La compétence Claude Code combine les approches de DeepMind Aletheia et d'Anthropic harness.

Une compétence Claude Code implémente un pipeline Planificateur → Générateur → Évaluateur → Réviseur qui synthétise l'agent de recherche mathématique Aletheia de DeepMind avec l'architecture de codage multi-agent d'Anthropic, ajoutant une pré-analyse à l'aveugle où l'évaluateur raisonne sur les approches correctes avant de voir le code candidat.

OpenClawRadar
Claude Code Studio : Application de bureau open-source pour gérer plusieurs sessions de codage Claude
Tools

Claude Code Studio : Application de bureau open-source pour gérer plusieurs sessions de codage Claude

Claude Code Studio v0.9.3 est une application de bureau open-source qui fournit une interface multi-fenêtres pour gérer plusieurs sessions CLI Claude Code. Il résout les problèmes courants de flux de travail comme jongler avec les onglets de terminal, la persistance des sessions et la répétition des instructions.

OpenClawRadar
La réutilisation du cache KV pour les conversations longues sur Apple Silicon offre une accélération de 200x
Tools

La réutilisation du cache KV pour les conversations longues sur Apple Silicon offre une accélération de 200x

Un développeur a mis en œuvre la réutilisation du cache KV basé sur des sessions pour l'inférence LLM locale en utilisant le framework MLX d'Apple, obtenant une amélioration de 200x du temps jusqu'au premier token pour une longueur de contexte de 100K. L'approche conserve le cache KV en mémoire à travers les tours de conversation, ne traitant que les nouveaux tokens.

OpenClawRadar
Task-observateur : une méta-compétence qui automatise l’amélioration des compétences pour les agents de codage IA
Tools

Task-observateur : une méta-compétence qui automatise l’amélioration des compétences pour les agents de codage IA

Task-observer est une méta-compétence qui améliore automatiquement toutes les compétences de votre agent IA, y compris elle-même. Elle a enregistré 600 améliorations de compétences à travers 40 compétences en 3 mois et automatise la création de compétences à partir des lacunes dans le travail.

OpenClawRadar