Publication Reddit critique les flux de travail des agents PDG virtuels, prône une approche basée sur les compétences

Un post Reddit sur r/openclaw s'oppose à un modèle courant dans les flux de travail des agents IA : créer des systèmes complexes avec des agents nommés d'après des rôles professionnels spécifiques. L'auteur décrit cela comme une "frénésie de PDG virtuel" et le considère comme une surcharge inutile.
La critique
Le post mentionne spécifiquement avoir vu des gens créer des agents avec des titres comme :
- Développeur backend
- Développeur frontend
- Growth hacker
- Expert en sécurité
- Marketeur
L'auteur critique cette approche, suggérant qu'elle crée "des agents experts factices qui font des choses que nous ne voulons pas sur la base de données aléatoires de leur entraînement."
Flux de travail alternatif proposé
Au lieu d'attribuer des titres de poste aux agents, le post préconise de regrouper les capacités utiles en compétences qui peuvent être appelées en cas de besoin. Le flux de travail spécifique de l'auteur est :
- Commencer par une instruction
- Demander au LLM de suggérer des améliorations
- Faire extraire et sauvegarder par le LLM les meilleures pratiques pertinentes qu'il a apprises en tant que compétence nommée (par exemple, 'compétence-X')
- Lorsqu'on rencontre des problèmes similaires plus tard, demander au LLM d'effectuer la tâche en utilisant la compétence sauvegardée comme référence
Cette approche vise à avoir "les bons outils prêts pour des tâches spécifiques" plutôt que de maintenir plusieurs agents spécialisés.
📖 Read the full source: r/openclaw
👀 See Also

Les journaux de session de l'agent de codage sont stockés localement, ce qui pourrait permettre un entraînement fédéré ouvert.
Les agents de codage comme Claude Code et Codex CLI stockent localement des journaux de session détaillés, incluant les tâches, le raisonnement, les appels d'outils et les réponses de l'environnement. Un post Reddit propose d'utiliser ces données via l'apprentissage fédéré pour créer un équivalent ouvert aux jeux de données d'entraînement propriétaires.

Bêta publique de sécurité Claude : analyse le code, valide ses propres découvertes, propose des correctifs
Anthropic a lancé Claude Security en version bêta publique pour les clients Enterprise. Il raisonne à travers le code comme un chercheur en sécurité, remet en question ses propres conclusions via une auto-vérification adversarial, et propose des correctifs concrets.

Claude Code v2.1.136 : Refus strict pour le mode automatique, correctifs MCP OAuth et plus de 40 corrections de bugs
Anthropic a publié Claude Code v2.1.136 avec un paramètre hard_deny pour les règles du classificateur en mode automatique, des correctifs pour la disparition du serveur MCP après /clear, les problèmes de concurrence lors de l'actualisation des jetons OAuth, et plus de 40 autres corrections de bugs.
Claude Code v2.1.283 ajoute des paramètres d'autorisation/de refus de modèle et un audit des invites
Claude Code v2.1.283 ajoute les paramètres gérés availableModelsMatch="exact" et deniedModels, une commande /doctor prompt-audit, et des en-têtes de corrélation prompt-id pour les passerelles.