Utilisateur de Reddit teste la fonction d'auto-apprentissage de l'agent IA Hermes, découvre des failles critiques

Hermes contre OpenClaw : Une comparaison pratique
Un utilisateur de Reddit qui utilise OpenClaw depuis la version du 29 janvier a testé l'agent IA Hermes pour évaluer ses capacités d'auto-apprentissage. L'utilisateur gagne de l'argent avec OpenClaw et le considère comme son outil principal.
Ce que fait réellement Hermes
Hermes présente l'« auto-apprentissage » comme son principal avantage par rapport à OpenClaw, mais selon les tests de l'utilisateur :
- Hermes n'est pas « auto-apprenant » au sens de l'apprentissage automatique
- Il utilise des fichiers markdown comme mémoire, comme OpenClaw
- L'« auto-apprentissage » fait référence à la création automatique de compétences sans écriture manuelle
- Les compétences = fichiers markdown générés automatiquement
Le problème critique : la boucle d'auto-évaluation
L'utilisateur a identifié un problème majeur dans l'implémentation d'Hermes :
- Hermes fonctionne dans une boucle d'apprentissage fermée où il évalue ses propres résultats
- Il pense toujours avoir bien fait le travail, quelle que soit la performance réelle
- Lors d'un test de récupération de résultats d'analyse d'eau sur le site de l'Indiana DNR, Hermes a « tout mélangé » mais pensait toujours avoir « assuré »
- Lorsque les utilisateurs modifient manuellement les compétences pour corriger les erreurs, la fonction d'auto-amélioration d'Hermes écrase ces modifications
Les affirmations de stabilité remises en question
L'utilisateur aborde les comparaisons de stabilité entre les deux outils :
- Hermes a eu 6 versions au total
- OpenClaw a eu 82 versions
- 3 des versions d'Hermes « ne fonctionnaient même pas »
- L'utilisateur conseille de ne pas affirmer qu'Hermes est plus stable en raison de son historique de versions limité
État actuel et avenir
L'utilisateur de Reddit conclut qu'Hermes est actuellement « inutilisable pour quelqu'un qui sait utiliser OpenClaw ». Cependant, il reconnaît que le projet pourrait « s'avérer incroyable » et prévoit de continuer à suivre son développement.
📖 Read the full source: r/openclaw
👀 See Also

Bouclier : Plugin de Sécurité Open-Source pour Claude Code avec Analyse Unifiée
Shield est un plugin de sécurité open-source pour Claude Code qui orchestre plusieurs outils de sécurité à partir d'une seule commande /shield:shield, détecte automatiquement votre pile technologique, exécute les outils installés et génère des rapports unifiés avec des scores de risque et des suggestions de corrections de code.

Conduid.com référence plus de 23 000 serveurs MCP dans un annuaire consultable.
Conduid.com agrège des serveurs MCP provenant de 11 sources, les déduplique et propose une recherche, des catégories et des scores de confiance basés sur l'activité GitHub, la qualité de la documentation et les signaux de maintenance.

Le Benchmark OpenClaw Montre que Qwen3.5:27B Surpasse les Autres LLMs Locaux pour les Tâches d'Agent
Un benchmark de 7 LLM locaux sur 22 tâches d'agent réelles utilisant OpenClaw a révélé que qwen3.5:27b-q4_K_M a obtenu 59,4 %, tandis que le deuxième, qwen3.5:35b, n'a obtenu que 23,2 %. La plupart des modèles n'ont pas pu trouver des outils de base comme les fonctions de messagerie.

OpenCortex : Un système de mémoire auto-améliorant pour OpenClaw
OpenCortex remplace le fichier plat MEMORY.md d'OpenClaw par des fichiers de mémoire structurés organisés par projets, contacts, workflows, préférences, runbooks, outils et infrastructure. Il inclut une distillation nocturne avec audits d'application des principes et une synthèse hebdomadaire avec détection de motifs et création automatique de runbooks.