Les agents d'IA préfèrent les requêtes structurées au langage naturel lors des tests du serveur MCP Cala.

L'équipe de Cala a récemment livré un serveur MCP qui offre trois façons distinctes pour les agents IA d'accéder à leur graphe de connaissances : requêtes en langage naturel, langage de requête structuré et parcours direct des entités/relations.
Comportement inattendu des agents
Malgré les attentes que les agents utiliseraient par défaut les interfaces en langage naturel (le point fort typique des LLM), la plupart des agents ont abandonné les requêtes en langage naturel en quelques minutes. Sans aucune incitation ou suggestion, ils sont passés de manière autonome à l'utilisation des requêtes structurées et des méthodes de parcours de graphe.
Pourquoi cela a du sens
La source explique ce comportement en notant que les LLM ne sont pas explicitement entraînés à être "efficaces" mais plutôt à être corrects grâce au RLHF. Cette recherche de justesse conduit à un comportement efficace comme effet secondaire - les agents apprennent à prendre le chemin fiable le plus court vers les solutions. Les interfaces en langage naturel ajoutent une couche d'interprétation qui introduit de l'incertitude, tandis que les requêtes structurées fournissent des résultats déterministes.
Face à trois méthodes d'accès, les agents ont systématiquement choisi l'option qui minimisait l'incertitude plutôt que l'interface la plus "naturelle".
Questions clés soulevées
- Accordons-nous trop d'importance aux interfaces en langage naturel pour les outils d'agents ?
- Les serveurs MCP devraient-ils privilégier par défaut les modèles d'accès structurés/par graphe plutôt que le langage naturel ?
- Si les agents préfèrent les chemins déterministes, comment cela devrait-il influencer la conception des outils ?
La discussion sur Reddit sollicite l'avis d'autres personnes développant des outils pour agents pour voir si elles ont observé des schémas similaires.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Coinbase x402 contre Google A2A : Deux ordres de paiement opposés pour les paiements entre agents.
Construire des paiements entre agents révèle une divergence fondamentale : le middleware x402 de Coinbase règle après le travail (vérifier→exécuter→régler), tandis que l'extension A2A de Google règle avant (vérifier→régler→exécuter) pour les appels d'agents lents.

Mise à jour OpenClaw .23 Provoquant des Problèmes d'Agent et des Pertes de Données
La mise à jour OpenClaw .23 provoque des agents non réactifs, incapables d'exécuter des tâches et perdant la connexion avec les extensions de navigateur. L'exécution de la commande de réparation peut supprimer des configurations JSON entières, nécessitant des sauvegardes système pour la récupération.

Un standard ouvert pour les enregistrements d’exécution d’agents : Plaidoyer pour un schéma de log partagé
Chaque runtime d'agent a son propre format de log, entraînant une fragmentation dans le débogage, l'audit et la portabilité des outils. Les champs convergent déjà vers un schéma de base — il est temps de normaliser.

Les ingénieurs en IA ne sont pas à l'abri d'être remplacés par l'IA
À mesure que les modèles de base comme DINO de Meta deviennent polyvalents, les rôles spécialisés en IA se voient cannibalisés. L'auteur affirme que la plupart des emplois d'ingénieur IA seront remplacés plus tôt que d'autres postes de développeur.