Agents IA parient sur la Coupe du Monde : pourquoi « garder plusieurs issues en jeu » gagne

Une expérience menée avec plus de 40 agents IA indépendants sur Polymarket, chacun doté d'un portefeuille de 100 $, a placé environ 1 500 paris réels sur les matchs de la phase de groupes de la Coupe du Monde 2026. Les agents ayant terminé en profit ont parié sur plusieurs résultats dans un même match bien plus souvent que les agents perdants. En médiane, 16 % de leurs matchs contre 6 % pour les perdants.
Résultat clé : Croyance vs. Action
Les agents LLM sont forts pour former des croyances mais faibles pour choisir des actions. La solution : ajouter une étape de valorisation. Au lieu de sélectionner le résultat le plus probable, l'agent doit :
- Produire une probabilité pour chaque résultat (domicile, nul, extérieur) qui somme à 1,0 — c'est la croyance.
- Évaluer chaque résultat en fonction de son gain par rapport à sa probabilité (edge). Parier sur le résultat avec le plus d'edge, qui n'est souvent pas le plus probable.
- Parier sur plus d'un résultat lorsque plusieurs dépassent le seuil d'edge — ne pas forcer un choix unique.
- Ne jamais écarter le match nul. Les agents perdants n'ont pas mal jugé la probabilité du nul ; ils n'ont tout simplement jamais évalué si le nul valait la peine d'être joué à son prix.
Application pratique
Pour tout agent IA prenant des décisions en situation d'incertitude, séparez la génération de croyances de la sélection d'actions. Générez une distribution de probabilité complète, puis évaluez la valeur attendue de chaque action indépendamment.
📖 Lire la source complète : r/clawdbot
👀 See Also

L'Inde développe des modèles d'IA frugaux pour répondre aux besoins locaux avec Sarvam et Krutrim.
Les startups indiennes Sarvam AI et Krutrim développent des modèles d'IA souverains optimisés pour les smartphones bas de gamme et les réseaux à faible bande passante, avec le modèle SarvamM de 24 milliards de paramètres de Sarvam entraîné sur 10 langues indiennes.

L'équipe MeshCore se divise : marque déposée en secret, litige autour du code généré par IA.
L'équipe de développement de MeshCore se sépare publiquement après que le contributeur Andy Kirby a déposé secrètement une demande de marque pour MeshCore et a utilisé Claude Code pour générer la majorité de ses contributions de code sans le divulguer.

Nouvelle version d'OpenClaw : Simple changement de nom ou mise à niveau majeure ?
OpenClaw, anciennement connu sous le nom de ClawDBot, a subi une transformation. Lisez la suite pour découvrir si ce changement est purement cosmétique ou s'il introduit de nouvelles fonctionnalités et une stabilité améliorée.

Claude Code v2.1.172 : Sous-agents désormais à 5 niveaux de profondeur, corrections de la région Bedrock et gains de performance
Claude Code v2.1.172 permet aux sous-agents de générer des sous-agents jusqu'à 5 niveaux de profondeur, corrige la détection de région Bedrock, ajoute une recherche de plugins et améliore les performances dans les longues conversations.