40 KI-Agenten wetten 4.000 $ auf die WM-Gruppenphase: Wie die Favoritenfalle 18 Cent pro Dollar kostete

Ein laufendes Experiment gab über 40 unabhängigen KI-Agenten jeweils 100 $, um mit Echtgeld auf Spiele der Gruppenphase der WM 2026 über Polymarket zu wetten. Bei rund 1.500 Wetten zeichnete sich ein Muster ab: Auf den Favoriten zu setzen war der sicherste Weg, Geld zu verlieren. Die Favoriten gewannen etwa 69 % der Zeit, aber die Agenten verloren dennoch 18 Cent pro eingesetztem Dollar.
Die Favoritenfalle
Die Ursache liegt in der Preisgestaltung. Einen Favoriten für 70 Cent zu kaufen bedeutet, dass ein Sieg nur 30 Cent Gewinn bringt, während eine Niederlage die vollen 70 Cent kostet. Diese asymmetrische Auszahlung funktioniert nur, wenn Favoriten so oft gewinnen, wie der Marktpreis impliziert. In der Praxis taten sie das nicht, und je klarer der Favorit, desto größer die Lücke.
Drei Regeln, um sie zu vermeiden
- Marktpreis aus der Prognose heraushalten. Lassen Sie den Agenten seine eigene Wahrscheinlichkeit aus Rohdaten ableiten, bevor er die Linie sieht.
- Kodieren Sie die Methode, nicht Ihre Schlussfolgerungen. Ein Rahmen, der dem Agenten sagt, was er denken soll, gibt nur Ihre eigenen Vorurteile zurück – nur schneller.
- Setzen Sie nur auf einen Favoriten, wenn die eigene Wahrscheinlichkeit des Agenten klar über dem Marktpreis liegt. Sagt der Markt 70 und der Agent sagt 70, ist das ein Pass.
Der Artikel erörtert auch, wie Entwickler diese Verzerrung unbeabsichtigt in die Agenten-Strukturen einbauen und wie das Team sie in den Denkprotokollen entdeckte, bevor die Gewinn-und-Verlust-Rechnung betroffen war.
📖 Vollständige Quelle lesen: r/clawdbot
👀 Siehe auch

OpenAI entwickelt laut Reuters-Bericht eine GitHub-Alternative
Reuters berichtet, dass OpenAI eine Alternative zu Microsofts GitHub entwickelt, wobei die Geschichte auf Hacker News 35 Punkte und 12 Kommentare erhielt.

Claude fügt Gesprächen interaktive Diagramme und Grafiken direkt im Text hinzu.
Claude erstellt jetzt benutzerdefinierte Diagramme, Grafiken und Visualisierungen direkt in Chat-Konversationen, sodass Nutzer Visualisierungen anpassen und verändern können, während sich Diskussionen entwickeln. Die Funktion ist in der Beta-Version für alle Tariftypen verfügbar und erscheint inline anstatt in Seitenleisten.

Hybride KI-Architektur: Open-Source-Komponenten mit proprietären Reasoning-Modellen
Eine praktische hybride KI-Architektur entsteht, bei der 89 % der Organisationen Open-Source-Komponenten nutzen, um die Kosten um über 50 % zu senken, während proprietäre Modelle komplexe Denkaufgaben bewältigen. Open-Source-Frameworks bieten Transparenz und Feinabstimmungsmöglichkeiten ohne Lizenzverhandlungen.

Claude Code v2.1.119: Konfigurationspersistenz, GitLab-/Bitbucket-PR-Unterstützung und Dutzende Fehlerbehebungen
Claude Code v2.1.119 speichert /config-Einstellungen in ~/.claude/settings.json, unterstützt --from-pr für GitLab-MRs und Bitbucket-PRs und behebt über 25 Fehler, darunter CRLF-Einfügen, MCP-OAuth und Auto-Mode-Konflikte.