KI-Agenten wetten auf die WM: Warum "mehrere Ergebnisse im Spiel halten" gewinnt

✍️ OpenClawRadar📅 Veröffentlicht: 7. Juli 2026🔗 Source
KI-Agenten wetten auf die WM: Warum "mehrere Ergebnisse im Spiel halten" gewinnt
Ad

Ein Experiment mit über 40 unabhängigen KI-Agenten auf Polymarket, die jeweils ein Guthaben von 100 $ hatten, platzierte rund 1.500 Echtgeld-Wetten auf Spiele der Gruppenphase der WM 2026. Die Agenten, die mit Gewinn abschlossen, setzten deutlich häufiger auf mehr als ein Ergebnis in demselben Spiel als die Verlierer. Im Median betraf dies 16 % ihrer Spiele gegenüber 6 % bei den Verlierern.

Wichtige Erkenntnis: Überzeugung vs. Handlung

LLM-Agenten sind stark darin, Überzeugungen zu bilden, aber schlecht darin, Handlungen zu wählen. Der Fix: Füge einen Wertschritt hinzu. Statt das wahrscheinlichste Ergebnis auszuwählen, sollte der Agent:

  • Eine Wahrscheinlichkeit für jedes Ergebnis (Heimsieg, Unentschieden, Auswärtssieg) erstellen, die in der Summe 1,0 ergibt – das ist die Überzeugung.
  • Jedes Ergebnis nach Auszahlung im Verhältnis zur Wahrscheinlichkeit bewerten (Vorteil). Setze auf das Ergebnis mit dem größten Vorteil, was oft nicht das wahrscheinlichste ist.
  • Auf mehr als ein Ergebnis setzen, wenn mehr als eines die Vorteilsschwelle überschreitet – erzwinge keine einzelne Wahl.
  • Das Unentschieden niemals ausschließen. Verlierende Agenten haben die Wahrscheinlichkeit eines Unentschiedens nicht falsch eingeschätzt; sie haben nie geprüft, ob das Unentschieden zu seinem Preis lohnend war.
Ad

Praktische Anwendung

Für jeden KI-Agenten, der Entscheidungen unter Unsicherheit trifft, trenne die Überzeugungsbildung von der Handlungsauswahl. Erstelle eine vollständige Wahrscheinlichkeitsverteilung und bewerte dann den erwarteten Wert jeder Handlung unabhängig.

📖 Read the full source: r/clawdbot

Ad

👀 Siehe auch

70% der Entwickler sagen, KI-Code hat mehr Schwachstellen; 30% liefern ihn trotzdem aus – Checkmarx-Umfrage
Nachrichten

70% der Entwickler sagen, KI-Code hat mehr Schwachstellen; 30% liefern ihn trotzdem aus – Checkmarx-Umfrage

70 % der Entwickler glauben, dass KI-generierter Code deutlich mehr Schwachstellen aufweist, doch 30 % bringen wissentlich unsicheren Code in die Produktion. Die Checkmarx-Umfrage unter 2.350 Befragten zeigt zudem, dass 93 % der Organisationen Sicherheitsverletzungen durch unsichere Anwendungen erlitten.

OpenClawRadar
Andrej Karpathy tritt dem Pre-Training-Team von Anthropic bei, um die rekursive Selbstverbesserung mit Claude voranzutreiben
Nachrichten

Andrej Karpathy tritt dem Pre-Training-Team von Anthropic bei, um die rekursive Selbstverbesserung mit Claude voranzutreiben

Andrej Karpathy, ehemaliger OpenAI-Mitbegründer, schließt sich unter Nick Josef dem Pre-Training-Team von Anthropic an, um ein neues Team aufzubauen, das sich darauf konzentriert, Claude zur Beschleunigung der Pre-Training-Forschung zu nutzen und so eine rekursive Selbstverbesserung zu ermöglichen.

OpenClawRadar
Gefährlich Code überspringen: Wenn LLMs schneller Code schreiben, als du ihn lesen kannst
Nachrichten

Gefährlich Code überspringen: Wenn LLMs schneller Code schreiben, als du ihn lesen kannst

Was, wenn wir aufhören, LLM-generierten Code zu reviewen, und ihn stattdessen wie Maschinencode behandeln? Verlagern wir die Sorgfalt auf Spezifikationen und Tests.

OpenClawRadar
LeMario: Training eines JEPA-Weltmodells mit Super Mario Bros — Technischer Leitfaden und Nachbetrachtung
Nachrichten

LeMario: Training eines JEPA-Weltmodells mit Super Mario Bros — Technischer Leitfaden und Nachbetrachtung

Benjamin Bai reproduziert LeWorldModels JEPA-Architektur von Grund auf und trainiert sie auf Super Mario Bros. Das Modell sagt fünf Schritte voraus, scheitert aber bei der langfristigen Planung – eine detaillierte technische Nachlese.

OpenClawRadar