40 ИИ-агентов ставят 4 тыс. долларов на групповой этап ЧМ: как ловушка фаворита стоила 18 центов за доллар

В ходе продолжающегося эксперимента более 40 независимых ИИ-агентов получили по $100 для ставок реальных денег на матчи группового этапа Чемпионата мира по футболу 2026 года через Polymarket. Примерно в 1500 ставках преобладала одна закономерность: ставка на фаворита была самым надежным способом потерять деньги. Фавориты выигрывали примерно в 69% случаев, но агенты все равно теряли 18 центов на каждый поставленный доллар.
Ловушка фаворитов
Коренная причина — ценообразование. Покупка фаворита по цене 70 центов означает, что выигрыш приносит всего 30 центов, в то время как проигрыш стоит полных 70 центов. Такая асимметричная выплата работает только в том случае, если фавориты выигрывают так же часто, как предполагает рыночная цена. На практике этого не произошло, и чем сильнее был фаворит, тем больше был разрыв.
Три правила, как этого избежать
- Не учитывайте рыночную цену в прогнозе. Пусть агент приходит к собственной вероятности на основе исходных данных, прежде чем увидит линию.
- Закодируйте метод, а не свои выводы. Обвязка, которая указывает агенту, что думать, просто быстрее передает ваши собственные искажения.
- Ставьте на фаворита только тогда, когда собственная вероятность агента явно выше рыночной цены. Если рынок говорит 70, а агент — 70, это повод воздержаться.
В статье также обсуждается, как разработчики невольно вносят это искажение в обвязки агентов и как команда обнаружила его в логических цепочках до того, как это отразилось на прибыли и убытках.
📖 Читать полный источник: r/clawdbot
👀 Смотрите также

Агентная GRPO: первый ИИ, победивший всех людей в соревновании по программированию
Новый алгоритм RL Agentic GRPO позволяет ИИ победить всех людей в соревновании по программированию, предоставляя немедленные награды и отложенную коррекцию.

Ошибка подписки Claude Pro: платные пользователи застряли на бесплатном тарифе
Ошибка в Claude Pro после использования подарочного пропуска оставляет аккаунты на бесплатном плане, несмотря на успешную оплату и получение чеков. Поддержка Anthropic не отвечает в течение недели.

Отчет Anthropic об интенсивности внедрения искусственного интеллекта в мире
Последние данные Anthropic показывают неравномерное внедрение ИИ в мире, измеряя интенсивность использования, а не общее количество пользователей. Отчёт демонстрирует, где ИИ интегрирован в рабочие процессы, такие как программирование, исследования и принятие решений, как среди частных лиц, так и в бизнесе.

Точность Claude Opus 4.6 снизилась в тесте на галлюцинации BridgeBench.
Claude Opus 4.6 демонстрирует значительное снижение точности в тесте на галлюцинации BridgeBench — с 83% до 68%, согласно сообщению BridgeMind AI в Twitter.