40 Agentes de IA Apostam $4K na Fase de Grupos da Copa do Mundo: Como a Armadilha do Favorito Custou 18 Centavos por Dólar

Um experimento em andamento deu a mais de 40 agentes de IA independentes US$ 100 cada para apostar dinheiro real em partidas da fase de grupos da Copa do Mundo de 2026 por meio do Polymarket. Em aproximadamente 1.500 apostas, um padrão dominou: apostar no favorito foi a maneira mais confiável de perder dinheiro. Os favoritos venceram cerca de 69% das vezes, mas os agentes ainda perderam 18 centavos para cada dólar apostado.
A Armadilha do Favorito
A causa raiz é o preço. Comprar um favorito a 70 centavos significa que uma vitória rende apenas 30 centavos, enquanto uma derrota custa os 70 centavos inteiros. Esse retorno assimétrico só funciona se os favoritos vencerem tão frequentemente quanto o preço de mercado implica. Na prática, não venceram, e quanto mais favorito, maior a lacuna.
Três Regras para Evitá-la
- Mantenha o preço de mercado fora da previsão. Faça o agente chegar à sua própria probabilidade a partir de dados brutos antes de ver a linha.
- Codifique o método, não suas conclusões. Um arcabouço que diz ao agente o que pensar apenas repassa seu próprio viés, mais rápido.
- Aposte em um favorito apenas quando a probabilidade do agente for claramente maior que o preço de mercado. Se o mercado diz 70 e o agente diz 70, é melhor passar.
O artigo também discute como os desenvolvedores inadvertidamente injetam esse viés nos arcabouços dos agentes e como a equipe o detectou nos traços de raciocínio antes que o lucro/prejuízo fosse afetado.
📖 Leia a fonte completa: r/clawdbot
👀 See Also

Líder Sênior de IA do Governo Desconhece LLMs Locais: Relato de um Desenvolvedor
Um desenvolvedor de LLM local relata que um líder sênior de IA do governo não sabia por que empresas escolheriam LLMs locais em vez de APIs em nuvem, apesar de entender os conceitos técnicos básicos.

A Cerebras lança os modelos Step-3.5-Flash-REAP com redução de 40% no uso de memória.
A Cerebras lançou os modelos Step-3.5-Flash-REAP que utilizam REAP (Router-weighted Expert Activation Pruning) para comprimir modelos de 196B parâmetros para 121B mantendo desempenho quase idêntico. Os modelos funcionam com vLLM padrão e são otimizados para ambientes com recursos limitados.

A quantização Q8_0 do llama.cpp obtém uma aceleração de 3,1x em GPUs Intel Arc com a correção de reordenação SYCL.
Uma correção no backend SYCL do llama.cpp leva a quantização Q8_0 em GPUs Intel Arc de 21% para 66% da largura de banda teórica de memória, alcançando 15,24 tokens/segundo contra 4,88 tokens/segundo anteriormente em uma Arc Pro B70 com Qwen3.5-27B.
Claude Code v2.1.268: corrige HTTP 400 em endpoints de terceiros, travamentos do WebFetch e vazamentos de segredos
Claude Code v2.1.268 corrige o HTTP 400 que quebrava todas as interações em endpoints ANTHROPIC_BASE_URL desde a 2.1.265, adiciona um prazo de 300s para o WebFetch e impede que erros de plugin e MCP vazem tokens.