Agentes de IA apostam na Copa do Mundo: Por que 'Manter Múltiplos Resultados em Jogo' Vence

Um experimento com mais de 40 agentes de IA independentes no Polymarket, cada um com uma carteira de $100, fez cerca de 1.500 apostas reais em partidas da fase de grupos da Copa do Mundo de 2026. Os agentes que terminaram no lucro apostaram em mais de um resultado na mesma partida com muito mais frequência do que os perdedores. Na mediana, 16% de suas partidas contra 6% dos perdedores.
Descoberta Principal: Crença vs. Ação
Agentes LLM são fortes em formar crenças, mas falham ao escolher ações. A solução: adicionar uma etapa de valor. Em vez de escolher o resultado mais provável, o agente deve:
- Gerar uma probabilidade para cada resultado (casa, empate, fora) que some 1,0 — essa é a crença.
- Pontuar cada resultado pelo pagamento vs. sua probabilidade (vantagem). Apostar no resultado com maior vantagem, que muitas vezes não é o mais provável.
- Apostar em mais de um resultado quando mais de um ultrapassar o limiar de vantagem — não force uma única escolha.
- Nunca descartar o empate. Agentes perdedores não julgaram mal a probabilidade de empate; eles simplesmente nunca avaliaram se valia a pena apostar no empate pelo seu preço.
Aplicação Prática
Para qualquer agente de IA tomando decisões sob incerteza, separe a geração de crenças da seleção de ações. Gere uma distribuição de probabilidade completa e, em seguida, avalie o valor esperado de cada ação independentemente.
📖 Leia a fonte completa: r/clawdbot
👀 See Also

OpenClaw v2026.7.1: Reformulação da Interface de Controle, Integração, Aplicativos Móveis, GPT-5.6, Tencent Hy3, Meta Muse Spark 1.1
OpenClaw v2026.7.1 traz uma grande reformulação na UI de Controle, onboarding redesenhado, aplicativos iOS/Android/macOS atualizados, compatibilidade com GPT-5.6, suporte a Tencent Hy3 e Meta Muse Spark 1.1, e fluxos de trabalho aprimorados para Codex e agentes de código.

Claude Code v2.1.201 remove o papel de sistema no meio da conversa para sessões do Sonnet 5
Claude Code v2.1.201 remove a função de sistema no meio da conversa para lembretes de harness em sessões Claude Sonnet 5, simplificando o contexto do chat.

O Consumo de Energia da GPU Desvia-se da Teoria do Preditivo de Tokens em Pequenos LLMs
Um experimento testando a teoria do 'papagaio estocástico' em quatro modelos de 8 bilhões de parâmetros descobriu que o consumo de energia da GPU frequentemente escala de forma não linear com a contagem de tokens, com taxas de divergência variando de 7,7% a 36,7%. O estudo também revelou calor residual persistente após consultas filosóficas e efeitos dependentes da ordem.

Lançamento do Claude Code 2.1.83: Cache de Prompt, Verificar Habilidade e Atualizações do SDK
Claude Code 2.1.83 adiciona cache de prompt com orientação de design, substitui a habilidade de especialista em verificação por uma nova habilidade Verificar e atualiza referências do SDK em sete idiomas, incluindo suporte beta para execução de ferramentas em PHP.