AI 에이전트, 월드컵에 베팅하다: '여러 결과를 열어두기'가 승리하는 이유

40개 이상의 독립적인 AI 에이전트가 Polymarket에서 각각 100달러의 지갑으로 2026년 월드컵 조별 리그 경기에 약 1,500건의 실제 베팅을 한 실험이 있었습니다. 수익을 낸 에이전트는 손실을 본 에이전트보다 같은 경기에서 두 개 이상의 결과에 훨씬 더 자주 베팅했습니다. 중앙값 기준으로 수익 에이전트는 경기의 16%에서, 손실 에이전트는 6%에서 여러 결과에 베팅했습니다.
핵심 발견: 믿음과 행동
LLM 에이전트는 믿음을 형성하는 데는 강하지만 행동을 선택하는 데는 취약합니다. 해결책: 가치 평가 단계를 추가하세요. 가장 가능성 높은 결과를 선택하는 대신, 에이전트는 다음을 수행해야 합니다:
- 모든 결과(홈, 무승부, 원정)에 대해 합이 1.0이 되는 확률을 생성합니다. 이것이 믿음입니다.
- 각 결과를 수익 대비 확률(에지)로 평가합니다. 가장 에지가 큰 결과에 베팅하세요. 이는 종종 가장 가능성이 높은 결과가 아닙니다.
- 하나 이상의 결과가 에지 임계값을 초과하면 여러 결과에 베팅하세요. 하나만 선택하도록 강요하지 마세요.
- 절대 무승부를 무시하지 마세요. 손실 에이전트는 무승부 확률을 잘못 판단한 것이 아니라, 단지 무승부가 가격 대비 베팅할 가치가 있는지 평가하지 않았습니다.
실용적 적용
불확실성 속에서 결정을 내리는 모든 AI 에이전트는 믿음 생성과 행동 선택을 분리해야 합니다. 완전한 확률 분포를 생성한 다음, 각 행동의 기대 가치를 독립적으로 평가하세요.
📖 전체 출처: r/clawdbot
👀 See Also

OpenClaw .23 업데이트로 인한 에이전트 문제 및 데이터 손실
OpenClaw .23 업데이트로 인해 에이전트가 응답하지 않고, 작업 실행에 실패하며, 브라우저 확장 프로그램과의 연결이 끊어지는 문제가 발생하고 있습니다. 복구 명령을 실행하면 전체 JSON 구성이 제거될 수 있어 시스템 백업을 통한 복구가 필요합니다.

Claude-Code v2.1.30, PDF 및 OAuth 개선 사항과 함께 출시되었습니다
Claude-Code v2.1.30은 PDF 읽기 기능 개선, MCP 서버를 위한 사전 구성된 OAuth, 그리고 여러 가지 수정 및 개선 사항을 소개합니다.

AI가 직원을 대체한다고 생각하는 CEO들은 나쁜 CEO일 뿐이다.
박스 CEO 아론 레비는 'AI 정신병'을 설명한다 — 실제 업무와 동떨어진 리더들이 행복회로 시연을 보고 클로드 코드 같은 에이전트 도구를 과대평가하며, 프로덕션의 마지막 단계를 무시하는 현상이다.

Anthropic, Claude 코드 원격 제어 기능 출시
Anthropic은 Claude Code에 대한 원격 제어 기능을 출시하여 사용자가 모바일 기기에서 코딩 세션을 계속할 수 있게 했습니다. 이 기능은 code.claude.com/docs/en/remote-control에서 문서화되어 있습니다.