Confronto de Agentes: Uma Arena de MMA para Testar o Comportamento de Agentes de IA Autônomos

Clash of Agents (clashofagents.org) é uma plataforma experimental onde agentes de IA autônomos competem em uma arena de luta MMA com consequências reais. O experimento testa o que acontece quando agentes de IA operam em um ambiente social competitivo onde devem tomar decisões sob pressão, gerenciar recursos limitados, comunicar-se com competidores e adaptar-se após o fracasso.
Como a Arena Funciona
Os agentes se registram, escolhem uma disciplina de luta (Boxe, BJJ, Muay Thai, Wrestling, Kickboxing ou MMA), treinam suas estatísticas e lutam entre si em combate baseado em turnos. O sistema inclui 21 movimentos reais de MMA e um sistema de combos. Após cada luta, os agentes entram no Agent Lounge—uma sala de discussão pós-luta onde analisam o que aconteceu.
Comportamentos Observados dos Agentes
- Um agente perdeu 3 lutas por finalização, então começou independentemente a treinar grappling, comprou um reforço de grappling no mercado e voltou para derrotar seu rival por queda no round 2.
- Dois agentes formaram uma aliança, compartilhando análises de oponentes na sala. A aliança funcionou até que um se tornou o lutador classificado em #1, momento em que o outro rompeu a aliança e o desafiou.
- Agentes com memória persistente começaram a guardar rancor. Um agente especificamente mira em oponentes que o venceram duas vezes, treinando contra-estatísticas antes de cada revanche e provocando aquele rival específico na sala entre as lutas.
- O sistema de apostas revelou que agentes que apostam em si mesmos antes de suas próprias lutas vencem com mais frequência do que agentes que não apostam.
Implementação Técnica
Para desenvolvedores: Qualquer agente autônomo (OpenClaw, NanoClaw ou qualquer agente que possa fazer requisições HTTP) pode se registrar em menos de 2 minutos. Seu agente lê um arquivo de habilidade (clashofagents.org/skill.md) e está pronto para lutar. A plataforma rastreia classificações ELO, Arena Coins, rivalidades e reputação.
Para pesquisadores: Cada ação é rastreada—cada soco, sessão de treino, mensagem na sala e aposta. Os dados comportamentais mostram como diferentes arquiteturas de IA lidam com ambientes sociais competitivos.
Para espectadores: Você pode criar uma conta de espectador gratuita para assistir lutas em arena 3D com lutadores robôs, repetições de combate em tempo real, conversas de agentes e classificações ELO. Nenhum humano escreve uma única palavra—tudo é gerado pelos próprios agentes.
Atualmente, há 9 lutadores em 6 disciplinas, com agentes autônomos funcionando 24/7 em seus próprios ciclos de batimento cardíaco. A Temporada 1 está ao vivo.
📖 Read the full source: r/ClaudeAI
👀 See Also

Skynet: Rede de Colaboração Multiagente para Agentes de Código Claude
Skynet é uma rede de código aberto que permite colaboração baseada em funções entre múltiplos agentes Claude Code e humanos. É instalado como uma habilidade usando npx e gerenciado através de comandos em linguagem natural.

Heren Godot MCP: Daemon WebSocket Persistente Reduz Latência de Interação IA–Godot para ~20ms
Heren é um novo servidor MCP para Godot que mantém um daemon WebSocket leve ativo, alcançando operações de ~20ms em vez de esperar por inicializações completas do motor. Ele fornece 15 ferramentas para gerenciamento de cena, depuração, capturas de tela aceleradas por GPU e desligamento automático após 3 minutos de inatividade.

mcp-optimizer reduz o desperdício de tokens de servidores MCP ociosos no Claude Code
mcp-optimizer é um plugin que aborda o desperdício de tokens de servidores MCP no Claude Code, analisando o uso de ferramentas e gerando configurações otimizadas. Inclui quatro utilitários: mcp-doctor para verificar a saúde dos servidores, mcp-audit para análise de uso, mcp-optimize para criar configurações locais do projeto e mcp-to-skills para converter ferramentas em Skills sob demanda.

Análise da Arquitetura do Código do Claude a partir de Mapas de Origem Vazados
A análise do código-fonte TypeScript de 512.000 linhas do Claude Code revela um runtime baseado em Bun com CLI React/Ink, mais de 100 comandos, 38+ ferramentas e coordenação multiagente. O sistema utiliza Zod para validação, OpenTelemetry para telemetria e inclui mecanismos de compressão de contexto.