SWE-rebench-V2 Lançado: Maior Conjunto de Dados Multilíngue Aberto para Treinamento de Agentes de Código

✍️ OpenClawRadar📅 Publicado: March 7, 2026🔗 Source
SWE-rebench-V2 Lançado: Maior Conjunto de Dados Multilíngue Aberto para Treinamento de Agentes de Código
Ad

Detalhes do Lançamento do SWE-rebench-V2

A equipe de P&D da Nebius, liderada por Ibragim, publicou o SWE-rebench-V2, que eles descrevem como "atualmente o maior conjunto de dados aberto do mundo para treinar agentes de codificação". O conjunto de dados é multilíngue e executável, projetado especificamente para treinamento de aprendizado por reforço em grande escala.

Principais Características Técnicas

A equipe construiu um pipeline automatizado para extrair ambientes de RL em escala. Este lançamento inclui:

  • O conjunto de dados completo SWE-rebench-V2
  • Um relatório técnico detalhado
  • Artigo e conjunto de dados disponíveis em: https://huggingface.co/papers/2602.23866
Ad

Comunidade e Suporte

A equipe mantém suporte ativo no Discord tanto para o conjunto de dados quanto para sua Tabela de Classificação SWE-rebench em: https://discord.gg/wXYmWpMu. Eles observam que a comunidade LocalLLaMA forneceu "o feedback mais valioso" para seu trabalho com a Tabela de Classificação SWE-rebench e confirmam que continuam trabalhando na tabela de classificação com planos para "torná-la ainda mais legal".

Para colaborações de pesquisa ou perguntas, Ibragim pode ser contatado por DM no Reddit ou Twitter (X) em: https://x.com/ibragim_bad.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also