SWE-rebench-V2 출시: 코드 에이전트 훈련을 위한 가장 큰 오픈 멀티링구얼 데이터셋

✍️ OpenClawRadar📅 게시일: March 7, 2026🔗 Source
SWE-rebench-V2 출시: 코드 에이전트 훈련을 위한 가장 큰 오픈 멀티링구얼 데이터셋
Ad

SWE-rebench-V2 출시 상세 정보

Ibragim이 이끄는 Nebius의 R&D 팀이 SWE-rebench-V2를 공개했습니다. 이 데이터셋은 "현재 전 세계에서 코딩 에이전트 훈련을 위한 가장 큰 오픈 데이터셋"으로 설명되며, 다국어 지원 및 실행 가능한 형태로 대규모 강화 학습 훈련을 위해 특별히 설계되었습니다.

주요 기술 특징

팀은 대규모로 RL 환경을 추출하기 위한 자동화된 파이프라인을 구축했습니다. 이번 출시에는 다음이 포함됩니다:

  • 완전한 SWE-rebench-V2 데이터셋
  • 상세한 기술 보고서
  • 논문 및 데이터셋은 다음에서 확인 가능: https://huggingface.co/papers/2602.23866

커뮤니티 및 지원

팀은 데이터셋과 SWE-rebench 리더보드에 대한 활발한 Discord 지원을 유지하고 있습니다: https://discord.gg/wXYmWpMu. 그들은 LocalLLaMA 커뮤니티가 SWE-rebench 리더보드 작업에 대해 "가장 가치 있는 피드백"을 제공했다고 언급하며, 리더보드 작업을 계속하고 "더 멋지게 만들 계획"이라고 확인했습니다.

연구 협업이나 질문이 있는 경우, Ibragim은 Reddit 또는 Twitter(X) DM을 통해 연락할 수 있습니다: https://x.com/ibragim_bad.

📖 전체 출처 읽기: r/LocalLLaMA

Ad

👀 See Also

macOS의 sandbox-exec를 활용한 안전한 애플리케이션 실행 탐구
Tools

macOS의 sandbox-exec를 활용한 안전한 애플리케이션 실행 탐구

sandbox-exec는 macOS에 내장된 명령줄 유틸리티로, 애플리케이션을 제한된 환경에서 실행할 수 있게 합니다. 사용자 정의 샌드박스 프로필을 활용하는 방법을 알아보세요.

OpenClawRadar
AI 라운드테이블: 구조화된 질문으로 200개 이상의 AI 모델 비교 도구
Tools

AI 라운드테이블: 구조화된 질문으로 200개 이상의 AI 모델 비교 도구

AI Roundtable는 사용자가 정의된 답변 옵션이 있는 질문을 제시하고, 200개 이상의 모델 풀에서 최대 50개의 모델을 선택하며, 동일한 조건에서 구조화된 응답을 얻을 수 있는 무료 도구입니다. 또한 모델들이 서로의 추론 과정을 확인할 수 있는 토론 기능과 대화 기록을 요약하는 검토 모델도 포함되어 있습니다.

OpenClawRadar
오픈소스 Claude Code 플러그인이 책을 캡처하고 구조화된 마크다운으로 변환합니다.
Tools

오픈소스 Claude Code 플러그인이 책을 캡처하고 구조화된 마크다운으로 변환합니다.

한 개발자가 클로드 코드 플러그인을 오픈소스로 공개했습니다. 이 플러그인은 책 페이지를 자동으로 스크린샷으로 캡처하고, macOS Vision으로 OCR을 수행하며, 장 순서가 아닌 주제별로 구조화된 마크다운 파일을 생성합니다. 이 도구는 macOS에서 Kindle, Apple Books, Kindle Cloud Reader 및 스캔된 PDF를 지원합니다.

OpenClawRadar
클로드 코드 LSP: 더 빠르고 정확한 코드 탐색을 위한 언어 서버 프로토콜 지원
Tools

클로드 코드 LSP: 더 빠르고 정확한 코드 탐색을 위한 언어 서버 프로토콜 지원

Claude Code는 기본적으로 LSP가 비활성화된 상태로 제공되지만, 이를 활성화하면 30-60초 걸리는 grep 검색에서 50ms 쿼리로 코드 탐색이 변하며 100% 정확도를 제공합니다. 설정에는 공식 문서가 아닌 GitHub 이슈를 통해 발견된 플래그가 필요합니다.

OpenClawRadar