코드셋은 깃 히스토리에서 저장소별 컨텍스트를 활용하여 코딩 에이전트를 향상시킵니다.

Codeset의 기능
Codeset는 git 기록을 파이프라인으로 처리하여 리포지토리에 직접 저장되는 파일을 생성합니다. 이 파일에는 파일별 과거 버그와 근본 원인, 알려진 함정, 공동 변경 관계, 테스트 체크리스트가 포함됩니다. 코딩 에이전트는 일반적인 컨텍스트 윈도우의 일부로 이러한 파일을 읽습니다. RAG나 벡터 데이터베이스가 쿼리 시 필요하지 않으며, 런타임 인프라도 필요 없습니다. 단지 정적 파일로, 에이전트가 리포의 다른 파일처럼 읽어들입니다.
벤치마크 결과
팀은 두 가지 벤치마크로 Codeset를 테스트했습니다:
- codeset-gym-python (150개 작업, Claude 평가와 동일한 부분집합): 60.7% → 66% (+5.3% 포인트)
- SWE-Bench Pro (무작위 샘플링된 400개 작업): 56.5% → 58.5% (+2% 포인트)
이는 두 벤치마크 모두에서 일관된 개선을 보여주며, codeset-gym에 비해 SWE-Bench Pro에서는 더 작은 향상을 보였습니다. codeset-gym 벤치마크는 공개되어 있으며, 전체 작업 목록과 검증 도구가 방법론 검증에 사용 가능합니다.
가격 및 이용 가능성
Codeset는 리포지토리당 $5의 일회성 결제입니다. 무료 체험을 위해 CODESETLAUNCH 코드를 사용하세요. 전체 평가 아티팩트는 https://github.com/codeset-ai/codeset-release-evals에서 확인할 수 있습니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

옵티오: 티켓에서 PR까지 쿠버네티스에서 AI 코딩 에이전트 오케스트레이션하기
Optio는 Claude Code나 Codex와 같은 AI 코딩 에이전트를 사용하여 티켓을 병합된 풀 리퀘스트로 전환하는 오픈소스 오케스트레이션 시스템입니다. CI 실패나 리뷰 피드백 시 에이전트를 자동으로 재개하는 피드백 루프를 통해 격리된 Kubernetes 파드에서 전체 라이프사이클을 처리합니다.

클로드 코드 플랜 모드로 재작업률을 40%에서 거의 0%로 줄입니다
한 개발자가 Claude Code로 30개 이상의 코딩 세션을 추적한 결과, 계획 모드를 건너뛰면 40%의 경우 작업을 처음부터 다시 해야 했습니다. 계획 모드를 사용하면 재작업률이 거의 제로로 떨어졌으며, 한 기능은 계획 없이 35분 이상 걸리던 것을 계획 후 17분 만에 완료했습니다.

오픈 소스 클로드 코드 기술로 개인화된 소셜 미디어 콘텐츠 만들기
한 개발자가 클로드가 소셜 미디어 콘텐츠를 작성할 때 사용자의 진정한 목소리처럼 들리도록 돕는 13개의 클로드 코드 스킬을 오픈소스로 공개했습니다. 이 스킬에는 LinkedIn, Twitter/X, Threads, Bluesky를 위한 컨텍스트 정의, 전략, 생성, 분석 도구가 포함되어 있습니다.

Godmode 플러그인, Claude Code 및 기타 AI 코딩 에이전트에 자율 반복 루프 기능 추가
Godmode는 Claude Code에 자율적인 측정-수정-검증 루프를 추가하는 오픈소스 플러그인으로, 병렬 에이전트, 실패 메모리, 최적화, 보안 감사, TDD를 포함한 126가지 기능을 제공합니다. Cursor, Codex, Gemini CLI, OpenCode와 호환됩니다.