깃허브의 Spec-Kit과 클로드 코드를 2개월간 사용해 본 결과: 효과적인 점과 그렇지 않은 점

✍️ OpenClawRadar📅 게시일: May 15, 2026🔗 Source
깃허브의 Spec-Kit과 클로드 코드를 2개월간 사용해 본 결과: 효과적인 점과 그렇지 않은 점
Ad

r/LocalLLaMA의 한 개발자가 Claude Code를 주 에이전트로 GitHub의 spec-kit을 사용한 Spec-Driven Development(SDD) 2개월 후, 무엇이 잘 작동하고 무엇이 그렇지 않은지 보고합니다. github.com/github/spec-kit에서 제공되는 이 툴킷은 헌법, 명세, 계획, 작업, 구현의 5단계 워크플로우를 강제합니다. 핵심 아이디어: 프롬프트가 아닌 명세가 진실의 원천입니다.

실제로 좋은 점

  • 에이전트에 무관함: 동일한 명세가 Claude Code, Cursor, Codex, Gemini CLI, Copilot에서 작동합니다. 작성자는 Claude Code로 코드를 생성한 후, 원활하게 Cursor에 명세를 넘겨 테스트 리팩토링을 수행했습니다.
  • 단계 간 확실한 체크포인트: 계획 단계에서는 코드가 작성되기 전에 전체 제안된 아키텍처를 보여주어, 잘못된 결정을 5시간 대신 5분 수정 비용으로 잡아냅니다.
  • 품질 관문으로서의 헌법 파일: 테스트 커버리지 최소치, 의존성 허용 목록, 성능 예산, 타입 엄격성 등 불가침 규칙을 미리 정의합니다. 에이전트가 이를 위반하려고 하면 자체 검증에 실패합니다.
  • 향상된 결정론: 구현 단계를 다시 실행하면 원시 프롬프팅보다 더 일관된 출력을 생성합니다. 에이전트가 30가지의 암묵적인 결정을 채울 필요가 없기 때문입니다.
Ad

짜증나는 점

  • 드리프트는 현실: 명세를 업데이트하지 않고 수동으로 코드를 수정하면 빠르게 불일치가 발생합니다. spec-kit에 도구가 있지만 초기 단계입니다.
  • 작은 변경에 대한 오버헤드: 50줄 미만의 버그 수정이나 간단한 기능은 형식적입니다. 작성자의 규칙: 200줄 이상을 다루는 새 모듈이나 기능에만 전체 SDD를 사용합니다.
  • 레거시 마이그레이션은 고통스러움: 3만 줄 코드베이스에 SDD를 적용하려면 몇 달이 걸립니다.
  • 품질은 에이전트에 달림: Claude Code(Sonnet/Opus 4.6+)는 잘 처리하지만, 작은 모델은 컴파일은 되지만 아키텍처 추론이 부족한 계획을 생성합니다.

실용적 설정

  • 설치: uv tool install --from git+https://github.com/github/spec-kit.git specify-cli. 공식 저장소만 안전합니다. PyPI에는 타이포스쿼터가 있습니다.
  • 주 에이전트: Claude Code, Cursor 및 Gemini CLI로 교차 검증.
  • 로컬 지속성: SQLite(명세/검증이 쉽고 클라우드 의존성 없음).
  • 재사용 가능한 헌법 템플릿: 엄격한 타입, pytest 커버리지 80% 이상, 명시적 의존성 허용 목록, 필수가 아닌 한 클라우드 서비스 없음.

미해결 질문

  • 로컬 모델(Qwen, DeepSeek-Coder, GLM, Llama)이 계획 및 구현을 유능하게 처리할 수 있을까? 작성자는 작은 모델이 형식은 따르지만 아키텍처 추론에 실패한다고 밝혔습니다.
  • 다중 에이전트 SDD가 작동할까? 한 모델이 명세를, 다른 모델이 구현을, 세 번째 모델이 감사를 수행하는 방식이 이론적으로는 더 낫지만, 실제로 단일 에이전트보다 측정 가능하게 더 낫지는 않습니다.

📖 전체 소스 읽기: r/LocalLLaMA

Ad

👀 See Also

TypeScript 프로젝트용 MCP 서버, Claude Code의 Grep 패턴을 인덱싱된 심볼 조회로 대체
Tools

TypeScript 프로젝트용 MCP 서버, Claude Code의 Grep 패턴을 인덱싱된 심볼 조회로 대체

한 개발자가 TypeScript 프로젝트에서 Claude Code의 grep-and-guess 패턴을 인덱싱된 심볼 조회로 대체하는 MCP 서버를 구축했습니다. 이 도구는 심볼, 호출 위치, 임포트, 클래스 계층 구조의 실시간 SQLite 인덱스를 유지하여 테스트에서 토큰 사용량을 63-79% 줄였습니다.

OpenClawRadar
클로드 코드를 위한 다중 에이전트 아키텍처 기반 연구팀 인어박스 프레임워크
Tools

클로드 코드를 위한 다중 에이전트 아키텍처 기반 연구팀 인어박스 프레임워크

한 개발자가 Claude Code용 다중 에이전트 연구 프레임워크를 만들어 Opus 4.6을 활용해 전문 에이전트들을 조율합니다. 이 프레임워크는 research-clab이라는 플러그인을 사용하며, 안내된 질의응답 과정을 통해 전개되고 11가지 기술, 에이전트 정의, 복잡한 연구 프로젝트 관리를 위한 구조화된 디렉터리를 포함합니다.

OpenClawRadar
Claude Code가 ToolSearch를 통해 도구 스키마를 지연 로딩하여 토큰을 절약합니다
Tools

Claude Code가 ToolSearch를 통해 도구 스키마를 지연 로딩하여 토큰을 절약합니다

Claude Code는 도구 스키마를 미리 로드하지 않고, 도구 이름만 먼저 전송한 후 사용 전에 ToolSearch 호출을 통해 스키마를 가져오도록 합니다. 이 아키텍처는 토큰 소모를 크게 줄여줍니다.

OpenClawRadar
마인드 프로토콜: 오픈소스 시스템으로 클로드에 지속적 메모리와 실시간 생체 인식 통합 제공
Tools

마인드 프로토콜: 오픈소스 시스템으로 클로드에 지속적 메모리와 실시간 생체 인식 통합 제공

Mind Protocol은 Claude가 자율적인 동반자로 지속적으로 실행되는 오픈소스 시스템입니다. 이 시스템은 모든 세션에 걸쳐 지속적인 메모리를 제공하며, 패턴, 선호도, 기록에 대한 수개월간 누적된 컨텍스트를 Claude에 제공합니다. 또한 모든 대화에 실시간 Garmin 워치 데이터(심박수, HRV, 스트레스, 수면 지표, 체력 배터리 수치 등)를 주입합니다.

OpenClawRadar