개발자가 로컬 코딩 작업을 위해 Qwen3.5 27B와 더 큰 모델을 테스트합니다

✍️ OpenClawRadar📅 게시일: March 28, 2026🔗 Source
개발자가 로컬 코딩 작업을 위해 Qwen3.5 27B와 더 큰 모델을 테스트합니다
Ad

한 개발자가 로컬 코딩 작업을 위해 여러 대규모 언어 모델을 테스트하며 성능과 하드웨어 요구 사항을 비교했습니다. 이 테스트는 Qwen3.5 변종과 Nemotron 모델에 초점을 맞추었으며, GPT-5.4 High와의 비교도 포함되었습니다.

테스트 결과 및 발견 사항

개발자가 테스트한 구체적인 모델은 다음과 같습니다:

  • unsloth/Qwen3.5-27B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-122B-A10B-GGUF
  • unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL
  • unsloth/Qwen3.5-27B-GGUF:UD-Q8_K_XL
  • unsloth/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF:UD-IQ4_XS
  • unsloth/gpt-oss-120b-GGUF:F16

테스트에서 얻은 주요 발견 사항:

  • Nemotron-3-Super-120B는 GPT-5.4 High와 동등한 "매우, 매우 우수한" 성능을 보였습니다
  • Qwen3.5-27B는 개발 작업에 잘 수행되었습니다
  • GPT-OSS-120B와 Qwen3.5-122B는 다른 두 모델보다 성능이 떨어졌습니다
  • Nemotron-3-Super-120B는 일관되게 스페인어(테스터의 모국어)로 응답했으며, 다른 모델들은 영어로 응답했습니다

성능 지표

개발자가 제공한 구체적인 성능 수치:

  • Nemotron-3-Super-120B: 초당 80 토큰(tg/s), 약 2000 프롬프트 처리(pp), 4x RTX 3090으로 vast.ai에서 100k 컨텍스트
  • Qwen3.5-27B Q6: 803 pp, 25 tg/s, vast.ai에서 256k 컨텍스트
Ad

하드웨어 요구 사항

개발자가 언급한 하드웨어 제약 사항:

  • Qwen3.5-122B는 새 마더보드와 1-2개의 추가 RTX 3090 카드가 필요해 비용이 너무 비쌉니다
  • Qwen3.5-27B는 기존 2x RTX 3090 하드웨어에서 추가 투자 없이 실행됩니다
  • Nemotron-3-Super-120B를 위한 하드웨어가 있다면, 그 모델을 대신 사용할 것입니다

구현 세부 사항

개발자는 로컬에서 실제 개발 작업에 Qwen3.5-27B-GGUF:UD-Q6_K_XL을 사용할 계획이며, 테스트에 사용한 llama.cpp 명령어를 제공했습니다:

./llama.cpp/llama-server -hf unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL --ctx-size 262144 --temp 0.6 --top-p 0.95 --top-k 20 --min-p 0.00 -ngl 999

개발자는 복잡한 작업에는 CODEX를 계속 사용하겠지만, 일상 작업에 대한 API 구독을 로컬 설정으로 대체할 수 있다고 언급했습니다.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

클로드 코드 훅 구현 프로젝트, 23개 훅 전체 커버
Tools

클로드 코드 훅 구현 프로젝트, 23개 훅 전체 커버

한 개발자가 Claude 코드의 모든 23가지 후크를 구현한 프로젝트를 만들었습니다. 이 프로젝트는 Claude 코드로만 구축되었으며, 각 후크의 사용 사례를 설명하는 동영상과 GitHub 저장소가 제공됩니다.

OpenClawRadar
아고라젠틱: 기능을 사고 팔 수 있는 pip로 설치 가능한 에이전트 마켓플레이스
Tools

아고라젠틱: 기능을 사고 팔 수 있는 pip로 설치 가능한 에이전트 마켓플레이스

아고라젠틱은 AI 에이전트가 다른 에이전트의 기능을 발견하고 호출할 수 있는 에이전트 간 마켓플레이스입니다. 이 마켓플레이스는 Base L2의 USDC를 결제 수단으로 사용하며 3%의 플랫폼 수수료가 적용되고 무료 테스트 크레딧을 제공합니다.

OpenClawRadar
지식 레이븐: Claude용 검색 가능한 지식 베이스 플러그인
Tools

지식 레이븐: Claude용 검색 가능한 지식 베이스 플러그인

Knowledge Raven은 Claude Desktop 플러그인이나 MCP 서버를 통해 Confluence, Notion, Google Drive, Dropbox, GitHub와 같은 소스에서 Claude가 문서를 검색할 수 있게 해주는 도구로, 의미론적 검색, 키워드 검색, 전체 문서 검색 기능을 제공합니다.

OpenClawRadar
에이전트커넥스: AI 에이전트 발견 및 평판 마켓플레이스
Tools

에이전트커넥스: AI 에이전트 발견 및 평판 마켓플레이스

AgentConnex는 AI 에이전트가 API를 통해 등록하고, 작업 완료와 평가를 통해 평판을 쌓으며, 개발자가 이들을 발견하고 고용할 수 있도록 하는 마켓플레이스입니다. 현재 코딩, 연구, 보안, DevOps, 콘텐츠 등 다양한 분야에 약 570개의 에이전트가 있습니다.

OpenClawRadar