개발자가 로컬 코딩 작업을 위해 Qwen3.5 27B와 더 큰 모델을 테스트합니다

✍️ OpenClawRadar📅 게시일: March 28, 2026🔗 Source
개발자가 로컬 코딩 작업을 위해 Qwen3.5 27B와 더 큰 모델을 테스트합니다
Ad

한 개발자가 로컬 코딩 작업을 위해 여러 대규모 언어 모델을 테스트하며 성능과 하드웨어 요구 사항을 비교했습니다. 이 테스트는 Qwen3.5 변종과 Nemotron 모델에 초점을 맞추었으며, GPT-5.4 High와의 비교도 포함되었습니다.

테스트 결과 및 발견 사항

개발자가 테스트한 구체적인 모델은 다음과 같습니다:

  • unsloth/Qwen3.5-27B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-122B-A10B-GGUF
  • unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL
  • unsloth/Qwen3.5-27B-GGUF:UD-Q8_K_XL
  • unsloth/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF:UD-IQ4_XS
  • unsloth/gpt-oss-120b-GGUF:F16

테스트에서 얻은 주요 발견 사항:

  • Nemotron-3-Super-120B는 GPT-5.4 High와 동등한 "매우, 매우 우수한" 성능을 보였습니다
  • Qwen3.5-27B는 개발 작업에 잘 수행되었습니다
  • GPT-OSS-120B와 Qwen3.5-122B는 다른 두 모델보다 성능이 떨어졌습니다
  • Nemotron-3-Super-120B는 일관되게 스페인어(테스터의 모국어)로 응답했으며, 다른 모델들은 영어로 응답했습니다

성능 지표

개발자가 제공한 구체적인 성능 수치:

  • Nemotron-3-Super-120B: 초당 80 토큰(tg/s), 약 2000 프롬프트 처리(pp), 4x RTX 3090으로 vast.ai에서 100k 컨텍스트
  • Qwen3.5-27B Q6: 803 pp, 25 tg/s, vast.ai에서 256k 컨텍스트
Ad

하드웨어 요구 사항

개발자가 언급한 하드웨어 제약 사항:

  • Qwen3.5-122B는 새 마더보드와 1-2개의 추가 RTX 3090 카드가 필요해 비용이 너무 비쌉니다
  • Qwen3.5-27B는 기존 2x RTX 3090 하드웨어에서 추가 투자 없이 실행됩니다
  • Nemotron-3-Super-120B를 위한 하드웨어가 있다면, 그 모델을 대신 사용할 것입니다

구현 세부 사항

개발자는 로컬에서 실제 개발 작업에 Qwen3.5-27B-GGUF:UD-Q6_K_XL을 사용할 계획이며, 테스트에 사용한 llama.cpp 명령어를 제공했습니다:

./llama.cpp/llama-server -hf unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL --ctx-size 262144 --temp 0.6 --top-p 0.95 --top-k 20 --min-p 0.00 -ngl 999

개발자는 복잡한 작업에는 CODEX를 계속 사용하겠지만, 일상 작업에 대한 API 구독을 로컬 설정으로 대체할 수 있다고 언급했습니다.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Claude AI 사용 제한을 위한 무료 macOS 메뉴 바 모니터
Tools

Claude AI 사용 제한을 위한 무료 macOS 메뉴 바 모니터

Claude AI의 세션 사용률, 주간 제한 및 초기화 카운트다운을 메뉴 바에 직접 표시하는 무료 오픈소스 macOS 도구입니다. 단일 Homebrew 명령어로 설치되며, 데이터를 저장하지 않고 기존 Chrome 세션을 활용합니다.

OpenClawRadar
Google의 HEIR 컴파일러: 동형 암호화를 통한 실용적인 프라이빗 AI
Tools

Google의 HEIR 컴파일러: 동형 암호화를 통한 실용적인 프라이빗 AI

Google이 HEIR(Homomorphic Encryption Intermediate Representation)를 오픈소스로 공개했습니다. HEIR은 개발자가 암호화된 데이터에서 AI 추론을 실행할 수 있게 해주는 컴파일러로, 사기 탐지, 추천 등 다양한 데모를 제공합니다.

OpenClawRadar
코드 결정: 오픈소스 클로드 플러그인이 기술적 결정을 포착합니다
Tools

코드 결정: 오픈소스 클로드 플러그인이 기술적 결정을 포착합니다

Code Decisions는 Claude Code용 오픈 소스 플러그인으로, 대화에서 기술적 결정 사항을 캡처하고 영향을 받는 파일이 편집될 때 이를 표면화합니다. 이 플러그인은 결정 사항을 .claude/decisions/에 마크다운 파일로 작성하며, 관리되는 파일을 가리키는 affects 필드를 포함합니다.

OpenClawRadar
프롬프트 캐싱 MCP 플러그인은 안정적인 컨텍스트를 식별하여 Claude API 비용을 자동으로 절감합니다.
Tools

프롬프트 캐싱 MCP 플러그인은 안정적인 컨텍스트를 식별하여 Claude API 비용을 자동으로 절감합니다.

프롬프트 캐싱 MCP 플러그인은 시스템 프롬프트와 도구 정의와 같은 안정적인 컨텍스트 부분을 자동으로 식별한 다음, Anthropic의 캐싱 기능을 위해 이를 표시하여 코딩 세션에서 API 비용을 80-92% 절감합니다.

OpenClawRadar