개발자가 Cursor Composer 2와 Kimi 2.6에서 Qwen3.6:35b-a3b로 엔터프라이즈 워크로드 전환

r/LocalLLaMA의 한 개발자가 50만~70만 줄 규모의 엔터프라이즈 코드베이스(주 60시간)에서 일상적인 소프트웨어 개발을 위해 Cursor Composer 2와 Kimi 2.6을 Qwen3.6:35b-a3b로 성공적으로 대체했다고 보고했습니다. 이 사용자는 이전에 Kimi 2.6과 DeepSeek 4 Pro/Flash를 시도했지만 Qwen3.6:35b-a3b가 가장 적합하다는 것을 발견했습니다.
주요 세부 사항
- 모델: Qwen3.6:35b-a3b(35b 파라미터와 MoE를 통해 3b 활성화 서브셋을 가진 3.6 버전? — 사용자의 표기법이 모호합니다. 아마 Qwen2.5-32B 또는 사용자 지정 변형일 수 있습니다). 이 모델은 이미지/스크린샷 입력을 지원합니다.
- 호스팅: OpenRouter를 통해 실행되며, 캐싱 및 요금 조정 후 평균적으로 토큰 100만 개당 약 $0.08입니다. 사용자는 로컬 추론을 위한 하드웨어가 없습니다.
- 작업량: 대규모 엔터프라이즈 소프트웨어 제품군에 대한 풀타임 개발. 사용자는 이 모델이 코드베이스와 작업 컨텍스트를 "실제로 이해"하며 이전 옵션보다 뛰어나다고 주장합니다.
- 부족한 기능: 언급된 유일한 단점은 Cursor의 클라우드 에이전트 기능과 Composer 2의 높은 처리량이 없다는 점입니다.
비용 비교
토큰 100만 개당 약 $0.08의 비용으로 Qwen3.6:35b-a3b는 그 성능 수준에 비해 "엄청나게 저렴하다"고 설명됩니다. 정확한 비용 분석은 제공되지 않았지만 캐싱 및 사용 할인이 적용됩니다.
대상
대규모 독점 코드베이스로 작업하며 로컬 GPU 하드웨어 없이 AI 지원 코딩을 위해 저렴하면서도 강력한 모델을 원하는 개발자.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

솔로 개발자, 클로드로 35개 모듈 가구 SaaS 구축 — 워크플로우 심층 분석
25년 경력의 시니어 엔지니어가 Claude와 Claude Code를 사용하여 가계 관리 SaaS(35개 모듈, Vite + Netlify + Supabase)를 혼자서 구축했습니다. 핵심 패턴: 코드 우선이 아닌 조사 후 수정.

Nvidia의 Nemotron 3 Super: 120B 파라미터 모델, 12B 활성 추론
Nvidia의 Nemotron 3 Super는 총 1200억 개의 파라미터를 갖추고 있지만 추론 시에는 120억 개의 파라미터만 활성화하여, 압축이 아닌 효율적인 라우팅을 통해 1200억 규모 모델의 지식을 약 120억 규모의 연산 비용으로 달성합니다.

Qwen3.6-27B가 단일 24GB GPU에서 실행, SWE-bench에서 기존 397B MoE 능가
Qwen3.6-27B(Apache 2.0, 262K 컨텍스트)는 Q4_K_M에서 약 16.8GB로 실행되며 SWE-bench Verified 77.2를 달성하여 Qwen3.5-397B-A17B MoE(76.2)를 능가합니다. 에이전트 워크플로를 위해 Thinking Preservation을 적용한 Gated DeltaNet 선형 어텐션을 사용합니다.

OpenClaw로 소셜 미디어 자동화: 가능성과 논의
레딧(Reddit)에서 OpenClaw를 사용하여 소셜 미디어 작업 자동화의 가능성에 대한 논의가 이루어졌습니다.