Qwen3.5-122B-A10B-MINT-MLX는 64GB RAM이 탑재된 M5 Pro에서 원활하게 실행됩니다.

✍️ OpenClawRadar📅 게시일: April 20, 2026🔗 Source
Qwen3.5-122B-A10B-MINT-MLX는 64GB RAM이 탑재된 M5 Pro에서 원활하게 실행됩니다.
Ad

애플 실리콘에서의 로컬 LLM 성능

레딧 사용자가 M5 Pro(64GB RAM)에서 Qwen3.5-122B-A10B-MINT-MLX 모델을 로컬로 실행한 경험을 공유했습니다. 이 설정은 적절한 구성으로 대규모 언어 모델이 소비자용 하드웨어에서 효과적으로 실행될 수 있음을 보여줍니다.

구성 세부사항

사용자는 VRAM 할당을 위한 특정 터미널 명령어를 사용하여 원활한 성능을 달성했습니다:

sysctl iogpu.unified_memory_limit_percentage
sudo sysctl iogpu.wired_limit_mb=61440

LM Studio에서 컨텍스트 창을 16384 토큰으로 설정했습니다. 이 구성으로 시스템은 Safari(여러 탭), 메시지, 활동 모니터를 동시에 실행하면서도 안정적인 성능을 유지했습니다.

성능 벤치마크

Qwen3.5-122B-A10B-MINT-MLX 모델의 성능은 다음과 같습니다:

  • 첫 토큰까지의 시간: 0.86초
  • 토큰 생성 속도: 39.58 토큰/초

사용자는 이 모델이 "여러 수수께끼를 정확히 풀고 약간의 바이브 코딩을 수행했다"고 언급하며, 3비트 MINT 양자화에 대한 불만은 없었습니다. 유일한 문제는 컨텍스트 창이 가득 차 VRAM 사용량이 59GB에 가까워졌을 때 시스템이 멈춘 경우였습니다.

다른 모델과의 비교

사용자는 "Qwen3.5 40B Claude 4.6 Opus Deckard Heretic Uncensored Thinking Mxfp8" 모델도 테스트했는데, 122B 모델보다 정확도는 높지만 속도는 훨씬 느렸습니다:

  • 토큰 생성 속도: 6.93 토큰/초
  • 생성 속도는 느렸지만 프롬프트 처리 속도는 여전히 빨랐습니다

이는 개발자가 로컬 LLM 구성을 선택할 때 모델 크기, 양자화, 추론 속도 사이에서 고려해야 하는 절충점을 보여줍니다.

📖 전체 원문 읽기: r/LocalLLaMA

Ad

👀 See Also

간편한 배포: Open Claw를 위한 새로운 원클릭 AWS 설정 출시
News

간편한 배포: Open Claw를 위한 새로운 원클릭 AWS 설정 출시

Open Claw 애호가들이 이제 기뻐할 이유가 생겼습니다. 새로운 원클릭 AWS 배포 도구가 Open Claw의 설정 과정을 단순화하여 개발자와 취미 개발자 모두에게 더욱 접근하기 쉬워졌습니다.

OpenClawRadar
Claude Code v2.1.169: 안전 모드, /cd 명령어 및 수십 개의 버그 수정
News

Claude Code v2.1.169: 안전 모드, /cd 명령어 및 수십 개의 버그 수정

v2.1.169는 모든 커스터마이징을 비활성화하는 --safe-mode를 추가하여 문제 해결을 돕고, /cd 명령어로 세션 중간에 디렉토리를 전환해도 캐시가 손실되지 않으며, 약 30-50ms UI 지연, Windows 클립보드 멈춤, 엔터프라이즈 MCP 정책 적용 문제를 수정했습니다.

OpenClawRadar
OneUptime이 단일 커밋으로 12,000개의 AI 생성 블로그 게시물을 추가합니다
News

OneUptime이 단일 커밋으로 12,000개의 AI 생성 블로그 게시물을 추가합니다

OneUptime의 블로그 저장소가 단일 커밋으로 ClickHouse, Redis, MongoDB, MySQL 및 기타 기술을 다루는 12,000개의 AI 생성 게시물을 추가했으며, 5,012개의 파일과 100만 줄 이상의 코드를 변경했습니다.

OpenClawRadar
onWatch로 다양한 제공업체 간 API 모니터링을 혁신하세요
News

onWatch로 다양한 제공업체 간 API 모니터링을 혁신하세요

강력한 새로운 도구인 onWatch가 여러 제공업체에 걸친 AI API 할당량 사용량 추적을 어떻게 간소화하여 한도 내에서 유지하고 자원 할당을 최적화하는지 알아보세요.

OpenClawRadar