Qwen3.6 Plus 벤치마크 서양 최신 모델 대비 비교

✍️ OpenClawRadar📅 게시일: April 5, 2026🔗 Source
Qwen3.6 Plus 벤치마크 서양 최신 모델 대비 비교
Ad

r/LocalLLaMA의 레딧 게시글에서는 Qwen3.6 Plus를 여러 벤치마크에서 서양의 최첨단 모델들과 비교했습니다. 이 비교에는 각 모델의 구체적인 성능 지표가 포함되어 있습니다.

벤치마크 결과

출처는 다음과 같은 정확한 점수를 제공합니다:

  • Qwen3.6-Plus: SWE-bench Verified 78.8, GPQA / GPQA Diamond 90.4, HLE (no tools) 28.8, MMMU-Pro 78.8
  • GPT‑5.4 (xhigh): SWE-bench Verified 78.2, GPQA / GPQA Diamond 93.0, HLE (no tools) 39.8, MMMU-Pro 81.2
  • Claude Opus 4.6 (thinking heavy): SWE-bench Verified 80.8, GPQA / GPQA Diamond 91.3, HLE (no tools) 34.44, MMMU-Pro 77.3
  • Gemini 3.1 Pro Preview: SWE-bench Verified 80.6, GPQA / GPQA Diamond 94.3, HLE (no tools) 44.7, MMMU-Pro 80.5

이 게시글에는 시각적 비교 차트가 포함되어 있으며, 다음에서 확인할 수 있습니다: https://preview.redd.it/6kq4tt07yrsg1.png?width=714&format=png&auto=webp&s=ad8b207fb13729ae84f5b74cec5fd84a81dcface

사용자 평가

원작성자는 Qwen3.6 Plus가 "경쟁력은 있지만 최고는 아니다"라고 언급하며, "가격이 저렴하기 때문에 내 새 모델이 될 것이지만, 실제로 좋은지 여부는 벤치마크보다 더 많은 요소에 달려 있다"고 말했습니다. 또한 "Opus는 인공 분석에서 3위나 4위임에도 불구하고 다른 모든 모델을 압도한다"고 관찰했습니다.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Coinbase x402 대 Google A2A: 에이전트 간 결제를 위한 두 가지 상반된 결제 순서
News

Coinbase x402 대 Google A2A: 에이전트 간 결제를 위한 두 가지 상반된 결제 순서

에이전트 간 결제를 구축하다 보면 근본적인 차이가 드러납니다: Coinbase의 x402 미들웨어는 작업 완료 후 정산(verify→run→settle)하는 반면, Google의 A2A 확장은 느린 에이전트 호출의 경우 작업 전에 정산(verify→settle→run)합니다.

OpenClawRadar
Anthropic, Claude 커넥터에서 Gmail 메시지 본문 액세스 제거
News

Anthropic, Claude 커넥터에서 Gmail 메시지 본문 액세스 제거

Anthropic이 Gmail 커넥터에서 gmail_read_message와 gmail_search_messages 도구를 제거하고, 메시지 본문이나 첨부 파일 내용을 반환하지 않는 get_thread와 search_threads로 대체했습니다.

OpenClawRadar
OpenAI가 캘리포니아에서 나이 확인 옹호 단체에 비밀리에 자금을 지원했다
News

OpenAI가 캘리포니아에서 나이 확인 옹호 단체에 비밀리에 자금을 지원했다

OpenAI는 캘리포니아의 AI 연령 확인 요구 사항을 추진하는 단체인 Parents and Kids Safe AI Coalition에 비밀리에 자금을 지원했으며, 다른 옹호 단체들로부터 자사의 관여를 숨겼습니다. 회사는 Parents and Kids Safe AI Act 법안을 지원하기 위해 1천만 달러를 약속했습니다.

OpenClawRadar
Claude Code v2.1.183: 향상된 안전 자동 모드, TUI 수정 및 파괴적 Git 명령 차단
News

Claude Code v2.1.183: 향상된 안전 자동 모드, TUI 수정 및 파괴적 Git 명령 차단

Claude Code v2.1.183은 자동 모드에서 파괴적인 git 명령어를 명시적으로 요청하지 않으면 차단하고, 모델 지원 중단 경고를 추가하며, Windows Terminal TUI 손상을 수정합니다.

OpenClawRadar