Comparaison de référence de Qwen3.6 Plus avec les modèles SOTA occidentaux

✍️ OpenClawRadar📅 Publié: April 5, 2026🔗 Source
Comparaison de référence de Qwen3.6 Plus avec les modèles SOTA occidentaux
Ad

Un post Reddit sur r/LocalLLaMA compare Qwen3.6 Plus à plusieurs modèles occidentaux de pointe à travers plusieurs benchmarks. La comparaison inclut des métriques de performance spécifiques pour chaque modèle.

Résultats des Benchmarks

La source fournit ces scores exacts :

  • Qwen3.6-Plus : SWE-bench Verified 78,8, GPQA / GPQA Diamond 90,4, HLE (sans outils) 28,8, MMMU-Pro 78,8
  • GPT‑5.4 (xhigh) : SWE-bench Verified 78,2, GPQA / GPQA Diamond 93,0, HLE (sans outils) 39,8, MMMU-Pro 81,2
  • Claude Opus 4.6 (thinking heavy) : SWE-bench Verified 80,8, GPQA / GPQA Diamond 91,3, HLE (sans outils) 34,44, MMMU-Pro 77,3
  • Gemini 3.1 Pro Preview : SWE-bench Verified 80,6, GPQA / GPQA Diamond 94,3, HLE (sans outils) 44,7, MMMU-Pro 80,5

Le post inclut un graphique de comparaison visuel disponible à l'adresse : https://preview.redd.it/6kq4tt07yrsg1.png?width=714&format=png&auto=webp&s=ad8b207fb13729ae84f5b74cec5fd84a81dcface

Ad

Évaluation de l'Utilisateur

L'auteur original du post note que Qwen3.6 Plus est "compétitif mais pas le meilleur" et déclare : "Ce sera mon nouveau modèle étant donné son faible coût, mais sa réelle efficacité dépendra de plus que des benchmarks." Il observe également que "Opus surpasse tous les autres malgré sa 3e ou 4e place sur artificalanalysis."

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Claude Code v2.1.223 : correctifs de sécurité, indice /teleport et alias /review
News

Claude Code v2.1.223 : correctifs de sécurité, indice /teleport et alias /review

Claude Code v2.1.223 ajoute des wildcards propriétaire pour les paramètres de marketplace, une astuce /teleport et corrige un contournement de permission Bash.

OpenClawRadar
La discussion sur l'IA dans Hacker News passe des démos à l'accent sur les outils
News

La discussion sur l'IA dans Hacker News passe des démos à l'accent sur les outils

Les discussions récentes sur Hacker News concernant l'IA évoluent des démonstrations ponctuelles vers des outils durables comme le suivi des prix, la vérification, la mémoire, l'évaluation et l'intégration dans les flux de travail. Cela indique un virage vers l'opérationnalisation, où les communautés cessent de récompenser les publications axées sur la nouveauté.

OpenClawRadar
Rust sauvera Linux de l'IA : Greg Kroah-Hartman sur les bugs du C et les garanties de sécurité de Rust
News

Rust sauvera Linux de l'IA : Greg Kroah-Hartman sur les bugs du C et les garanties de sécurité de Rust

Greg Kroah-Hartman, mainteneur du noyau Linux stable, affirme que Rust élimine 60% des bogues du noyau à la compilation, répondant à l'afflux de CVE découvertes par l'IA comme Dirty Frag et Fragnesia.

OpenClawRadar
Autoresearch pousse Qwen3.5-397B à 20,34 tok/s sur M5 Max via le streaming SSD
News

Autoresearch pousse Qwen3.5-397B à 20,34 tok/s sur M5 Max via le streaming SSD

Un développeur a atteint une vitesse d'inférence de 20,34 tokens/seconde pour le modèle Qwen3.5-397B de 209 Go sur un MacBook Pro M5 Max avec 128 Go de RAM en utilisant le streaming SSD et 36 expériences systématiques. Ce résultat représente une accélération de 2x par rapport au point de référence du M5 Max et de 4,67x par rapport au résultat original du M3 Max.

OpenClawRadar