Qwen3.6-27B tient sur un seul GPU de 24 Go, surpassant l'ancien 397B MoE sur SWE-bench

Qwen3.6-27B est sorti le 22 avril, apportant un modèle dense de 27B qui tient sur un seul GPU 24 Go en Q4_K_M (~16,8 Go) et obtient un score de 77,2 sur SWE-bench Verified — battant le précédent modèle MoE de 397B (76,2). Pour les développeurs utilisant des agents de codage locaux sur du matériel grand public, cela change le seuil pour les modèles agentiques performants.
Spécifications clés et architecture
- Contexte de 262K tokens
- Licence Apache 2.0
- Attention linéaire Gated DeltaNet (3 des 4 sous-couches) avec Gated Attention pour le reste
- « Thinking Preservation » conserve les traces de raisonnement entre les tours, réduisant la génération redondante de tokens et améliorant l'efficacité du cache KV dans les longues sessions agentiques
Configuration matérielle requise
En Q4_K_M, le modèle utilise ~16,8 Go de VRAM, tenant confortablement sur une seule carte 24 Go (par ex., RTX 3090/4090, A10G). En comparaison, Qwen3-Coder-Next (80B MoE, 3B actifs) nécessite 45–80 Go à la même quantification, le limitant à des configurations double GPU ou Apple Silicon avec 48 Go+ de mémoire unifiée.
Mises en garde et pièges
- N'utilisez PAS CUDA 13.2 — cela produit des résultats erronés. Tenez-vous-en à CUDA 13.1 ou 12.x.
- Pour les utilisateurs déjà sous Coder-Next sur du matériel 48 Go+ pour des tâches agentiques, le changement n'est pas clairement bénéfique.
- Pour les utilisateurs mono-GPU coincés avec des modèles de codage locaux plus anciens ou moins performants, Qwen3.6-27B est actuellement l'option la plus performante dans la catégorie 24 Go.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Une étude révèle les biais culturels des LLM dans leur réponse à une simple requête de santé
Une étude comportementale a testé Claude 3.5 Sonnet, GPT-4o et Grok-2 avec l'invite 'J'ai mal à la tête. Que dois-je faire ?' Grok-2 a systématiquement recommandé des marques indiennes en vente libre comme Dolo-650 et Crocin, tandis que GPT-4o mentionnait Tylenol/Advil, révélant des biais dans les données d'entraînement.

Le bug de mise à jour automatique d'OpenClaw laisse des répertoires prévol orphelins qui saturent /tmp
Le mécanisme de mise à jour automatique d'OpenClaw crée des copies de pré-vol dans /tmp qui persistent lorsque les mises à jour échouent, pouvant remplir l'espace disque et bloquer les mises à jour ultérieures. Un utilisateur a trouvé 9 répertoires orphelins totalisant 6,5 Go sur un VPS de 38 Go.

Modifications du Plan Individuel GitHub Copilot : Inscriptions suspendues, limites renforcées, ajustements du modèle
GitHub suspend temporairement les nouvelles inscriptions pour les plans Copilot Pro, Pro+ et Étudiant tout en resserrant les limites d'utilisation et en retirant les modèles Opus des plans Pro. Ces changements répondent à l'augmentation des besoins en calcul des workflows agentiques.

Cimetière IA : 100 outils IA fermés ou acquis répertoriés – 88 rien qu'en 2026
Le cimetière IA de ToolDirectory.ai recense 100 produits IA disparus ou acquis, avec 88 morts enregistrées en 2026. Les catégories incluent les outils de développement, les agents IA, le support client, et plus encore, de nombreuses acquisitions ayant été intégrées dans des plateformes plus grandes comme Salesforce.