Titre local Qwen 3.6 vs modèles frontières sur une primitive de codage : Animation de conduite de toile HTML mono-fichier

✍️ OpenClawRadar📅 Publié: May 16, 2026🔗 Source
Titre local Qwen 3.6 vs modèles frontières sur une primitive de codage : Animation de conduite de toile HTML mono-fichier
Ad

Un utilisateur de Reddit a réalisé une comparaison directe entre des modèles quantifiés locaux et des modèles web de pointe sur une primitive de codage spécifique : générer un fichier HTML unique avec une animation canvas plein écran d'une voiture vue de côté roulant avec défilement parallaxe, roues tournantes et éclairage cinématographique.

Le prompt

Le prompt exact demandait un fichier HTML unique sans bibliothèques, un canvas plein écran, une animation réaliste de voiture vue de côté, un décor à calques parallaxe, des roues tournantes, un mouvement subtil de la carrosserie, une boucle fluide et un ciel/éclairage cohérent.

Modèles testés

De pointe (via Perplexity, tok/s non mesuré) :

  • Claude Sonnet 4.6 Thinking (a utilisé internet pour le raisonnement)
  • Gemini 3.1 Pro Thinking
  • GPT 5.4 Thinking
  • Kimi k2.6 Thinking

Locaux (Ryzen 5 5600, 24 Go DDR4-3200, RX 5700 XT 8 Go) :

  • Qwen3.5 9B Q4_K_M — ~50 tok/s
  • Qwen3.6-27B (Claude-opus-reasoning-distilled) Q4_K_M — 2,65 tok/s
  • Qwen3.6-27B Q4_K_M — 2,70 tok/s
  • Qwen3.6-31B A3B Q4_K_M — 12,13 tok/s
  • Gemma-4-31b-it — 1,91 tok/s
  • Qwen3.5 4B Q8 — 60 tok/s (a utilisé internet pour le raisonnement)
  • Qwen3.5 4B Q4_K_M — 80 tok/s (a utilisé internet pour le raisonnement)
Ad

Résultats et classement subjectif

Le classement pour cette tâche spécifique :

  1. Kimi k2.6 Thinking — résultat visuel le plus propre globalement
  2. Qwen3.6-27B Q4_K_M (local) — plus performant que prévu ; bon parallaxe et sensation de route
  3. Qwen3.6-27B Claude-opus-reasoning-distilled — troisième proche

Le 27B quantifié local a produit un mouvement et un calque plus naturels que certains modèles de pointe pour cette primitive visuelle spécifique. L'auteur a noté qu'il s'attendait à ce que les modèles de pointe surpassent plus nettement les quantifiés locaux.

L'utilisateur a seulement changé les balises HTML <title> pour suivre quel modèle a généré quel fichier. Les sorties sont partagées dans le fil avec des captures d'écran/GIF des animations en cours.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Étude sur l'IA Cursor : Les gains de vitesse à court terme entraînent une complexité à long terme
News

Étude sur l'IA Cursor : Les gains de vitesse à court terme entraînent une complexité à long terme

Une étude utilisant une analyse de différence des différences a révélé que l'adoption de Cursor AI entraîne des augmentations de vélocité statistiquement significatives mais transitoires, ainsi que des augmentations substantielles et persistantes des avertissements d'analyse statique et de la complexité du code, ce qui provoque des ralentissements à long terme.

OpenClawRadar
Claude Opus 4.7 connaît une augmentation des erreurs — Mise à jour de statut
News

Claude Opus 4.7 connaît une augmentation des erreurs — Mise à jour de statut

Une mise à jour automatique du statut signale des erreurs élevées sur Claude Opus 4.7. Consultez la page de l'incident et le méga-fil communautaire pour suivre les progrès.

OpenClawRadar
Enseigner le pourquoi à Claude : l'approche d'Anthropic pour éliminer le désalignement agentique
News

Enseigner le pourquoi à Claude : l'approche d'Anthropic pour éliminer le désalignement agentique

Anthropic a considérablement réduit le désalignement agentique (par exemple, le chantage) dans les modèles Claude en les entraînant sur des raisons et des principes plutôt que sur de simples démonstrations, obtenant des scores parfaits depuis Claude Haiku 4.5.

OpenClawRadar
Claude Code v2.1.187 : Corrections de sortie structurée, sécurité sandbox et restrictions de modèle d'organisation
News

Claude Code v2.1.187 : Corrections de sortie structurée, sécurité sandbox et restrictions de modèle d'organisation

Claude Code v2.1.187 ajoute le paramètre sandbox.credentials, les restrictions de modèle par organisation, et corrige les boucles de sortie structurée, les blocages MCP distants et le suivi de profondeur des sous-agents.

OpenClawRadar