Titre local Qwen 3.6 vs modèles frontières sur une primitive de codage : Animation de conduite de toile HTML mono-fichier

Un utilisateur de Reddit a réalisé une comparaison directe entre des modèles quantifiés locaux et des modèles web de pointe sur une primitive de codage spécifique : générer un fichier HTML unique avec une animation canvas plein écran d'une voiture vue de côté roulant avec défilement parallaxe, roues tournantes et éclairage cinématographique.
Le prompt
Le prompt exact demandait un fichier HTML unique sans bibliothèques, un canvas plein écran, une animation réaliste de voiture vue de côté, un décor à calques parallaxe, des roues tournantes, un mouvement subtil de la carrosserie, une boucle fluide et un ciel/éclairage cohérent.
Modèles testés
De pointe (via Perplexity, tok/s non mesuré) :
- Claude Sonnet 4.6 Thinking (a utilisé internet pour le raisonnement)
- Gemini 3.1 Pro Thinking
- GPT 5.4 Thinking
- Kimi k2.6 Thinking
Locaux (Ryzen 5 5600, 24 Go DDR4-3200, RX 5700 XT 8 Go) :
- Qwen3.5 9B Q4_K_M — ~50 tok/s
- Qwen3.6-27B (Claude-opus-reasoning-distilled) Q4_K_M — 2,65 tok/s
- Qwen3.6-27B Q4_K_M — 2,70 tok/s
- Qwen3.6-31B A3B Q4_K_M — 12,13 tok/s
- Gemma-4-31b-it — 1,91 tok/s
- Qwen3.5 4B Q8 — 60 tok/s (a utilisé internet pour le raisonnement)
- Qwen3.5 4B Q4_K_M — 80 tok/s (a utilisé internet pour le raisonnement)
Résultats et classement subjectif
Le classement pour cette tâche spécifique :
- Kimi k2.6 Thinking — résultat visuel le plus propre globalement
- Qwen3.6-27B Q4_K_M (local) — plus performant que prévu ; bon parallaxe et sensation de route
- Qwen3.6-27B Claude-opus-reasoning-distilled — troisième proche
Le 27B quantifié local a produit un mouvement et un calque plus naturels que certains modèles de pointe pour cette primitive visuelle spécifique. L'auteur a noté qu'il s'attendait à ce que les modèles de pointe surpassent plus nettement les quantifiés locaux.
L'utilisateur a seulement changé les balises HTML <title> pour suivre quel modèle a généré quel fichier. Les sorties sont partagées dans le fil avec des captures d'écran/GIF des animations en cours.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Les hôpitaux de New York mettent fin au contrat avec Palantir alors que son expansion au Royaume-Uni fait l'objet d'un examen minutieux
Le système hospitalier public de New York ne renouvellera pas son contrat de 4 millions de dollars avec Palantir en octobre, passant à des systèmes internes. Pendant ce temps, Palantir fait face à des préoccupations concernant la confidentialité de son accord de 330 millions de livres sterling avec le NHS et son nouveau contrat de régulation financière au Royaume-Uni.

Les outils d'IA peuvent conduire à une uniformisation des productions dans les travaux créatifs et de développement.
Un utilisateur de Reddit rapporte que plusieurs équipes utilisant des outils d'IA comme ChatGPT, Co-Pilot et Claude pour des feuilles de route stratégiques et le développement de logiciels produisent des résultats similaires avec des modèles de mots à la mode et des structures de conception identiques.

SenseNova-U1-8B-MoT : Modèle Multimodal Natif Open Source avec Architecture NEO-Unify
SenseNova a publié SenseNova-U1-8B-MoT, un modèle multimodal natif qui élimine à la fois l'encodeur visuel et le VAE, en utilisant l'architecture NEO-Unify pour une compréhension, un raisonnement et une génération unifiés. Il excelle dans la conversion texte-infographie, l'édition d'images et la génération entrelacée texte-image.

Anthropic limite OpenClaw avec un nouveau système de crédit : détails et impact
Anthropic limite à nouveau OpenClaw : à partir du 15 juin 2026, toute utilisation programmatique passe à un pool de crédits séparé avec des plafonds mensuels, sans report, et une facturation des dépassements aux tarifs de l'API.