Le modèle Distilled Qwen 3.5 27B démontre de solides performances avec l'agent de codage Cursor AI.

Performance du modèle avec Cursor
Un utilisateur de Reddit sur r/LocalLLaMA a partagé son expérience d'utilisation de la version distillée opus 4.6 de Qwen 27B comme modèle qui alimente Cursor, un assistant de codage IA. Il a décrit le modèle comme "incroyablement bon" et a évalué ses capacités au "niveau de Gemini 3 Flash".
L'utilisateur a noté que c'est la première fois qu'il a l'impression qu'un modèle open source vaut la peine d'être utilisé pour un travail de développement régulier, citant des performances "super solides". Il a spécifiquement mentionné que le mode Plan, le mode Agent et le mode Ask de Cursor fonctionnent tous bien immédiatement avec ce modèle.
Processus d'installation
Selon la source, l'installation a pris environ 10 minutes. L'utilisateur a laissé Cursor gérer le travail de configuration pour mettre en place à la fois le tunnel ngrok et l'infrastructure localllama nécessaires pour exécuter le modèle localement.
La combinaison des outils de Cursor avec ce modèle Qwen distillé crée ce que l'utilisateur décrit comme "une combinaison de codage vraiment puissante". Il recommande de l'essayer sur la base de son expérience positive.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Génération SVG Qwen3.6-27B avec harnais en boucle fermée
Un harnais en boucle fermée utilisant les agents Agno et Pi améliore itérativement les sorties SVG de Qwen3.6-27B en rendant l'image, en renvoyant le PNG à Qwen Vision, et en jugeant les résultats en deux tours.

Argus : Une extension VS Code pour déboguer les coûts et le comportement des sessions Claude Code
Un développeur a créé Argus, une extension VS Code qui analyse les transcriptions JSONL de Claude Code pour les afficher sous forme de timeline en temps réel avec répartition des tokens/coûts par étape, taux de cache hit, et signalement des boucles de tentative, lectures en double et pression contextuelle.

ClawCodex / Mode Conseiller : Associer un travailleur bon marché à un évaluateur coûteux pour réduire les coûts sans perdre en qualité
L'agent de codage Python open-source ClawCodex ajoute un mode /advisor qui associe un modèle ouvrier bon marché (p. ex., Haiku) à un réviseur coûteux (p. ex., Opus) aux décisions clés, réduisant considérablement les coûts sans sacrifier le jugement architectural.

SpruceChat exécute un LLM de 0,5 milliard de paramètres directement sur les consoles portables Miyoo grâce à llama.cpp.
SpruceChat exécute Qwen2.5-0.5B entièrement sur l'appareil sur des consoles de jeu portables en utilisant llama.cpp, sans nécessiter de cloud ou de WiFi. Sur un Miyoo A30 (quadricœur Cortex-A7), il se charge en ~60 secondes et génère à ~1-2 tokens/seconde.