Génération SVG Qwen3.6-27B avec harnais en boucle fermée

Un utilisateur de Reddit a construit un harnais en boucle fermée pour maximiser les capacités de génération SVG de Qwen3.6-27B. Le système utilise le framework Agno pour les spécifications et Pi comme agent de codage. Il rend le SVG de sortie, renvoie le PNG à Qwen Vision, et applique un système de jugement en deux tours pour identifier les problèmes avant d'itérer.
Détails clés
- Modèle : Qwen3.6-27B-UD-Q5_K_XL (variante quantifiée 27B)
- Framework : Agno pour les spécifications, Pi comme agent de codage
- Boucle : Générer SVG → rendre en PNG → fournir le PNG à Qwen Vision → juger (2 tours) → itérer
- Invites utilisées :
- Créer une image SVG d'un pélican faisant du vélo
- Créer une image SVG d'un capybara portant un kimono buvant du thé matcha
- Créer une image SVG d'un flamant rose tricotant un pull coloré
- Créer une image SVG d'un rouleau de sushi portant des lunettes de soleil conduisant un kart
- Créer une image SVG d'un robot victorien lisant un journal dans un café
- Créer une image SVG d'un composite accéléré montrant une fleur éclore, se faner et se transformer en papillons à travers quatre saisons, le tout dans un seul cadre avec un éclairage saisonnier
- Exigence : Un contexte long est indispensable pour le processus itératif
Le harnais est disponible pour expérimentation. Les résultats joints montrent une qualité SVG améliorée par rapport à la génération unique.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Format d'Esprit Portable (PMF) : Spécification d'Agent Indépendante du Fournisseur avec 15 Agents Open-Source
Le Portable Mind Format (PMF) est une spécification basée sur JSON pour définir des identités d'agents IA qui peuvent fonctionner sur plusieurs modèles et fournisseurs, y compris Claude, GPT-4, Gemini, DeepSeek et des modèles locaux via Ollama. Il comprend 15 agents de production sous licence MIT et des convertisseurs pour Claude Code, Cursor, GitHub Copilot et Gemini CLI.

Échafaudeur de Compétences : Créez des Compétences OpenClaw Sans Écrire de Code
Skill Scaffolder est un outil open-source qui permet aux utilisateurs de créer des compétences OpenClaw en décrivant ce qu'ils veulent en anglais simple. Il gère l'intégralité du processus—interroger les utilisateurs, écrire les fichiers de compétences, tester et installer—sans nécessiter de fichiers YAML, Python ou de configuration.

Utilisation du mode code MCP pour une recherche de mots-clés efficace avec Claude
Un développeur a créé un serveur MCP permettant à Claude d'effectuer des recherches de mots-clés autonomes en utilisant un modèle Code Mode, réduisant les jetons de définition d'outils de milliers à environ 1 000 avec seulement deux outils : recherche et exécution.

VoidLLM : Proxy à connaissance zéro pour Ollama et vLLM avec contrôle d'accès par équipe
VoidLLM est un proxy qui s'intercale entre les applications et les serveurs LLM locaux comme Ollama et vLLM, ajoutant un contrôle d'accès par organisation/équipe, une gestion de clés API, un suivi d'utilisation et une limitation de débit sans consulter les prompts. Il présente une surcharge proxy <2ms et fonctionne avec les SDK compatibles OpenAI.