Modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 publié avec configuration LM Studio

Détails et disponibilité du modèle
Le modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF est désormais disponible sur HuggingFace. Ce modèle a été créé en fusionnant deux modèles existants : Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong et Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.
La fusion conserve toutes les données d'entraînement et maintient la précision sur l'architecture Qwen 3.5 9B en utilisant la précision Float32 pendant le processus de fusion. Le modèle est entraîné sur le jeu de données Claude Opus 4.6 disponible à l'adresse https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.
Configuration recommandée
Pour de meilleures performances dans LM Studio 0.4.7 (build 4), utilisez ces paramètres :
- Invite système : https://pastebin.com/pU25DVnB
- Température : 0,7
- Échantillonnage Top K : 20
- Pénalité de répétition : (désactivée) ou 1,0
- Pénalité de présence : 1,5
- Échantillonnage Top P : 0,8
- Échantillonnage Min P : 0,0
- Graine : 3407
Performances et matériel
Sur une RTX 3060, le modèle atteint 42 jetons par seconde dans LM Studio. Le créateur note qu'il peut fonctionner encore plus rapidement sur llama-server. Le modèle a été créé en réponse aux demandes des utilisateurs sur Reddit et HuggingFace qui souhaitaient une grande fenêtre contextuelle dans une IA locale intelligente non censurée sans nécessiter de GPU puissants.
Le modèle est disponible à l'adresse : https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF
📖 Read the full source: r/LocalLLaMA
👀 See Also

Auto-co : Un script Bash de 50 lignes qui transforme le code Claude en entreprises d'IA autonomes
Auto-co est un script bash d'environ 50 lignes qui encapsule l'interface en ligne de commande Claude Code dans une boucle, lui permettant de fonctionner de manière autonome avec 14 agents IA jouant des rôles tels que PDG, ingénieur et critique. Il a créé quatre produits à partir de zéro, dont FormReply et Changelog.dev, pour un coût total de 268 dollars sur plus de 270 cycles.

Envoyer les agents OpenClaw comme participants à une réunion avec voix, chat et partage d'écran
Une nouvelle compétence permet aux agents OpenClaw de participer à Google Meet, Teams et Zoom avec voix (STT/TTS), chat, avatar vidéo et partage d'écran.

Outil de test d'authentification Web Bot gratuit de Fingerprint pour les développeurs d'agents IA
Fingerprint a publié un point de terminaison public et gratuit pour tester les implémentations de Web Bot Auth. Cet outil valide les signatures cryptographiques sur les requêtes HTTP, aidant les développeurs de bots et d'agents IA à s'assurer que leur configuration WBA fonctionne correctement avant la mise en production.

Expérience Utilisateur : Passer d'OpenClaw à l'Agent Hermes sur un LLM Local
Un développeur rapporte avoir basculé d'OpenClaw à Hermes Agent en utilisant Qwen3.5-9B sur une RX 9070 XT avec 16 Go de VRAM. Hermes a accompli une tâche complexe avec 5 appels d'outils corrects contre plus de 50 étapes pour OpenClaw, terminant 2 minutes 30 plus rapidement tout en conservant les fonctionnalités de RAG, d'appel d'outils et de mémoire persistante.