Modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 publié avec configuration LM Studio

Détails et disponibilité du modèle
Le modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF est désormais disponible sur HuggingFace. Ce modèle a été créé en fusionnant deux modèles existants : Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong et Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.
La fusion conserve toutes les données d'entraînement et maintient la précision sur l'architecture Qwen 3.5 9B en utilisant la précision Float32 pendant le processus de fusion. Le modèle est entraîné sur le jeu de données Claude Opus 4.6 disponible à l'adresse https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.
Configuration recommandée
Pour de meilleures performances dans LM Studio 0.4.7 (build 4), utilisez ces paramètres :
- Invite système : https://pastebin.com/pU25DVnB
- Température : 0,7
- Échantillonnage Top K : 20
- Pénalité de répétition : (désactivée) ou 1,0
- Pénalité de présence : 1,5
- Échantillonnage Top P : 0,8
- Échantillonnage Min P : 0,0
- Graine : 3407
Performances et matériel
Sur une RTX 3060, le modèle atteint 42 jetons par seconde dans LM Studio. Le créateur note qu'il peut fonctionner encore plus rapidement sur llama-server. Le modèle a été créé en réponse aux demandes des utilisateurs sur Reddit et HuggingFace qui souhaitaient une grande fenêtre contextuelle dans une IA locale intelligente non censurée sans nécessiter de GPU puissants.
Le modèle est disponible à l'adresse : https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF
📖 Read the full source: r/LocalLLaMA
👀 See Also

ClaudeOrb : Une Extension Chrome Surveille l'Utilisation de l'API Claude en Temps Réel
Un développeur a créé ClaudeOrb, une extension Chrome gratuite qui affiche le pourcentage de session Claude, les limites hebdomadaires, les comptes à rebours, les coûts de Claude Code et les tendances de dépenses sur 7 jours. L'outil a été créé avec Claude Code après avoir atteint des limites de taux sans avertissement.

Mengram AI : Outil de Mémoire Automatique pour les Sessions de Code Claude
Mengram AI maintient automatiquement le contexte entre les sessions Claude Code en chargeant les profils cognitifs, en injectant le contexte passé pertinent dans les invites et en sauvegardant les nouvelles connaissances. Il stocke une mémoire sémantique, épisodique et procédurale qui évolue en fonction des échecs.

DAUB MCP Server Permet à Claude de Générer et Rendre des Interfaces Utilisateur via des Spécifications JSON
DAUB est un serveur MCP qui permet à Claude de générer des interfaces utilisateur directement à partir d'invites en langage naturel, produisant des spécifications JSON structurées qui s'affichent comme des interfaces en direct sans génération de code ni compilation. Il expose quatre outils, notamment generate_ui, render_spec, validate_spec et get_component_catalog.

Résultats de Benchmark : 331 Modèles GGUF Testés sur Mac Mini M4 16 Go
Un benchmark de 331 modèles GGUF sur un Mac Mini M4 avec 16 Go de RAM révèle seulement 11 modèles Pareto-optimaux, tous des architectures Mixture-of-Experts. Les modèles Mixture-of-Experts dominent les performances avec une médiane de 20,0 tokens/seconde contre 4,4 pour les modèles denses.