Modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 publié avec configuration LM Studio

✍️ OpenClawRadar📅 Publié: April 19, 2026🔗 Source
Modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 publié avec configuration LM Studio
Ad

Détails et disponibilité du modèle

Le modèle Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF est désormais disponible sur HuggingFace. Ce modèle a été créé en fusionnant deux modèles existants : Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong et Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.

La fusion conserve toutes les données d'entraînement et maintient la précision sur l'architecture Qwen 3.5 9B en utilisant la précision Float32 pendant le processus de fusion. Le modèle est entraîné sur le jeu de données Claude Opus 4.6 disponible à l'adresse https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.

Configuration recommandée

Pour de meilleures performances dans LM Studio 0.4.7 (build 4), utilisez ces paramètres :

  • Invite système : https://pastebin.com/pU25DVnB
  • Température : 0,7
  • Échantillonnage Top K : 20
  • Pénalité de répétition : (désactivée) ou 1,0
  • Pénalité de présence : 1,5
  • Échantillonnage Top P : 0,8
  • Échantillonnage Min P : 0,0
  • Graine : 3407
Ad

Performances et matériel

Sur une RTX 3060, le modèle atteint 42 jetons par seconde dans LM Studio. Le créateur note qu'il peut fonctionner encore plus rapidement sur llama-server. Le modèle a été créé en réponse aux demandes des utilisateurs sur Reddit et HuggingFace qui souhaitaient une grande fenêtre contextuelle dans une IA locale intelligente non censurée sans nécessiter de GPU puissants.

Le modèle est disponible à l'adresse : https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

ClaudeOrb : Une Extension Chrome Surveille l'Utilisation de l'API Claude en Temps Réel
Tools

ClaudeOrb : Une Extension Chrome Surveille l'Utilisation de l'API Claude en Temps Réel

Un développeur a créé ClaudeOrb, une extension Chrome gratuite qui affiche le pourcentage de session Claude, les limites hebdomadaires, les comptes à rebours, les coûts de Claude Code et les tendances de dépenses sur 7 jours. L'outil a été créé avec Claude Code après avoir atteint des limites de taux sans avertissement.

OpenClawRadar
Mengram AI : Outil de Mémoire Automatique pour les Sessions de Code Claude
Tools

Mengram AI : Outil de Mémoire Automatique pour les Sessions de Code Claude

Mengram AI maintient automatiquement le contexte entre les sessions Claude Code en chargeant les profils cognitifs, en injectant le contexte passé pertinent dans les invites et en sauvegardant les nouvelles connaissances. Il stocke une mémoire sémantique, épisodique et procédurale qui évolue en fonction des échecs.

OpenClawRadar
DAUB MCP Server Permet à Claude de Générer et Rendre des Interfaces Utilisateur via des Spécifications JSON
Tools

DAUB MCP Server Permet à Claude de Générer et Rendre des Interfaces Utilisateur via des Spécifications JSON

DAUB est un serveur MCP qui permet à Claude de générer des interfaces utilisateur directement à partir d'invites en langage naturel, produisant des spécifications JSON structurées qui s'affichent comme des interfaces en direct sans génération de code ni compilation. Il expose quatre outils, notamment generate_ui, render_spec, validate_spec et get_component_catalog.

OpenClawRadar
Résultats de Benchmark : 331 Modèles GGUF Testés sur Mac Mini M4 16 Go
Tools

Résultats de Benchmark : 331 Modèles GGUF Testés sur Mac Mini M4 16 Go

Un benchmark de 331 modèles GGUF sur un Mac Mini M4 avec 16 Go de RAM révèle seulement 11 modèles Pareto-optimaux, tous des architectures Mixture-of-Experts. Les modèles Mixture-of-Experts dominent les performances avec une médiane de 20,0 tokens/seconde contre 4,4 pour les modèles denses.

OpenClawRadar