Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lanzado con Configuración de LM Studio

Detalles del Modelo y Disponibilidad
El modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF ya está disponible en HuggingFace. Este modelo fue creado fusionando dos modelos existentes: Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong y Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.
La fusión preserva todos los datos de entrenamiento y mantiene la precisión en la arquitectura Qwen 3.5 9B utilizando precisión Float32 durante el proceso de fusión. El modelo está entrenado en el conjunto de datos Claude Opus 4.6 disponible en https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.
Configuración Recomendada
Para el mejor rendimiento en LM Studio 0.4.7 (compilación 4), utiliza estas configuraciones:
- Prompt del Sistema: https://pastebin.com/pU25DVnB
- Temperatura: 0.7
- Muestreo Top K: 20
- Penalización de Repetición: (desactivada) o 1.0
- Penalización de Presencia: 1.5
- Muestreo Top P: 0.8
- Muestreo Min P: 0.0
- Semilla: 3407
Rendimiento y Hardware
En una RTX 3060, el modelo alcanza 42 tokens por segundo en LM Studio. El creador señala que puede ejecutarse aún más rápido en llama-server. El modelo fue creado en respuesta a solicitudes de usuarios en Reddit y HuggingFace que deseaban una ventana de contexto grande en IA local inteligente sin censura sin requerir GPUs potentes.
El modelo está disponible en: https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Limonada por AMD: Servidor de LLM Local de Código Abierto para GPU y NPU
Lemonade es un servidor de IA local de código abierto que ejecuta modelos de texto, imagen y voz en GPUs y NPUs. Es compatible con la API de OpenAI, admite múltiples modelos simultáneamente y tiene un backend nativo en C++ de 2MB.

Código abierto local cambia automáticamente entre modelos de Claude para reducir costos de IA.
Un desarrollador creó un gancho local para Cursor y Claude Code que analiza las indicaciones y selecciona automáticamente el modelo Claude apropiado (Haiku, Sonnet u Opus) antes de enviar las solicitudes. La herramienta utiliza reglas de palabras clave para clasificar tareas y bloquear escenarios de sobrepago, mostrando un análisis retrospectivo una reducción de costos del 50-70%.

Habilidades de Claude para Emular un Entorno de Estudio de Diseño
Un diseñador comparte dos habilidades de Claude: una simula un estudio con compañeros y métodos de diseño, la otra añade 'juego riguroso' para la creatividad.

Sistema de 2 Prompts para Mantener el Contexto entre Conversaciones de Claude sin Desperdicio de Tokens
Un desarrollador comparte dos indicaciones para comprimir toda una conversación de Claude en un bloque de contexto estructurado y cargarlo en un nuevo chat, preservando decisiones, trabajo y próximos pasos.