Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lanzado con Configuración de LM Studio

✍️ OpenClawRadar📅 Publicado: 19 de abril de 2026🔗 Source
Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lanzado con Configuración de LM Studio
Ad

Detalles del Modelo y Disponibilidad

El modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF ya está disponible en HuggingFace. Este modelo fue creado fusionando dos modelos existentes: Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong y Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.

La fusión preserva todos los datos de entrenamiento y mantiene la precisión en la arquitectura Qwen 3.5 9B utilizando precisión Float32 durante el proceso de fusión. El modelo está entrenado en el conjunto de datos Claude Opus 4.6 disponible en https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.

Configuración Recomendada

Para el mejor rendimiento en LM Studio 0.4.7 (compilación 4), utiliza estas configuraciones:

  • Prompt del Sistema: https://pastebin.com/pU25DVnB
  • Temperatura: 0.7
  • Muestreo Top K: 20
  • Penalización de Repetición: (desactivada) o 1.0
  • Penalización de Presencia: 1.5
  • Muestreo Top P: 0.8
  • Muestreo Min P: 0.0
  • Semilla: 3407
Ad

Rendimiento y Hardware

En una RTX 3060, el modelo alcanza 42 tokens por segundo en LM Studio. El creador señala que puede ejecutarse aún más rápido en llama-server. El modelo fue creado en respuesta a solicitudes de usuarios en Reddit y HuggingFace que deseaban una ventana de contexto grande en IA local inteligente sin censura sin requerir GPUs potentes.

El modelo está disponible en: https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Limonada por AMD: Servidor de LLM Local de Código Abierto para GPU y NPU
Herramientas

Limonada por AMD: Servidor de LLM Local de Código Abierto para GPU y NPU

Lemonade es un servidor de IA local de código abierto que ejecuta modelos de texto, imagen y voz en GPUs y NPUs. Es compatible con la API de OpenAI, admite múltiples modelos simultáneamente y tiene un backend nativo en C++ de 2MB.

OpenClawRadar
Código abierto local cambia automáticamente entre modelos de Claude para reducir costos de IA.
Herramientas

Código abierto local cambia automáticamente entre modelos de Claude para reducir costos de IA.

Un desarrollador creó un gancho local para Cursor y Claude Code que analiza las indicaciones y selecciona automáticamente el modelo Claude apropiado (Haiku, Sonnet u Opus) antes de enviar las solicitudes. La herramienta utiliza reglas de palabras clave para clasificar tareas y bloquear escenarios de sobrepago, mostrando un análisis retrospectivo una reducción de costos del 50-70%.

OpenClawRadar
Habilidades de Claude para Emular un Entorno de Estudio de Diseño
Herramientas

Habilidades de Claude para Emular un Entorno de Estudio de Diseño

Un diseñador comparte dos habilidades de Claude: una simula un estudio con compañeros y métodos de diseño, la otra añade 'juego riguroso' para la creatividad.

OpenClawRadar
Sistema de 2 Prompts para Mantener el Contexto entre Conversaciones de Claude sin Desperdicio de Tokens
Herramientas

Sistema de 2 Prompts para Mantener el Contexto entre Conversaciones de Claude sin Desperdicio de Tokens

Un desarrollador comparte dos indicaciones para comprimir toda una conversación de Claude en un bloque de contexto estructurado y cargarlo en un nuevo chat, preservando decisiones, trabajo y próximos pasos.

OpenClawRadar