Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lanzado con Configuración de LM Studio

Detalles del Modelo y Disponibilidad
El modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF ya está disponible en HuggingFace. Este modelo fue creado fusionando dos modelos existentes: Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF de Jackrong y Qwen3.5-9B-Uncensored-HauhauCS-Aggressive de HauhauCS.
La fusión preserva todos los datos de entrenamiento y mantiene la precisión en la arquitectura Qwen 3.5 9B utilizando precisión Float32 durante el proceso de fusión. El modelo está entrenado en el conjunto de datos Claude Opus 4.6 disponible en https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.
Configuración Recomendada
Para el mejor rendimiento en LM Studio 0.4.7 (compilación 4), utiliza estas configuraciones:
- Prompt del Sistema: https://pastebin.com/pU25DVnB
- Temperatura: 0.7
- Muestreo Top K: 20
- Penalización de Repetición: (desactivada) o 1.0
- Penalización de Presencia: 1.5
- Muestreo Top P: 0.8
- Muestreo Min P: 0.0
- Semilla: 3407
Rendimiento y Hardware
En una RTX 3060, el modelo alcanza 42 tokens por segundo en LM Studio. El creador señala que puede ejecutarse aún más rápido en llama-server. El modelo fue creado en respuesta a solicitudes de usuarios en Reddit y HuggingFace que deseaban una ventana de contexto grande en IA local inteligente sin censura sin requerir GPUs potentes.
El modelo está disponible en: https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Google PM publica como código abierto un agente de memoria siempre activo con almacenamiento SQLite, sin base de datos vectorial.
Shubham Saboo, gerente sénior de productos de IA en Google, ha liberado como código abierto un Agente de Memoria Siempre Activo que almacena recuerdos estructurados en SQLite en lugar de utilizar bases de datos vectoriales, funcionando con Gemini 3.1 Flash-Lite con consolidación de memoria programada cada 30 minutos.

Hospedaje Nativo de Agentes Habilitado para MCP: Implementa Apps mediante Agentes de IA en ocl-nexus
ocl-nexus presenta una configuración de servidor MCP que permite a los agentes de codificación de IA implementar aplicaciones directamente en un entorno en vivo protegido con SSO usando solo una clave API.

Coding-Flashcards: más de 800 tarjetas Anki para Rust, SQLite, Godot y Wolfram Language
Más de 800 tarjetas didácticas en Markdown que cubren Rust, SQLite, Godot y el lenguaje Wolfram desde primeros principios, con scripts para convertir a mazos de Anki o PDFs.

Complemento de Word SquarePact se conecta a la puerta de enlace OpenClaw para la edición de documentos agéntica
El complemento de Word de SquarePact se conecta a tu propio gateway OpenClaw a través de WebSocket. El agente propone ediciones que se muestran como tarjetas de aprobación, con detección de ediciones obsoletas y lógica de reintento para JSON malformado de modelos pequeños.