Qwen3.6-27B cabe en una única GPU de 24GB, supera al anterior modelo MoE de 397B en SWE-bench

✍️ OpenClawRadar📅 Publicado: 29 de abril de 2026🔗 Source
Qwen3.6-27B cabe en una única GPU de 24GB, supera al anterior modelo MoE de 397B en SWE-bench
Ad

Qwen3.6-27B se lanzó el 22 de abril, trayendo un modelo denso de 27B que cabe en una sola GPU de 24GB en Q4_K_M (~16.8GB) y obtiene una puntuación de 77.2 en SWE-bench Verified — superando al modelo MoE anterior de 397B (76.2). Para desarrolladores que ejecutan agentes de codificación locales en hardware de consumo, esto cambia el umbral para modelos agentivos capaces.

Especificaciones clave y arquitectura

  • Longitud de contexto de 262K
  • Licencia Apache 2.0
  • Atención lineal Gated DeltaNet (3 de 4 subcapas) con Gated Attention para el resto
  • "Thinking Preservation" transporta trazas de razonamiento entre turnos, reduciendo la generación de tokens redundantes y mejorando la eficiencia de la caché KV en sesiones largas de agentes
Ad

Requisitos de hardware

En Q4_K_M, el modelo usa ~16.8GB de VRAM, cabiendo cómodamente en una tarjeta de 24GB (por ejemplo, RTX 3090/4090, A10G). En contraste, Qwen3-Coder-Next (80B MoE, 3B activos) requiere 45–80GB en la misma cuantización, limitándolo a configuraciones de doble GPU o Apple Silicon con 48GB+ de memoria unificada.

Advertencias y detalles importantes

  • NO uses CUDA 13.2 — produce resultados basura. Quédate con CUDA 13.1 o 12.x.
  • Para usuarios que ya ejecutan Coder-Next en hardware de 48GB+ para tareas de agente, el cambio no es obviamente beneficioso.
  • Para usuarios de una sola GPU atascados con modelos de codificación locales más antiguos o débiles, Qwen3.6-27B es actualmente la opción más capaz en el nivel de 24GB.

📖 Lee la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Despliegue Sin Esfuerzo: Se Lanza Nueva Configuración de AWS con Un Clic para Open Claw
Noticias

Despliegue Sin Esfuerzo: Se Lanza Nueva Configuración de AWS con Un Clic para Open Claw

Los entusiastas de Open Claw ahora tienen una razón para celebrar. Una nueva herramienta de implementación en AWS con un solo clic simplifica el proceso de configuración para Open Claw, haciéndolo más accesible para desarrolladores y aficionados por igual.

OpenClawRadar
Un ejecutivo de Microsoft sugiere que los agentes de IA podrían requerir licencias de software como "oportunidades de puestos".
Noticias

Un ejecutivo de Microsoft sugiere que los agentes de IA podrían requerir licencias de software como "oportunidades de puestos".

El ejecutivo de Microsoft Rajesh Jha sugiere que los agentes de IA podrían necesitar sus propias licencias de software, con cada agente contando como un 'asiento' en los sistemas empresariales. Esto contrasta con las opiniones de que la IA reducirá el número de licencias al reemplazar a los usuarios humanos.

OpenClawRadar
Claude Encabeza las Listas de la App Store en Medio del Enfrentamiento Gubernamental
Noticias

Claude Encabeza las Listas de la App Store en Medio del Enfrentamiento Gubernamental

La aplicación Claude de Anthropic saltó del puesto 42 al 1 en las listas de Más Descargados de la App Store de EE. UU., con ChatGPT y Gemini ocupando el segundo y tercer lugar. El aumento sigue a un desacuerdo público entre Anthropic y el gobierno de EE. UU. sobre el uso militar y de vigilancia de la tecnología de IA.

OpenClawRadar
Punto de Referencia de Estrategias de Comercio: Modelos de IA Más Económicos Superan a Claude Opus 4.6
Noticias

Punto de Referencia de Estrategias de Comercio: Modelos de IA Más Económicos Superan a Claude Opus 4.6

Una prueba comparativa evaluó a 10 LLMs en el desarrollo de estrategias de trading, donde modelos más económicos como Minimax 2.5 y Gemini 3.1 superaron a Claude Opus 4.6 a pesar de su costo 10 veces mayor. El experimento se ejecutó tres veces con resultados consistentes.

OpenClawRadar