Desarrollador cambia de Cursor Composer 2 y Kimi 2.6 a Qwen3.6:35b-a3b para cargas de trabajo empresariales

Un desarrollador en r/LocalLLaMA informa que ha reemplazado con éxito Cursor Composer 2 y Kimi 2.6 con Qwen3.6:35b-a3b para el desarrollo diario de software en una base de código empresarial de 500,000 a 700,000 líneas (60 horas/semana). El usuario probó anteriormente Kimi 2.6 y DeepSeek 4 Pro/Flash, pero encontró que Qwen3.6:35b-a3b era la mejor opción.
Detalles clave
- Modelo: Qwen3.6:35b-a3b (la versión 3.6 con 35 mil millones de parámetros y un subconjunto activado de 3 mil millones mediante MoE? — la notación del usuario es ambigua; probablemente Qwen2.5-32B o una variante personalizada). El modelo admite entrada de imágenes/capturas de pantalla.
- Alojamiento: Ejecutado a través de OpenRouter a aproximadamente $0.08 por 1 millón de tokens en promedio después de ajustes de caché y facturación. El usuario carece del hardware necesario para inferencia local.
- Carga de trabajo: Desarrollo a tiempo completo en un gran conjunto de software empresarial. El usuario afirma que el modelo "realmente entiende" la base de código y el contexto de la tarea, superando las opciones anteriores.
- Característica faltante: La única desventaja mencionada es la falta de la funcionalidad de agentes en la nube de Cursor y el alto rendimiento en Composer 2.
Comparación de costos
A ~$0.08/1M tokens, Qwen3.6:35b-a3b se describe como "increíblemente barato" para su nivel de capacidad. No se proporciona un desglose exacto, pero se aplican descuentos de caché y uso.
Para quién es
Desarrolladores que trabajan con grandes bases de código propietarias y desean un modelo capaz y de bajo costo para codificación asistida por IA sin necesidad de hardware GPU local.
📖 Leer la fuente original: r/LocalLLaMA
👀 Ver también
Nueva Orleans prueba la IA de Carbyne para el triaje de llamadas al 911 — Qué significa para la tecnología de emergencias
Nueva Orleans está probando el sistema de triaje de llamadas de emergencia con IA de Carbyne para 911, que maneja llamadas repetidas sobre el mismo incidente, reduciendo la carga de los despachadores. La IA pregunta a los llamantes si se refieren a un incidente conocido; si es así, proporciona información; si no, transfiere a un humano.

Lanzamiento de Claude-Code v2.1.38: Principales correcciones y mejoras.
Claude-Code v2.1.38 aborda regresiones en el terminal de VS Code, problemas con la tecla Tab y correcciones de permisos en comandos bash. También mejora el análisis de heredocs y la seguridad en modo sandbox.

Anthropic lanza una ventana de contexto de 1 millón para Claude Opus sin costo adicional.
Anthropic ha puesto a disposición la ventana de contexto de 1 millón de tokens para todos los usuarios de Claude Code en los planes Max, Team y Enterprise en la versión 2.1.75, eliminando la tarifa de uso adicional anterior. La ventana predeterminada sigue siendo de 200k tokens.

GPT 5.5 vs Claude: Informe de batalla de refactorización para desarrolladores
Un desarrollador usó GPT 5.5 para planificar y Claude para codificar una masiva refactorización de 36k líneas en C. GPT 5.5 impresionó con planes claros pero consumió el 85% del uso en 2 horas en el plan de $30.