Desarrollador Prueba Qwen3.5 27B frente a Modelos Más Grandes para Tareas de Programación Local

✍️ OpenClawRadar📅 Publicado: 28 de marzo de 2026🔗 Source
Desarrollador Prueba Qwen3.5 27B frente a Modelos Más Grandes para Tareas de Programación Local
Ad

Un desarrollador probó varios modelos de lenguaje grandes para tareas de programación local, comparando rendimiento y requisitos de hardware. Las pruebas se centraron en variantes de Qwen3.5 y modelos Nemotron, con comparaciones con GPT-5.4 High.

Resultados y Hallazgos de las Pruebas

El desarrollador probó estos modelos específicos:

  • unsloth/Qwen3.5-27B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-122B-A10B-GGUF
  • unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL
  • unsloth/Qwen3.5-27B-GGUF:UD-Q8_K_XL
  • unsloth/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF:UD-IQ4_XS
  • unsloth/gpt-oss-120b-GGUF:F16

Hallazgos clave de las pruebas:

  • Nemotron-3-Super-120B funcionó "muy, muy bien", a la par con GPT-5.4 High
  • Qwen3.5-27B funcionó bien para tareas de desarrollo
  • GPT-OSS-120B y Qwen3.5-122B funcionaron peor que los otros dos modelos
  • Nemotron-3-Super-120B respondió consistentemente en español (el idioma nativo del probador) mientras que otros respondieron en inglés

Métricas de Rendimiento

El desarrollador proporcionó números de rendimiento específicos:

  • Nemotron-3-Super-120B: 80 tokens por segundo (tg/s), ~2000 procesamiento de prompt (pp), contexto de 100k en vast.ai con 4x RTX 3090
  • Qwen3.5-27B Q6: 803 pp, 25 tg/s, contexto de 256k en vast.ai
Ad

Requisitos de Hardware

El desarrollador señaló limitaciones de hardware:

  • Qwen3.5-122B requeriría una nueva placa base y 1-2 tarjetas RTX 3090 adicionales, haciéndolo demasiado costoso
  • Qwen3.5-27B funciona en hardware existente de 2x RTX 3090 sin inversión adicional
  • Si tuvieran el hardware para Nemotron-3-Super-120B, lo usarían en su lugar

Detalles de Implementación

El desarrollador planea usar Qwen3.5-27B-GGUF:UD-Q6_K_XL para tareas de desarrollo reales localmente y proporcionó el comando de llama.cpp utilizado para las pruebas:

./llama.cpp/llama-server -hf unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL --ctx-size 262144 --temp 0.6 --top-p 0.95 --top-k 20 --min-p 0.00 -ngl 999

El desarrollador mencionó que continuará usando CODEX para tareas complejas pero puede reemplazar suscripciones de API para tareas diarias con la configuración local.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Generador de Indicaciones Socráticas Construido como Artefacto React Dentro de Claude
Herramientas

Generador de Indicaciones Socráticas Construido como Artefacto React Dentro de Claude

Un desarrollador creó un generador de prompts socráticos como un artefacto React que se ejecuta dentro de Claude, con detección automática de la complejidad de entrada y generación de prompts de tres niveles con análisis de modos de fallo.

OpenClawRadar
Claude Code Agrega Modo Automático para Decisiones de Permisos
Herramientas

Claude Code Agrega Modo Automático para Decisiones de Permisos

Claude Code ahora tiene un modo automático que permite a Claude manejar las decisiones de permisos en lugar de requerir aprobación manual para cada escritura de archivo y comando bash. Este modo incluye salvaguardas que verifican cada acción antes de ejecutarla, con un clasificador que revisa las llamadas a herramientas en busca de acciones potencialmente destructivas.

OpenClawRadar
OctoArch v5.0: Entorno de Ejecución B2B de Confianza Cero con Personas de IA Basadas en JSON
Herramientas

OctoArch v5.0: Entorno de Ejecución B2B de Confianza Cero con Personas de IA Basadas en JSON

OctoArch v5.0 es un entorno de ejecución cognitivo B2B de confianza cero diseñado para casos de uso empresariales estrictos como la extracción fiscal/de facturas. Reemplaza los prompts basados en texto con personas de IA definidas por JSON e implementa el encarcelamiento de rutas para prevenir ataques al servidor.

OpenClawRadar
Manifiesto Agrega Planes de Token MiniMax con Soporte para Modelo M2.7
Herramientas

Manifiesto Agrega Planes de Token MiniMax con Soporte para Modelo M2.7

Manifest, una capa de enrutamiento de código abierto para OpenClaw, ahora admite planes de tokens MiniMax a partir de $10/mes. El nuevo modelo MiniMax M2.7 está específicamente diseñado para flujos de trabajo de OpenClaw y obtiene 62.7 en MM-ClawBench y 56.2 en SWE-Bench Pro.

OpenClawRadar