Comparación de referencia de Qwen3.6 Plus con modelos SOTA occidentales

✍️ OpenClawRadar📅 Publicado: 5 de abril de 2026🔗 Source
Comparación de referencia de Qwen3.6 Plus con modelos SOTA occidentales
Ad

Una publicación en Reddit en r/LocalLLaMA compara Qwen3.6 Plus con varios modelos occidentales de última generación en múltiples benchmarks. La comparación incluye métricas de rendimiento específicas para cada modelo.

Resultados de los Benchmarks

La fuente proporciona estas puntuaciones exactas:

  • Qwen3.6-Plus: SWE-bench Verified 78.8, GPQA / GPQA Diamond 90.4, HLE (sin herramientas) 28.8, MMMU-Pro 78.8
  • GPT‑5.4 (xhigh): SWE-bench Verified 78.2, GPQA / GPQA Diamond 93.0, HLE (sin herramientas) 39.8, MMMU-Pro 81.2
  • Claude Opus 4.6 (thinking heavy): SWE-bench Verified 80.8, GPQA / GPQA Diamond 91.3, HLE (sin herramientas) 34.44, MMMU-Pro 77.3
  • Gemini 3.1 Pro Preview: SWE-bench Verified 80.6, GPQA / GPQA Diamond 94.3, HLE (sin herramientas) 44.7, MMMU-Pro 80.5

La publicación incluye un gráfico de comparación visual disponible en: https://preview.redd.it/6kq4tt07yrsg1.png?width=714&format=png&auto=webp&s=ad8b207fb13729ae84f5b74cec5fd84a81dcface

Ad

Evaluación del Usuario

El autor original señala que Qwen3.6 Plus es "competitivo pero no el mejor" y afirma: "Será mi nuevo modelo dado lo económico que es, pero si realmente es bueno en la vida real dependerá de más que solo benchmarks". También observa que "Opus destruye a todos los demás a pesar de ser 3º o 4º en artificalanalysis".

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Dos funcionarios sudafricanos de Asuntos de Interior suspendidos por alucinaciones de IA en un documento de política
Noticias

Dos funcionarios sudafricanos de Asuntos de Interior suspendidos por alucinaciones de IA en un documento de política

Dos funcionarios fueron suspendidos después de que se encontraran alucinaciones de IA en la lista de referencias de un libro blanque revisado sobre ciudadanía, inmigración y protección de refugiados. El departamento implementará controles de IA y revisará todos los documentos políticos desde noviembre de 2022.

OpenClawRadar
Los marcas de agua de IA en texto siempre serán triviales de eliminar
Noticias

Los marcas de agua de IA en texto siempre serán triviales de eliminar

La Ley de IA de la UE exige marcas de agua de texto para 2026, pero siempre se podrán eliminar. Aquí te explicamos por qué y cómo funciona SynthID.

OpenClawRadar
Cuando el Código se Vuelve Barato, la Comprensión se Vuelve Cara
Noticias

Cuando el Código se Vuelve Barato, la Comprensión se Vuelve Cara

Markus Poppastring establece paralelismos entre la ola de subcontratación de los 2000 y la generación de código mediante IA actual: el costo pasa de escribir código a entenderlo, y con la IA, la intención puede no existir en ningún lado.

OpenClawRadar
China prohíbe a los cofundadores de Manus salir del país durante la revisión del acuerdo con Meta
Noticias

China prohíbe a los cofundadores de Manus salir del país durante la revisión del acuerdo con Meta

China ha prohibido a dos cofundadores de la startup de inteligencia artificial Manus salir del país mientras los reguladores revisan si la adquisición de Meta por $2 mil millones violó las normas de inversión. Los ejecutivos fueron convocados a Beijing para una reunión con la Comisión Nacional de Desarrollo y Reforma este mes.

OpenClawRadar