Mistral Medium 3.5 128B Lanzado: Modelo Denso con Razonamiento y Visión Configurables

Mistral AI ha lanzado Mistral Medium 3.5 (128B), un modelo transformer denso que reemplaza a Mistral Medium 3.1 y Magistral en Le Chat, y a Devstral 2 en su agente de codificación Vibe. Es un conjunto único de pesos que maneja seguimiento de instrucciones, razonamiento y codificación.
Características clave
- Parámetros densos de 128B — no es Mixture of Experts.
- Ventana de contexto de 256k para entradas largas.
- Entrada multimodal: acepta texto e imágenes; solo genera texto. El codificador de visión se entrenó desde cero para manejar tamaños y relaciones de aspecto variables.
- Esfuerzo de razonamiento configurable: alternar por solicitud entre respuesta instantánea (
none) y razonamiento profundo (high). - Llamada a funciones nativa y salida JSON para flujos de trabajo de agentes.
- Multilingüe: admite inglés, francés, español, alemán, italiano, portugués, neerlandés, chino, japonés, coreano, árabe y otros.
- Fuerte adherencia a las instrucciones del sistema.
Configuración recomendada
- Esfuerzo de razonamiento:
nonepara respuestas rápidas;highpara solicitudes complejas y uso de agentes (p. ej.,reasoning_effort="high"). - Temperatura: 0.7 con razonamiento
high; 0.0–0.7 connonedependiendo de la creatividad deseada.
Licencia
Publicado bajo una Licencia MIT Modificada — código abierto para uso comercial y no comercial, con excepciones para empresas de grandes ingresos.
Disponibles cuantizaciones GGUF
Unsloth ha publicado una versión GGUF en Hugging Face: unsloth/Mistral-Medium-3.5-128B-GGUF
Este modelo es relevante para desarrolladores que ejecutan agentes de codificación de IA locales, particularmente aquellos que necesitan seguimiento de instrucciones de alta calidad, razonamiento y visión en un único modelo denso con una ventana de contexto grande.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Concesionaria BMW revoca oferta de recompra tras error de chatbot de IA, precedente del caso Air Canada
Un concesionario BMW de Toronto revocó una oferta de recompra generada por su chatbot de IA, lo que desata preguntas legales. El precedente de Air Canada responsabiliza a las empresas por los errores de sus chatbots.

Usuarios de Anthropic Claude Informan Restricción Silenciosa de Funciones en Cuentas de Pago
Un suscriptor pagador de Claude informa que la ejecución de shell/bash dejó de funcionar en todas las sesiones sin notificación, con restricciones integradas en el prompt del sistema a nivel de despliegue. El usuario presentó múltiples tickets de soporte y formularios de apelación pero no recibió respuesta mientras continuaba siendo facturado.

Qwen3.5-122B en Blackwell SM120: Problema de Corrupción de Caché KV fp8 y Hallazgos de Rendimiento
Las pruebas de Qwen3.5-122B en hardware 8x RTX PRO 6000 Blackwell revelaron que la caché KV fp8_e4m3 produce silenciosamente salidas corruptas sin errores, requiriendo en su lugar caché KV bf16. La optimización MTP proporcionó una aceleración de 2.75x en solicitudes únicas, mientras que las restricciones de DeltaNet bloquearon otras optimizaciones.

Kimi K2.6 vs Claude Opus 4.7: Prueba práctica con un mod de tablón de recompensas para Minetest
Un desarrollador probó Kimi K2.6 y Claude Opus 4.7 creando un mod de tablón de recompensas para Minetest/Luanti con backend en TypeScript y registro en Google Sheets. Opus logró que funcionara correctamente; Kimi falló en la parte de integración.