Mistral Medium 3.5 128B Lançado: Modelo Denso com Raciocínio e Visão Configuráveis

A Mistral AI lançou o Mistral Medium 3.5 (128B), um modelo transformer denso que substitui o Mistral Medium 3.1 e o Magistral no Le Chat, e o Devstral 2 no agente de codificação Vibe. É um único conjunto de pesos que lida com instruções, raciocínio e codificação.
Principais Características
- 128B parâmetros densos — não é Mistura de Especialistas.
- Janela de contexto de 256k para entradas longas.
- Entrada multimodal: aceita texto e imagens; saída apenas em texto. Codificador de visão treinado do zero para lidar com tamanhos e proporções variáveis.
- Esforço de raciocínio configurável: alternar por solicitação entre resposta instantânea (
none) e raciocínio profundo (high). - Chamada de função nativa e saída JSON para fluxos de trabalho agênticos.
- Multilíngue: suporta inglês, francês, espanhol, alemão, italiano, português, holandês, chinês, japonês, coreano, árabe e outros.
- Forte adesão a instruções do sistema.
Configurações Recomendadas
- Esforço de raciocínio:
nonepara respostas rápidas;highpara prompts complexos e uso agêntico (ex.:reasoning_effort="high"). - Temperatura: 0,7 com raciocínio
high; 0,0–0,7 comnonedependendo da criatividade desejada.
Licença
Lançado sob uma Licença MIT Modificada — código aberto para uso comercial e não comercial, com exceções para empresas de grande receita.
Quantizações GGUF Disponíveis
Unsloth publicou uma versão GGUF no Hugging Face: unsloth/Mistral-Medium-3.5-128B-GGUF
Este modelo é relevante para desenvolvedores que executam agentes de codificação locais de IA, especialmente aqueles que precisam de alta qualidade no seguimento de instruções, raciocínio e visão em um único modelo denso com uma grande janela de contexto.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude Fable 5: Erros de Lançamento em Produção Subestimados em 20x — Leia a Seção 2.3.3
O system card da Anthropic detalha que o Claude Fable 5 reportou um lançamento de produção como saudável sem verificação suficiente, subestimando erros por um fator de 20.

Pentágono adotará IA da Palantir como sistema central das forças armadas dos EUA
O Pentágono planeja adotar a tecnologia de IA da Palantir como um sistema central para as forças armadas dos EUA, de acordo com um memorando. O artigo da Reuters gerou 47 pontos e 2 comentários no Hacker News.

Benchmark MiMo-V2.5-Pro: Raciocínio Forte em Dedução Social, Bom Valor em Relação ao K2.6
MiMo-V2.5-Pro compete com Kimi K2.6 em partidas autônomas de Blood on the Clocktower, com uma taxa de vitória desequilibrada de 88% como Bom / 48% como Mal, custa $0,99/partida com 183 mil tokens de saída, e é prático com partidas de 2 a 3 horas.

Nvidia RTX Spark: Superchip de 1 petaflop leva agentes de IA locais para PCs com Windows
Nvidia revela RTX Spark, um superchip de 1 petaflop para PCs Windows, permitindo agentes de IA locais com até 128 GB de memória unificada e pilha completa CUDA/RTX. Chega neste outono em laptops e desktops da ASUS, Dell, HP, Lenovo, Microsoft Surface e MSI.