Mistral Medium 3.5 128B publié : modèle dense avec raisonnement et vision configurables

Mistral AI a publié Mistral Medium 3.5 (128B), un modèle transformer dense qui remplace Mistral Medium 3.1 et Magistral dans Le Chat, et Devstral 2 dans leur agent de codage Vibe. Il s'agit d'un ensemble unique de poids gérant le suivi d'instructions, le raisonnement et le codage.
Fonctionnalités clés
- Paramètres denses de 128B — pas de Mixture of Experts.
- Fenêtre de contexte de 256k pour les entrées longues.
- Entrée multimodale : accepte le texte et les images ; ne produit que du texte. Encodeur visuel entraîné de zéro pour gérer des tailles et ratios variables.
- Effort de raisonnement configurable : basculer par requête entre réponse instantanée (
none) et raisonnement profond (high). - Appel de fonction natif et sortie JSON pour les workflows agentiques.
- Multilingue : prend en charge l'anglais, le français, l'espagnol, l'allemand, l'italien, le portugais, le néerlandais, le chinois, le japonais, le coréen, l'arabe et d'autres.
- Forte adhérence aux instructions système.
Paramètres recommandés
- Effort de raisonnement :
nonepour les réponses rapides ;highpour les invites complexes et l'usage agentique (par ex.,reasoning_effort="high"). - Température : 0,7 avec raisonnement
high; 0,0–0,7 avecnoneselon la créativité souhaitée.
Licence
Publié sous une Licence MIT modifiée — open source pour usage commercial et non commercial, avec des exceptions pour les entreprises à fort chiffre d'affaires.
Quantifications GGUF disponibles
Unsloth a publié une version GGUF sur Hugging Face : unsloth/Mistral-Medium-3.5-128B-GGUF
Ce modèle est pertinent pour les développeurs exécutant des agents de codage IA locaux, en particulier ceux ayant besoin d'un suivi d'instructions de haute qualité, de raisonnement et de vision dans un seul modèle dense avec une grande fenêtre de contexte.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Claude d'Anthropic mène 80 000 entretiens structurés en alternative aux enquêtes
Anthropic a utilisé Claude pour mener des entretiens structurés avec environ 80 000 utilisateurs dans plus de 150 pays et 70 langues, le LLM servant à la fois d'intervieweur et d'analyste pour recueillir des informations conversationnelles.

Le modèle IA Gemini Nano de Chrome consomme 4 Go d'espace disque
Selon un rapport de The Verge, Google Chrome télécharge automatiquement un fichier weights.bin de 4 Go pour le modèle d'IA Gemini Nano intégré, ce qui peut gonfler le stockage sans notification claire à l'utilisateur. La désactivation du bouton IA Intégrée dans les paramètres supprime le fichier et empêche un nouveau téléchargement.

Anomalie de facturation de l'API Anthropic : Le modèle Sonnet facturé aux tarifs Opus
Un utilisateur a découvert que l'API Anthropic facture incorrectement le modèle claude-sonnet-4-6 aux tarifs d'Opus, bien qu'elle renvoie la chaîne de modèle correcte. Le bug a été identifié par l'analyse des données d'événements brutes montrant un écart de coût.

Claude Code v2.1.199 corrige plus de 20 bugs : correctifs SSL, sous-agents, plantages du démon
Claude Code v2.1.199 corrige les erreurs de certificat SSL, les échecs silencieux des sous-agents, une boucle de crash du démon Linux, et plus de 20 autres bugs. Les correctifs clés incluent des indications immédiates d'erreur SSL, la conservation partielle des flux et la propagation des erreurs des sous-agents.