Mistral Medium 3.5 128B publié : modèle dense avec raisonnement et vision configurables

Mistral AI a publié Mistral Medium 3.5 (128B), un modèle transformer dense qui remplace Mistral Medium 3.1 et Magistral dans Le Chat, et Devstral 2 dans leur agent de codage Vibe. Il s'agit d'un ensemble unique de poids gérant le suivi d'instructions, le raisonnement et le codage.
Fonctionnalités clés
- Paramètres denses de 128B — pas de Mixture of Experts.
- Fenêtre de contexte de 256k pour les entrées longues.
- Entrée multimodale : accepte le texte et les images ; ne produit que du texte. Encodeur visuel entraîné de zéro pour gérer des tailles et ratios variables.
- Effort de raisonnement configurable : basculer par requête entre réponse instantanée (
none) et raisonnement profond (high). - Appel de fonction natif et sortie JSON pour les workflows agentiques.
- Multilingue : prend en charge l'anglais, le français, l'espagnol, l'allemand, l'italien, le portugais, le néerlandais, le chinois, le japonais, le coréen, l'arabe et d'autres.
- Forte adhérence aux instructions système.
Paramètres recommandés
- Effort de raisonnement :
nonepour les réponses rapides ;highpour les invites complexes et l'usage agentique (par ex.,reasoning_effort="high"). - Température : 0,7 avec raisonnement
high; 0,0–0,7 avecnoneselon la créativité souhaitée.
Licence
Publié sous une Licence MIT modifiée — open source pour usage commercial et non commercial, avec des exceptions pour les entreprises à fort chiffre d'affaires.
Quantifications GGUF disponibles
Unsloth a publié une version GGUF sur Hugging Face : unsloth/Mistral-Medium-3.5-128B-GGUF
Ce modèle est pertinent pour les développeurs exécutant des agents de codage IA locaux, en particulier ceux ayant besoin d'un suivi d'instructions de haute qualité, de raisonnement et de vision dans un seul modèle dense avec une grande fenêtre de contexte.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Les startups déclarent dépenser plus en puissance de calcul IA qu'en salaires humains.
Les startups d'IA comme Swan AI déclarent des factures mensuelles de calcul IA dépassant les 113 000 $, leurs PDG décrivant cela comme du 'tokenmaxxing' où les dépenses en IA remplacent les budgets traditionnels d'effectifs.

Coûts horaires réels pour les équipes d'agents IA de longue durée
Un développeur partage les coûts horaires réels pour des équipes d'agents IA exécutant des sessions de plus de 5 heures avec un accès complet à Linux, un navigateur et des outils. Les agents de codage coûtent 10 à 60 $/h, les agents marketing 10 à 30 $/h et les agents back-office 5 à 15 $/h.

Claude Code v2.1.116 : Améliorations des performances, corrections du terminal et mises à jour de sécurité
Claude Code v2.1.116 apporte des améliorations significatives de performance, notamment une accélération allant jusqu'à 67 % pour la commande /resume sur des sessions de plus de 40 Mo, un défilement plus fluide dans le terminal et un démarrage plus rapide du MCP. Cette version corrige également des problèmes d'affichage dans le terminal, ajoute des protections de sécurité pour les opérations dangereuses sur les chemins et résout plusieurs bogues affectant les commandes slash et la gestion des extensions.

Révision de code GitHub Copilot consommera des minutes Actions à partir du 1er juin 2026
À partir du 1er juin 2026, les revues de code Copilot de GitHub sur les dépôts privés consommeront des minutes GitHub Actions en plus des crédits IA. Les dépôts publics restent gratuits.