Xiaomi publie en open source MiMo-V2.5-Pro : approche les performances de Claude Opus 4.6 sur les benchmarks de codage

✍️ OpenClawRadar📅 Publié: April 28, 2026🔗 Source
Xiaomi publie en open source MiMo-V2.5-Pro : approche les performances de Claude Opus 4.6 sur les benchmarks de codage
Ad

Xiaomi a publié la famille de modèles open-source MiMo-V2.5, dont la variante Pro offre des benchmarks de codage compétitifs par rapport à Claude Opus 4.6 et GPT-5.4.

Tests concrets

Le V2.5-Pro a réalisé un projet de compilateur de l'Université de Pékin (compilateur SysY en Rust) en 4,3 heures avec un score parfait de 233/233 — supérieur à la plupart des étudiants qui y consacrent des semaines. Sur une consigne vague comme "crée un éditeur vidéo", il a produit de manière autonome une application de bureau de 8 192 lignes avec timeline multi-pistes, découpage de clips, fondus enchaînés, mixage audio et pipeline d'exportation après 11,5 heures et 1 868 appels d'outils. Dans une tâche de conception de circuits analogiques de niveau master (LDO Flipped-Voltage-Follower en TSMC 180nm), il a itéré via la simulation ngspice et amélioré la régulation de ligne de 22× et la régulation de charge de 17× par rapport à sa propre tentative initiale.

Ad

Benchmarks vs. Claude Opus 4.6, GPT-5.4, Gemini 3.1 Pro, DeepSeek V4 Pro

  • SWE-Bench Pro : 57,2 (vs. 57,3 Claude, 57,7 GPT, 54,2 Gemini, 55,4 DeepSeek)
  • SWE-Bench Verified : 78,9 (vs. 80,8 Claude, n/a GPT, 76,2 Gemini, 80,6 DeepSeek)
  • Terminal-Bench 2.0 : 68,4 (vs. 65,4 Claude, 75,1 GPT, 68,5 Gemini, 67,9 DeepSeek) — devance Claude et Gemini
  • Claw-Eval Pass@3 : 63,8 (vs. 70,4 Claude, 60,3 GPT, 57,8 Gemini, 59,8 DeepSeek) — bat GPT et Gemini
  • HLE avec outils : 48,0 (vs. 53,0 Claude, 58,7 GPT, 51,4 Gemini, 48,2 DeepSeek) — à la traîne en raisonnement général
  • GDPVal-AA : 1581 (vs. 1606 Claude, 1674 GPT, 1317 Gemini, 1554 DeepSeek) — à la traîne derrière GPT et Claude

Sur Claw-Eval, le graphique d'efficacité des tokens de Xiaomi prétend également que V2.5-Pro (63,8) bat Claude Sonnet 4.6. Le V2.5-Pro prend en charge l'exécution de tâches soutenues sur plus de 1 000 appels d'outils avec auto-correction ; un passage de refactorisation régressive au tour 512 a été détecté et corrigé de manière autonome.

Les poids sont désormais open-source pour téléchargement et auto-hébergement.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Claude Code v2.1.181 : syntaxe /config, événements Apple du bac à sable, correctifs de streaming
News

Claude Code v2.1.181 : syntaxe /config, événements Apple du bac à sable, correctifs de streaming

Claude Code v2.1.181 ajoute la syntaxe /config clé=valeur pour les réglages en ligne, sandbox.allowAppleEvents sur macOS et CLAUDE_CLIENT_PRESENCE_FILE. Il met également à niveau Bun vers 1.4, corrige la mise en cache des prompts sur les URL d'API personnalisées, les problèmes d'écriture sur les lecteurs réseau et de nombreuses régressions au démarrage.

OpenClawRadar
🦀
News

OpenClaw v2026.9.5 : mises à jour atomiques, rechargement à chaud des plugins, partage de session

OpenClaw v2026.9.5 déploie les mises à jour atomiques avec vérifications et retour arrière, l'installation/rechargement de plugins sans redémarrage de la passerelle, le partage de session en lecture seule, GPT Live en réunion, un tableau de bord navigateur partagé et l'archivage des conversations.

OpenClawRadar
Uber épuise en 4 mois le budget IA 2026 avec Claude Code — 500 à 2 000 $ par ingénieur par mois
News

Uber épuise en 4 mois le budget IA 2026 avec Claude Code — 500 à 2 000 $ par ingénieur par mois

Uber a dépensé tout son budget IA 2026 d'ici avril, consacré à Claude Code et Cursor. Les coûts mensuels d'API atteignent 500 à 2 000 dollars par ingénieur. 95 % des ingénieurs utilisent des outils d'IA chaque mois ; 70 % du code engagé est généré par l'IA.

OpenClawRadar
Claude Code v2.1.183 : Mode automatique plus sûr, correctifs TUI et blocage des commandes Git destructrices
News

Claude Code v2.1.183 : Mode automatique plus sûr, correctifs TUI et blocage des commandes Git destructrices

Claude Code v2.1.183 bloque les commandes git destructrices en mode automatique sauf demande explicite, ajoute des avertissements de dépréciation de modèle, corrige la corruption TUI sur Windows Terminal, et plus encore.

OpenClawRadar