GLM-5.1 sorti avec des performances de codage équivalentes à Claude Opus 4.5

✍️ OpenClawRadar📅 Publié: March 27, 2026🔗 Source
GLM-5.1 sorti avec des performances de codage équivalentes à Claude Opus 4.5
Ad

Zhipu AI a lancé GLM-5.1, son dernier modèle phare, le rendant accessible à tous les utilisateurs du Coding Plan. Ce modèle démontre des capacités de codage qui approchent les niveaux de performance de Claude Opus 4.5.

Principaux benchmarks et spécifications

Selon les benchmarks de mars 2026 :

  • SWE-bench-Verified : 77,8 points — score le plus élevé parmi les modèles open source
  • Terminal Bench 2.0 : 56,2 points — également à la pointe de l'open source
  • Surpasse GPT-4o et approche Claude Opus 4.5 sur les tâches de codage

Les spécifications techniques incluent :

  • Fenêtre de contexte de 200K
  • Sortie maximale de 128K
  • 744B paramètres (40B activés)
  • 28,5T de données de pré-entraînement
  • Support natif MCP
Ad

Applications pratiques

Le matériel source indique que ces capacités se traduisent par :

  • Tâches de codage autonomes multi-étapes avec un minimum d'assistance
  • Refactorisation et débogage de bases de code à long contexte
  • Flux de travail agentiques : planifier → exécuter → déboguer → livrer

GLM-5.1 est disponible dès maintenant via les niveaux du Coding Plan de Zhipu AI : Lite, Pro et Max. La discussion sur Reddit demande des comparaisons de tests réels contre Claude 4.6 pour les tâches de codage en production.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Régression de performance de Claude Code diagnostiquée : Configuration, pas intelligence du modèle
News

Régression de performance de Claude Code diagnostiquée : Configuration, pas intelligence du modèle

Le post-mortem d'Anthropic révèle que la baisse de performance de Claude Code a été causée par trois changements de produit — l'effort de raisonnement par défaut, un bug de mise en cache de session et un changement de verbosité des prompts — et non par une dégradation du modèle. Le retour en arrière a rétabli les performances.

OpenClawRadar
Claude Code v2.1.178 ajoute des règles de permission Tool(param:valeur), corrige des problèmes de sous-agent et d'authentification
News

Claude Code v2.1.178 ajoute des règles de permission Tool(param:valeur), corrige des problèmes de sous-agent et d'authentification

Claude Code v2.1.178 ajoute la syntaxe Tool(param:valeur) pour les règles de permission, corrige la visualisation des transcriptions des sous-agents, les incompatibilités de jetons OAuth et la mise en cache d'authentification obsolète.

OpenClawRadar
Les agents Claude sur Bedrock reçoivent des micropaiements autonomes via le protocole x402
News

Les agents Claude sur Bedrock reçoivent des micropaiements autonomes via le protocole x402

AWS AgentCore Payments permet aux agents Claude sur Bedrock de détenir des portefeuilles et d'effectuer des micropaiements en USDC en cours de tâche via la norme HTTP x402, permettant des appels API payants autonomes et la délégation de sous-tâches sans approbation humaine.

OpenClawRadar
La bulle financière cachée dans l'infrastructure de l'IA – Points clés
News

La bulle financière cachée dans l'infrastructure de l'IA – Points clés

Une analyse critique de l'essor des dépenses d'infrastructure IA, avertissant d'une bulle non durable similaire aux précédents krachs technologiques. Le PDF soutient que les dépenses d'investissement massives en GPU et centres de données dépassent largement les revenus réels générés.

OpenClawRadar