Le Benchmark OpenClaw Montre que Qwen3.5:27B Surpasse les Autres LLMs Locaux pour les Tâches d'Agent

✍️ OpenClawRadar📅 Publié: March 28, 2026🔗 Source
Le Benchmark OpenClaw Montre que Qwen3.5:27B Surpasse les Autres LLMs Locaux pour les Tâches d'Agent
Ad

Configuration et Résultats du Benchmark

Un utilisateur a testé 7 modèles locaux sur 22 tâches d'agent réelles en utilisant OpenClaw sur un Raspberry Pi 5 avec une RTX 3090 exécutant Ollama. Les tâches comprenaient la lecture d'e-mails, la planification de réunions, la création de tâches, la détection de phishing, la gestion d'erreurs et l'automatisation du navigateur.

Le gagnant, avec une avance considérable, était qwen3.5:27b-q4_K_M à 59,4 %. Le deuxième (qwen3.5:35b) n'a obtenu que 23,2 %. Tous les autres modèles ont obtenu moins de 5 %.

Ad

Principales Constatations

  • Le modèle quantifié 27B a battu la version plus grande 35B par 2,5 fois
  • Un modèle 30B s'est classé dernier avec 1,6 %
  • Une réflexion modérée a fonctionné le mieux - trop réfléchir a en fait nui aux performances
  • Aucun modèle n'a pu accomplir les tâches d'automatisation du navigateur
  • Le principal facteur différenciant les gagnants des perdants était la capacité du modèle à trouver et utiliser des outils en ligne de commande
  • La plupart des modèles n'ont même pas pu trouver des outils de base comme la fonction de messagerie

Ce benchmark fournit des données concrètes sur la performance de différents LLM locaux en tant qu'agents IA dans des scénarios pratiques. L'écart de performance significatif entre le meilleur modèle et les autres suggère que la capacité à trouver des outils est un goulot d'étranglement critique pour les agents LLM locaux.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

French Translation: Conception Ouverte : Alternative Open-Source au Design Claude Fonctionnant sur vos Agents CLI Locaux
Tools

French Translation: Conception Ouverte : Alternative Open-Source au Design Claude Fonctionnant sur vos Agents CLI Locaux

Open Design est un moteur de conception local-first et BYOK qui transforme 11 CLI d'agents de codage (Claude Code, Codex, Cursor, Gemini CLI, etc.) en un workflow de conception avec 72 systèmes de design de qualité professionnelle et 31 compétences composables, exportant HTML/PDF/PPTX/MP4.

OpenClawRadar
🦀
Tools

Hoplite (YC S26) lance le déploiement cloud pour les agents de codage avec des aperçus QA

Hoplite vous permet de déployer des agents de codage dans le cloud, en transférant votre configuration locale, y compris les sessions, les mémoires et les serveurs MCP. Il comprend un harnais personnalisé et se concentre sur l'intégration et les aperçus pour l'assurance qualité.

OpenClawRadar
Extension Chrome relie Google Messages à Claude Code via MCP
Tools

Extension Chrome relie Google Messages à Claude Code via MCP

Un développeur a créé une extension Chrome qui connecte Google Messages Web à Claude Code en utilisant MCP avec un transport stdio et WebSocket. L'extension liste les conversations, lit les messages et rédige des réponses, mais ne peut actuellement pas envoyer de messages en raison de l'isolation de zone.js d'Angular.

OpenClawRadar
Configuration du contrôle vocal local pour les agents IA sur Apple Silicon
Tools

Configuration du contrôle vocal local pour les agents IA sur Apple Silicon

Configuration du contrôle vocal local pour les agents IA en utilisant Parakeet STT et Kokoro TTS sur Apple Silicon pour des interactions rapides et indépendantes du cloud.

OpenClawRadar