Benchmark : Gemma4 12B contre Qwen3 8B quantifié sur Mac Mini 24 Go

Comparaison des performances de deux modèles locaux pour OpenClaw
Un développeur a réalisé un test comparatif entre Gemma4 12B et Qwen3:8b-q4_K_M sur un Mac Mini 24GB. Le test a utilisé deux prompts : "expliquer comment fonctionne un carburateur" et "écrire une fonction Python pour détecter les fuites de mémoire". Claude a aidé à écrire une commande pour extraire les mesures de la sortie.
Résultats des benchmarks
Tâche d'explication du carburateur :
- Qwen3:8b-q4_K_M : Évaluation du prompt : 89,8 t/s, Génération : 19,6 t/s
- Gemma4 : Évaluation du prompt : 20,8 t/s, Génération : 27,6 t/s
Tâche de codage Python :
- Qwen3:8b-q4_K_M : Évaluation du prompt : 133,8 t/s, Génération : 18,7 t/s
- Gemma4 : Évaluation du prompt : 26,1 t/s, Génération : 26,1 t/s
Principales conclusions
Qwen3 traite les prompts 4 à 5 fois plus vite que Gemma4, ce qui est important pour OpenClaw en raison des prompts de contexte généralement volumineux envoyés. Gemma4 génère la sortie légèrement plus rapidement. Pour de nombreuses utilisations d'OpenClaw, Qwen3 l'emporte en vitesse. Le développeur note que Gemma4 est un modèle 12B et pourrait produire une sortie légèrement meilleure, bien que cela n'ait pas été testé.
Le développeur exécute diverses tâches sur des modèles locaux, y compris des tâches cron, la surveillance de l'activité, l'indexation de la mémoire, et fait souvent appel à OpenClaw pour lancer des sous-agents exécutant des modèles locaux. Il teste Gemma4 comme modèle local pour toutes ces tâches en arrière-plan, mais ne s'attend pas à remarquer des différences de performance puisque celles-ci s'exécutent en arrière-plan.
📖 Read the full source: r/openclaw
👀 See Also

ClamBot : Agent IA Exécute du Code Généré par LLM dans un Bac à Sable WASM pour la Sécurité
ClamBot est un framework d'agent IA qui exécute tout code généré par LLM dans un bac à sable WebAssembly en utilisant QuickJS dans Wasmtime, éliminant le besoin d'appels exec() ou de sous-processus. Il inclut une porte d'approbation pour les appels d'outils, une mise en cache persistante des scripts sous forme de 'clams', et prend en charge plusieurs fournisseurs de LLM.

Construction et test d'un serveur MCP dans Claude Desktop : Architecture et enseignements
Un développeur partage son expérience de construction et de test d'un serveur MCP dans Claude Desktop, détaillant sa configuration d'architecture et les leçons pratiques apprises sur les schémas d'outils, le débogage et les limitations.

Kit de démarrage Next.js open source ajoute des garde-fous et des instructions d'agent pour prévenir le contenu IA générique
Un nouveau boilerplate Next.js inclut l'authentification, la base de données, l'IC, les tests et les instructions Claude Code prêts à l'emploi, destiné aux développeurs utilisant des agents de codage IA pour créer plus rapidement des applications de production.

De Replit à Local : Comment un développeur a utilisé Claude pour construire StillHere, une application de chat compagnon IA basée sur API
Un développeur a créé StillHere.ink, une application de chat IA pour des conversations de type compagnon utilisant des clés API personnelles, après être passé de Replit à un développement local avec Claude. L'application propose une mémoire, des résumés de journal, du RAG, un changement de modèle et des outils de contrôle des coûts.