Benchmarks de Performance des LLM Locaux sur Mac Mini avec OpenClaw et LM Studio

Un utilisateur de Reddit a partagé des benchmarks de performance concrets pour l'exécution d'un grand modèle de langage en local sur un Mac Mini avec 32 Go de RAM. La publication aborde la rareté des données de performance spécifiques pour cette configuration matérielle.
Détails techniques de la configuration
L'utilisateur a rapporté la configuration et les résultats suivants :
- Versions logicielles : OpenClaw 2026.3.8, LM Studio 0.4.6+1
- Modèle : Unsloth gpt-oss-20b-Q4_K_S.gguf
- Taille de contexte : 26035
- Métriques de performance : 34 tokens/seconde après la première requête, 0,7 seconde de temps pour le premier token
Configuration du modèle
L'utilisateur a spécifié ces paramètres du modèle (tous par défaut) :
- Délégation GPU = 18
- Taille du pool de threads CPU = 7
- Concurrents maximum = 4
- Nombre d'experts = 4
- Attention flash = activée
La quantification Q4_K_S indique qu'il s'agit d'une version quantifiée sur 4 bits du modèle à 20 milliards de paramètres, ce qui réduit les besoins en mémoire tout en maintenant des performances raisonnables. Les 32 Go de RAM du Mac Mini sont suffisants pour cette taille de modèle avec la longueur de contexte donnée. Le débit de 34 tokens/seconde constitue un benchmark pratique pour les développeurs envisageant des configurations similaires de LLM en local sur du matériel Apple Silicon.
📖 Read the full source: r/openclaw
👀 See Also

Claude Code à l'échelle : Comment la recherche agentique évite les modes de défaillance du RAG dans les grandes bases de code
Claude Code utilise une navigation agentive du système de fichiers plutôt qu'un RAG basé sur les embeddings, éliminant les problèmes d'index obsolètes. L'article détaille cinq points d'extension (CLAUDE.md, hooks, skills, plugins, MCP) et la philosophie du harnais en tant que modèle pour les dépôts de plusieurs millions de lignes.

GoModel : Une passerelle d'IA légère et open-source écrite en Go
GoModel est une passerelle IA open-source qui fournit une API unifiée compatible OpenAI pour plusieurs fournisseurs, notamment OpenAI, Anthropic, Gemini, Groq, xAI et Ollama. Il propose une image Docker de 17 Mo, 44 fois plus légère que LiteLLM, avec une configuration priorisant les variables d'environnement et une observabilité intégrée.

Sgai : Outil de développement logiciel multi-agent axé sur les objectifs
Sgai est un outil Go open-source qui coordonne des agents d'IA pour exécuter des objectifs logiciels définis dans des fichiers GOAL.md. Il décompose les objectifs en workflows DAG, exécute des tests pour les portes de validation, et fonctionne localement avec un tableau de bord web pour le suivi.

Brunnfeld Agentic World : Simulation d'Économie Médiévale Multi-Agents Sans Invitations Comportementales
Une simulation TypeScript où 20 agents LLM négocient de manière autonome dans une économie de village médiéval sans instructions comportementales, objectifs ou stratégies commerciales. Les agents reçoivent environ 200 tokens de perceptions à chaque tick et interagissent via un moteur déterministe gérant la physique, les recettes et les mécanismes de marché.