oMLX introduit la mise en cache SSD KV pour Apple Silicon, réduisant les temps de réponse d'OpenClaw de 30 à 90 secondes à 5 secondes.

✍️ OpenClawRadar📅 Publié: March 7, 2026🔗 Source
oMLX introduit la mise en cache SSD KV pour Apple Silicon, réduisant les temps de réponse d'OpenClaw de 30 à 90 secondes à 5 secondes.
Ad

Ce que oMLX résout

Exécuter OpenClaw localement signifie généralement envoyer le même énorme prompt système (20 à 30k tokens couvrant les outils, compétences, contexte de l'espace de travail) à chaque requête. Bien qu'Ollama et LM Studio mettent en cache l'état KV, ils invalident tout le cache et le recalculent à partir de zéro lorsque le contexte change en milieu de session, ce qui entraîne des temps de réponse de 30 à 90 secondes.

oMLX résout ce problème en persistant les blocs de cache KV sur SSD au format safetensors. Lorsqu'un préfixe déjà vu revient, il est restauré depuis le disque au lieu d'être recalculé - cela fonctionne entre les requêtes et les redémarrages du serveur. Étant donné que le prompt système d'OpenClaw est principalement statique (seuls les horodatages et les métadonnées d'exécution changent), la mise en cache SSD signifie que seules les parties modifiées sont recalculées.

Benchmarks de performance

Testé avec Qwen3.5-122B-A10B-4bit sur M3 Ultra 512GB :

  • Benchmarks pour une seule requête :
    • Contexte de 1k : 768 tok/s de traitement du prompt, 56,6 tok/s de génération, 65,5 Go de mémoire maximale
    • Contexte de 8k : 940 tok/s de traitement du prompt, 51,4 tok/s de génération, 69,3 Go de mémoire maximale
    • Contexte de 32k : 764 tok/s de traitement du prompt, 42,4 tok/s de génération, 73,4 Go de mémoire maximale
  • Batching continu (pp1024/tg128) :
    • 1x batch : 56,6 tok/s, accélération de 1,00x
    • 2x batch : 92,1 tok/s, accélération de 1,63x
    • 4x batch : 135,1 tok/s, accélération de 2,39x
    • 8x batch : 190,2 tok/s, accélération de 3,36x
Ad

Configuration avec OpenClaw

  • Téléchargez le DMG depuis les versions et glissez-le dans Applications
  • Pointez-le vers votre répertoire de modèles (réutilise les modèles de LM Studio, pas besoin de retélécharger)
  • Ajoutez oMLX comme fournisseur personnalisé dans openclaw.json
  • Le tableau de bord web génère la configuration exacte - pas besoin de terminal

Fonctionnalités supplémentaires

  • Service multi-modèles : LLM + embedding + reranker simultanément
  • Appel d'outils pour tous les formats majeurs (JSON, Qwen, Gemma, GLM) + MCP
  • Troncature des résultats d'outils - tronque les sorties d'outils trop volumineuses
  • Compatibilité directe avec OpenAI + Anthropic /v1/messages
  • Application native macOS dans la barre de menu (pas Electron)
  • Licence Apache 2.0, 100% open source

📖 Lire la source complète : r/openclaw

Ad

👀 See Also

Destiny : Plugin Claude Code pour la divination déterministe utilisant l'astrologie classique est-asiatique
Tools

Destiny : Plugin Claude Code pour la divination déterministe utilisant l'astrologie classique est-asiatique

Destiny est un plugin Claude Code qui calcule de manière déterministe (Python) votre thème astrologique des huit caractères, le pilier du jour présent, et l'hexagramme du Yi Jing, puis utilise Claude pour générer des lectures en prose — pas d'horoscopes hallucinés par un LLM.

OpenClawRadar
Utiliser un serveur MCP pour optimiser les applications React Native avec Claude Code
Tools

Utiliser un serveur MCP pour optimiser les applications React Native avec Claude Code

Un serveur MCP diffuse en direct des données d'exécution d'une application React Native vers Claude Code, identifiant des problèmes de performance comme le battement du store Zustand et des re-rendus inutiles.

OpenClawRadar
OpenClaw Optimizer v1.18.0 publié avec alignement sur OpenClaw v2026.3.7
Tools

OpenClaw Optimizer v1.18.0 publié avec alignement sur OpenClaw v2026.3.7

La compétence OpenClaw Optimizer v1.18.0 est désormais alignée avec OpenClaw v2026.3.7, ajoutant la prise en charge de nouveaux fournisseurs d'IA, dont Google Gemini 3.1 Flash-Lite et OpenAI gpt-5.4, ainsi que de nouvelles commandes CLI comme /session idle et /usage cost.

OpenClawRadar
Mise en place de contrôles IA avec Continue pour les revues de PR sous contrôle de source
Tools

Mise en place de contrôles IA avec Continue pour les revues de PR sous contrôle de source

Continue intègre des vérifications IA directement dans votre flux de travail de demande de tirage en utilisant des fichiers markdown comme contrôles versionnés, visibles via les vérifications d'état GitHub.

OpenClawRadar