SpruceChat exécute un LLM de 0,5 milliard de paramètres directement sur les consoles portables Miyoo grâce à llama.cpp.

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
SpruceChat exécute un LLM de 0,5 milliard de paramètres directement sur les consoles portables Miyoo grâce à llama.cpp.
Ad

Ce que c'est

SpruceChat est un projet qui exécute le modèle de langage Qwen2.5-0.5B entièrement sur l'appareil sur plusieurs consoles de jeu portables en utilisant llama.cpp. Il ne nécessite aucune connexion cloud ou WiFi après la configuration initiale.

Ad

Détails clés

Le modèle réside en RAM après le premier démarrage, et les tokens s'affichent un par un pendant la génération. Il fonctionne sur le Miyoo A30, le Miyoo Flip, le Trimui Brick et le Trimui Smart Pro.

Performances sur le Miyoo A30 (qui possède un processeur quadricœur Cortex-A7) :

  • Chargement du modèle : ~60 secondes au premier démarrage
  • Vitesse de génération : ~1-2 tokens par seconde
  • Évaluation de l'invite : ~3 tokens par seconde

Le développeur note que ce n'est pas rapide, mais il diffuse en continu pour que vous puissiez le voir réfléchir. Il mentionne que les appareils 64 bits sont plus rapides.

L'IA est décrite comme ayant "la personnalité d'un épicéa : patient, sans hâte, tranquillement émerveillé par tout."

Si l'appareil est connecté au WiFi, vous pouvez également accéder au serveur llama depuis un navigateur sur un téléphone ou un ordinateur portable pour discuter avec un vrai clavier.

Le dépôt se trouve à https://github.com/RED-BASE/SpruceChat. Le projet a été construit avec l'aide de Claude, et il y a déjà un collaborateur qui travaille à étendre la prise en charge des appareils. La première version est disponible avec des binaires armhf et aarch64, et le modèle est inclus.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Manifest Ajoute des Plans de Jetons MiniMax avec Prise en Charge du Modèle M2.7
Tools

Manifest Ajoute des Plans de Jetons MiniMax avec Prise en Charge du Modèle M2.7

Manifest, une couche de routage open source pour OpenClaw, prend désormais en charge les forfaits de tokens MiniMax à partir de 10 $/mois. Le nouveau modèle MiniMax M2.7 est spécialement conçu pour les flux de travail OpenClaw et obtient 62,7 sur MM-ClawBench et 56,2 sur SWE-Bench Pro.

OpenClawRadar
nah : Un garde d'autorisation contextuel pour Claude Code
Tools

nah : Un garde d'autorisation contextuel pour Claude Code

nah est un crochet PreToolUse qui intercepte chaque appel d'outil dans Claude Code, classifiant les commandes par type d'action comme filesystem_read ou git_history_rewrite et appliquant des politiques basées sur le contexte. Il exécute un classifieur déterministe en millisecondes avec une escalade LLM facultative pour les cas ambigus.

OpenClawRadar
Zoku : Un outil qui détecte automatiquement les workflows répétés dans le code Claude
Tools

Zoku : Un outil qui détecte automatiquement les workflows répétés dans le code Claude

Zoku est un outil local qui se connecte au système d'événements de Claude Code pour enregistrer les actions des outils à travers les sessions, identifie les schémas de flux de travail répétés, puis informe Claude de ces schémas afin qu'il puisse les suggérer ou les exécuter de manière proactive. Il ne nécessite aucune configuration, n'a aucune dépendance et stocke tout localement dans ~/.zoku/.

OpenClawRadar
DÉLICE : Un Orchestrateur Local Utilise Plusieurs Sessions ChatGPT en tant qu'Agents Coordonnés
Tools

DÉLICE : Un Orchestrateur Local Utilise Plusieurs Sessions ChatGPT en tant qu'Agents Coordonnés

DELIGHT est un orchestrateur local qui exécute simultanément plusieurs sessions ChatGPT cachées dans le navigateur, les coordonnant comme une équipe d'agents sans nécessiter de clés API ou de ressources GPU. Il se connecte à OpenClaw comme couche d'action pour appliquer des modifications à des fichiers réels et exécuter des tests.

OpenClawRadar