Construisez un moniteur de jetons à 10 $ pour LM Studio à l'aide d'un écran ESP32
Le détournement de matériel bon marché pour les workflows IA est une tradition chez les hackers. Un utilisateur de Reddit vient de transformer un écran de station météo ESP32 à 10 $ d'AliExpress en moniteur de tokens par seconde en direct pour LM Studio. L'écran est un petit écran de 240×240 pixels généralement vendu comme ticker Bitcoin, mais le clone générique ne pouvait pas exécuter les projets GitHub originaux. Entrez Codex : l'utilisateur a demandé à Claude Codex (probablement l'assistant de codage d'Anthropic) d'écrire un firmware personnalisé, et en 15 minutes, il disposait d'un moniteur de tokens fonctionnel.
Le projet repose sur le WiFi de l'ESP32 pour récupérer les données de taux de tokens depuis l'API de LM Studio. Bien que le post n'inclue pas le code exact, l'approche est simple : interroger le point de terminaison HTTP local de LM Studio (généralement http://localhost:1234), analyser la vitesse de génération des tokens et l'afficher sur le petit écran rond. L'écran utilise le driver ST7789 via SPI, commun parmi ces modules AliExpress.
Détails clés du post :
- Matériel : écran LCD rond 240×240 basé sur ESP32 (vendu comme station météo / ticker Bitcoin) d'AliExpress pour ~10 $.
- Firmware : écrit sur mesure avec Codex en environ 15 minutes.
- Fonction : affiche la vitesse de génération de tokens en direct (tokens/seconde) depuis LM Studio.
- Point de terminaison API : LM Studio expose le taux de tokens via son API locale ; l'ESP32 l'interroge via WiFi.
- Driver : probablement ST7789 (courant pour les TFT 240×240).
L'utilisateur note que son clone d'écran spécifique ne supportait pas les projets GitHub existants pour ces écrans — un problème courant avec le matériel générique d'AliExpress — mais Codex a rapidement géré l'adaptation. Aucune bibliothèque spéciale au-delà du noyau Arduino ESP32 standard et de TFT_eSPI n'a été mentionnée.
C'est un projet de week-end sympa pour tous ceux qui utilisent LM Studio localement. Le coût total de la nomenclature est inférieur à 15 $, y compris la carte ESP32 (bien que beaucoup de ces écrans aient l'ESP32 intégré). Le principal défi est d'obtenir les détails du point de terminaison du taux de tokens depuis LM Studio — consultez sa documentation API pour le chemin exact.
À qui cela s'adresse : aux développeurs utilisant LM Studio localement qui souhaitent un affichage physique en temps réel du taux de tokens sans dépenser plus de 50 $ pour un moniteur externe.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Évaluation du chatbot RAG : comment un balayage de modèle + des correctifs de récupération ont réduit les coûts de 79 % et amélioré la qualité de 19 %
Un développeur a évalué un chatbot RAG de support client et a découvert des erreurs de configuration de la récupération, des défauts dans l'évaluateur heuristique, ainsi qu'un modèle moins cher qui surpassait celui en production. La qualité est passée de 6,62 à 7,88 tandis que le coût par session a chuté de 0,002420 $ à 0,000509 $.

Cinq problèmes courants de configuration d'OpenClaw qui augmentent les coûts des API
Un post Reddit identifie cinq problèmes de configuration dans les installations OpenClaw qui entraînent une consommation excessive de crédits API, notamment l'utilisation de modèles coûteux pour des tâches routinières, l'absence de limites budgétaires, des passerelles ouvertes, une mémoire non gérée et des compétences non vérifiées.

Les modèles Qwen3.x échouent silencieusement dans OpenClaw en raison d'une incompatibilité du format de sortie en streaming.
Les modèles Qwen3.x en mode streaming envoient leur sortie vers le champ 'reasoning' au lieu de 'content', ce qui fait qu'OpenClaw passe silencieusement aux modèles de secours. Un proxy qui traduit les formats d'API et injecte 'think: false' résout le problème, permettant une évaluation complète des appels d'outils.

Comment un agent inactif brûlait 50 millions de jetons par jour – et comment y remédier
Un agent OpenClaw inactif brûlait 50 millions de tokens par jour à cause de pings de heartbeat avec une session gonflée. Un utilisateur de Reddit explique comment il a tracé la fuite et l'a corrigée avec des changements de configuration.