Erstelle einen $10 Token-Monitor für LM Studio mit einem ESP32-Display

✍️ OpenClawRadar📅 Veröffentlicht: 13. Juli 2026🔗 Source
Ad

Günstige Hardware für KI-Workflows umzufunktionieren, ist eine Hacker-Tradition. Ein Reddit-Nutzer hat gerade einen 10-Dollar-ESP32-Wetterstationsbildschirm von AliExpress in einen Live-Token-pro-Sekunde-Monitor für LM Studio verwandelt. Der Bildschirm ist ein kleiner 240×240-Pixel-Display, das normalerweise als Bitcoin-Ticker verkauft wird, aber der generische Nachbau ließ die ursprünglichen GitHub-Projekte nicht laufen. Hier kommt Codex ins Spiel: Der Nutzer bat Claude Codex (wahrscheinlich Anthropics Coding-Assistenten), eine benutzerdefinierte Firmware zu schreiben, und hatte innerhalb von 15 Minuten einen funktionierenden Token-Monitor.

Das Projekt nutzt das WLAN des ESP32, um Token-Rate-Daten von der LM-Studio-API abzurufen. Während der Beitrag den genauen Code nicht enthält, ist der Ansatz unkompliziert: Den lokalen HTTP-Endpunkt von LM Studio abfragen (normalerweise http://localhost:1234), die Token-Generierungsgeschwindigkeit parsen und auf dem kleinen runden Display anzeigen. Das Display verwendet den ST7789-Treiber über SPI, der bei diesen AliExpress-Modulen üblich ist.

Wichtige Details aus dem Beitrag:

  • Hardware: ESP32-basiertes 240×240 rundes LCD-Display (als Wetterstation/Bitcoin-Ticker verkauft) von AliExpress für ca. 10 €.
  • Firmware: Eigenentwicklung mit Codex in etwa 15 Minuten.
  • Funktion: Zeigt die Live-Token-Generierungsgeschwindigkeit (Tokens/Sekunde) von LM Studio an.
  • API-Endpunkt: LM Studio stellt die Token-Rate über seine lokale API bereit; der ESP32 fragt sie über WLAN ab.
  • Treiber: Wahrscheinlich ST7789 (üblich für 240×240-TFTs).

Der Nutzer merkt an, dass sein spezifischer Display-Nachbau die bestehenden GitHub-Projekte für diese Bildschirme nicht unterstützte – ein häufiges Problem mit generischer AliExpress-Hardware –, aber Codex die Anpassung schnell erledigte. Es wurden keine speziellen Bibliotheken über den standardmäßigen ESP32-Arduino-Core und TFT_eSPI hinaus erwähnt.

Ad

Dies ist ein nettes Wochenendprojekt für alle, die LM Studio lokal betreiben. Die gesamte Teileliste liegt unter 15 € inklusive des ESP32-Boards (obwohl viele dieser Displays den ESP32 integriert haben). Die Hauptherausforderung besteht darin, die Details des Token-Rate-Endpunkts von LM Studio zu ermitteln – überprüfen Sie die API-Dokumentation für den genauen Pfad.

Für wen es ist: Entwickler, die LM Studio lokal betreiben und ein physisches, Echtzeit-Token-Rate-Display wünschen, ohne mehr als 50 € für einen externen Monitor auszugeben.

📖 Vollständige Quelle lesen: r/LocalLLaMA

Ad

👀 Siehe auch

Praktische Workflow-Muster für zuverlässige KI-Codierung in Mehrdatei-Projekten
Anleitungen

Praktische Workflow-Muster für zuverlässige KI-Codierung in Mehrdatei-Projekten

Ein Reddit-Nutzer teilt vier spezifische Workflow-Verbesserungen, die die Zuverlässigkeit von KI-Codierung bei Projekten mit mehreren Dateien erhöht haben: spezifikationsbasierte Starts, Aufgabenzerlegung mit Kontrollpunkten, stabile Arbeitsabläufe und signalbasierte Überprüfungen.

OpenClawRadar
OpenClaw-Einrichtung für menschliche Beteiligung bei der Browser-Automatisierung mit Docker, Chromium und noVNC
Anleitungen

OpenClaw-Einrichtung für menschliche Beteiligung bei der Browser-Automatisierung mit Docker, Chromium und noVNC

Ein Entwickler teilt sein Docker-Container-Setup, das es OpenClaw ermöglicht, CAPTCHAs und Genehmigungen während des Betriebs zu verarbeiten, indem Chromium mit noVNC für Fernzugriff verwendet wird, was etwa 300 MB RAM und 3 Sekunden Kaltstartzeit erfordert.

OpenClawRadar
Konfigurieren von OpenClaw für reibungslose Agent-zu-Agent-Kommunikation
Anleitungen

Konfigurieren von OpenClaw für reibungslose Agent-zu-Agent-Kommunikation

Ein Reddit-Nutzer teilt spezifische Konfigurationseinstellungen für OpenClaw, die Timeouts bei der Kommunikation zwischen Agenten reduzieren, einschließlich Einstellungen zur Werkzeugsichtbarkeit, Speicherdirektiven und Workarounds für die ANNOUNCE_SKIP-Einschränkung.

OpenClawRadar
Ausführen eines 1-Billionen-Parameter-LLM lokal auf einem AMD Ryzen AI Max+-Cluster
Anleitungen

Ausführen eines 1-Billionen-Parameter-LLM lokal auf einem AMD Ryzen AI Max+-Cluster

AMD demonstriert das Ausführen des Kimi K2.5 Open-Source-Modells (375 GB, 1 Billion Parameter) auf vier Framework Desktop-Systemen mit Ryzen AI Max+ 395 Prozessoren unter Verwendung von llama.cpp RPC. Die Anleitung behandelt TTM-Kernel-Modifikationen für 120 GB VRAM pro Knoten und bietet zwei Einrichtungsoptionen: vorgefertigte Lemonade SDK-Binärdateien oder manuelle ROCm 7.0.2-Installation.

OpenClawRadar