Erstelle einen $10 Token-Monitor für LM Studio mit einem ESP32-Display

✍️ OpenClawRadar📅 Veröffentlicht: 13. Juli 2026🔗 Source
Ad

Günstige Hardware für KI-Workflows umzufunktionieren, ist eine Hacker-Tradition. Ein Reddit-Nutzer hat gerade einen 10-Dollar-ESP32-Wetterstationsbildschirm von AliExpress in einen Live-Token-pro-Sekunde-Monitor für LM Studio verwandelt. Der Bildschirm ist ein kleiner 240×240-Pixel-Display, das normalerweise als Bitcoin-Ticker verkauft wird, aber der generische Nachbau ließ die ursprünglichen GitHub-Projekte nicht laufen. Hier kommt Codex ins Spiel: Der Nutzer bat Claude Codex (wahrscheinlich Anthropics Coding-Assistenten), eine benutzerdefinierte Firmware zu schreiben, und hatte innerhalb von 15 Minuten einen funktionierenden Token-Monitor.

Das Projekt nutzt das WLAN des ESP32, um Token-Rate-Daten von der LM-Studio-API abzurufen. Während der Beitrag den genauen Code nicht enthält, ist der Ansatz unkompliziert: Den lokalen HTTP-Endpunkt von LM Studio abfragen (normalerweise http://localhost:1234), die Token-Generierungsgeschwindigkeit parsen und auf dem kleinen runden Display anzeigen. Das Display verwendet den ST7789-Treiber über SPI, der bei diesen AliExpress-Modulen üblich ist.

Wichtige Details aus dem Beitrag:

  • Hardware: ESP32-basiertes 240×240 rundes LCD-Display (als Wetterstation/Bitcoin-Ticker verkauft) von AliExpress für ca. 10 €.
  • Firmware: Eigenentwicklung mit Codex in etwa 15 Minuten.
  • Funktion: Zeigt die Live-Token-Generierungsgeschwindigkeit (Tokens/Sekunde) von LM Studio an.
  • API-Endpunkt: LM Studio stellt die Token-Rate über seine lokale API bereit; der ESP32 fragt sie über WLAN ab.
  • Treiber: Wahrscheinlich ST7789 (üblich für 240×240-TFTs).

Der Nutzer merkt an, dass sein spezifischer Display-Nachbau die bestehenden GitHub-Projekte für diese Bildschirme nicht unterstützte – ein häufiges Problem mit generischer AliExpress-Hardware –, aber Codex die Anpassung schnell erledigte. Es wurden keine speziellen Bibliotheken über den standardmäßigen ESP32-Arduino-Core und TFT_eSPI hinaus erwähnt.

Ad

Dies ist ein nettes Wochenendprojekt für alle, die LM Studio lokal betreiben. Die gesamte Teileliste liegt unter 15 € inklusive des ESP32-Boards (obwohl viele dieser Displays den ESP32 integriert haben). Die Hauptherausforderung besteht darin, die Details des Token-Rate-Endpunkts von LM Studio zu ermitteln – überprüfen Sie die API-Dokumentation für den genauen Pfad.

Für wen es ist: Entwickler, die LM Studio lokal betreiben und ein physisches, Echtzeit-Token-Rate-Display wünschen, ohne mehr als 50 € für einen externen Monitor auszugeben.

📖 Vollständige Quelle lesen: r/LocalLLaMA

Ad

👀 Siehe auch

Kurze-Leine-KI-Coding-Methode: Fable schlagen, indem man die Kontrolle behält
Anleitungen

Kurze-Leine-KI-Coding-Methode: Fable schlagen, indem man die Kontrolle behält

Greg Slepaks Kurzleinenmethode für KI-Coding-Agenten: Planen, jede Änderung prüfen, schlechte Änderungen ablehnen, nach Unteraufgaben committen. Übertrifft Fable-Qualität, indem der Entwickler im Loop bleibt.

OpenClawRadar
Ausführen eines 1-Billionen-Parameter-LLM lokal auf einem AMD Ryzen AI Max+-Cluster
Anleitungen

Ausführen eines 1-Billionen-Parameter-LLM lokal auf einem AMD Ryzen AI Max+-Cluster

AMD demonstriert das Ausführen des Kimi K2.5 Open-Source-Modells (375 GB, 1 Billion Parameter) auf vier Framework Desktop-Systemen mit Ryzen AI Max+ 395 Prozessoren unter Verwendung von llama.cpp RPC. Die Anleitung behandelt TTM-Kernel-Modifikationen für 120 GB VRAM pro Knoten und bietet zwei Einrichtungsoptionen: vorgefertigte Lemonade SDK-Binärdateien oder manuelle ROCm 7.0.2-Installation.

OpenClawRadar
CLAUDE.md-Dateien sind oft für Entwickler strukturiert, nicht für KI-Modelle – warum das wichtig ist
Anleitungen

CLAUDE.md-Dateien sind oft für Entwickler strukturiert, nicht für KI-Modelle – warum das wichtig ist

CLAUDE.md-Dateien platzieren harte Regeln meist in Zeile 47, nach Hintergrund und Tech-Stack. Wenn das Modell die Einschränkungen liest, hat es bereits widersprüchliche Annahmen aufgebaut. Eine bessere Struktur setzt harte Regeln an den Anfang.

OpenClawRadar
SOUL.md-Regeln verändern sich in langen KI-Agenten-Sitzungen und wie man das behebt
Anleitungen

SOUL.md-Regeln verändern sich in langen KI-Agenten-Sitzungen und wie man das behebt

SOUL.md-Regeln funktionieren perfekt für die ersten 10-15 Nachrichten, beginnen aber um Nachricht 20-30 herum abzudriften, da der Gesprächskontext die ursprüngliche Systemaufforderung überschreibt. Die Lösung besteht darin, /new aggressiver zu verwenden, um Sitzungen vor jeder neuen Aufgabe zurückzusetzen.

OpenClawRadar