Einseitige Chatbot-Oberfläche für lokal laufendes Gemma 4 26B A4B

Ein Entwickler hat eine Chatbot-Oberfläche auf einer einzelnen HTML-Seite erstellt, die für die Verwendung mit lokal laufendem Gemma 4 26B A4B konzipiert ist. Die Implementierung verbindet sich mit der API von LM Studio und bietet eine vollständige Chatbot-Oberfläche in einer einzigen HTML-Datei.
Technische Umsetzung
Das System läuft mit Gemma 4 26B A4B lokal mit einem 32K-Kontextfenster und erreicht 50-65 Token pro Sekunde. Das Modell ist auf zwei GPUs aufgeteilt: eine 7900 XT und eine 3060 Ti.
Oberflächenfunktionen
- Vollständige Streaming-Unterstützung für Echtzeit-Antworten
- Markdown-Rendering für formatierte Ausgaben
- Modellauswahl zum Wechseln zwischen verfügbaren Modellen
- Sechs Parameter-Schieberegler zur Feinabstimmung des Modellverhaltens
- Nachrichtenbearbeitung mit Verzweigungsmöglichkeiten im Verlauf
- Neugenerierungsfunktion zum Erneuern von Antworten
- Abbruch-Taste zum Stoppen der Generierung während des Streamings
- System-Prompt-Unterstützung für benutzerdefinierte Anweisungen
Entwicklungsdetails
Der Entwickler merkt an, dass Claude verwendet wurde, um zwei DOM-Fehler zu beheben, die Gemma nicht lösen konnte. Alle anderen Entwicklungsarbeiten wurden mit Gemma 4 abgeschlossen. Das Projekt ist auf GitHub zur Prüfung und Nutzung verfügbar.
Diese Art von Einzelseiten-Oberfläche ist besonders nützlich für Entwickler, die mit lokalen LLMs arbeiten und eine leichtgewichtige, anpassbare Chat-Oberfläche ohne den Aufwand komplexer Webanwendungen wünschen. Die Integration mit der API von LM Studio macht sie mit verschiedenen lokalen Modellen kompatibel, nicht nur mit Gemma.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

OpenHelm: Eine macOS-App zur Automatisierung von Claude-Code-Aufgaben
OpenHelm ist eine kostenlose, lokale macOS-Anwendung, die repetitive Claude-Coding-Aufgaben automatisiert, indem sie Jobs nach Zeitplan ausführt, Fehler automatisch wiederholt und Arbeit in Teile aufteilt, um Sitzungslimits zu vermeiden. Sie nutzt Ihr bestehendes Claude-Abonnement für LLM-Aufrufe.

TeenyApp lässt Claude Full-Stack-Websites aus einem einzigen Chat-Link erstellen und bereitstellen
TeenyApp bietet eine Live-Subdomain und ein Agent-Token, das Claude per HTTP nutzen kann, um Code zu erstellen, Migrationen durchzuführen, Authentifizierung einzurichten und direkt auf eine echte URL zu deployen – ohne den Chat zu verlassen.

ClankerRank: Ein Benchmark für KI-gestützte Programmierfähigkeiten mit Claude Haiku
Ein Entwickler hat ClankerRank erstellt, um die Kompetenz beim KI-gestützten Programmieren mithilfe von Claudes Haiku 4.5-Modell zu messen. Die Plattform stellt Nutzern identische Fehler vor, bewertet die Ausgaben mit verborgenen Testsuites und hat klare Kompetenzlücken unter Hunderten von Teilnehmern aufgezeigt.

BigNumberTheory: Ein Erfahrungsaustausch-Netzwerk für Claude-Code-Agenten
BigNumberTheory ist ein Community-Netzwerk, in dem Claude Code-Agenten Lektionen aus echten Debugging-Sitzungen teilen und empfangen. Die Einrichtung erfordert einen Befehl und ist derzeit kostenlos, mit über 700 geteilten Erfahrungen und mehr als 1.100 über das Netzwerk gelieferten Erfahrungen.