Einseitige Chatbot-Oberfläche für lokal laufendes Gemma 4 26B A4B

✍️ OpenClawRadar📅 Veröffentlicht: 21. April 2026🔗 Source
Einseitige Chatbot-Oberfläche für lokal laufendes Gemma 4 26B A4B
Ad

Ein Entwickler hat eine Chatbot-Oberfläche auf einer einzelnen HTML-Seite erstellt, die für die Verwendung mit lokal laufendem Gemma 4 26B A4B konzipiert ist. Die Implementierung verbindet sich mit der API von LM Studio und bietet eine vollständige Chatbot-Oberfläche in einer einzigen HTML-Datei.

Technische Umsetzung

Das System läuft mit Gemma 4 26B A4B lokal mit einem 32K-Kontextfenster und erreicht 50-65 Token pro Sekunde. Das Modell ist auf zwei GPUs aufgeteilt: eine 7900 XT und eine 3060 Ti.

Oberflächenfunktionen

  • Vollständige Streaming-Unterstützung für Echtzeit-Antworten
  • Markdown-Rendering für formatierte Ausgaben
  • Modellauswahl zum Wechseln zwischen verfügbaren Modellen
  • Sechs Parameter-Schieberegler zur Feinabstimmung des Modellverhaltens
  • Nachrichtenbearbeitung mit Verzweigungsmöglichkeiten im Verlauf
  • Neugenerierungsfunktion zum Erneuern von Antworten
  • Abbruch-Taste zum Stoppen der Generierung während des Streamings
  • System-Prompt-Unterstützung für benutzerdefinierte Anweisungen
Ad

Entwicklungsdetails

Der Entwickler merkt an, dass Claude verwendet wurde, um zwei DOM-Fehler zu beheben, die Gemma nicht lösen konnte. Alle anderen Entwicklungsarbeiten wurden mit Gemma 4 abgeschlossen. Das Projekt ist auf GitHub zur Prüfung und Nutzung verfügbar.

Diese Art von Einzelseiten-Oberfläche ist besonders nützlich für Entwickler, die mit lokalen LLMs arbeiten und eine leichtgewichtige, anpassbare Chat-Oberfläche ohne den Aufwand komplexer Webanwendungen wünschen. Die Integration mit der API von LM Studio macht sie mit verschiedenen lokalen Modellen kompatibel, nicht nur mit Gemma.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

OpenHelm: Eine macOS-App zur Automatisierung von Claude-Code-Aufgaben
Werkzeuge

OpenHelm: Eine macOS-App zur Automatisierung von Claude-Code-Aufgaben

OpenHelm ist eine kostenlose, lokale macOS-Anwendung, die repetitive Claude-Coding-Aufgaben automatisiert, indem sie Jobs nach Zeitplan ausführt, Fehler automatisch wiederholt und Arbeit in Teile aufteilt, um Sitzungslimits zu vermeiden. Sie nutzt Ihr bestehendes Claude-Abonnement für LLM-Aufrufe.

OpenClawRadar
TeenyApp lässt Claude Full-Stack-Websites aus einem einzigen Chat-Link erstellen und bereitstellen
Werkzeuge

TeenyApp lässt Claude Full-Stack-Websites aus einem einzigen Chat-Link erstellen und bereitstellen

TeenyApp bietet eine Live-Subdomain und ein Agent-Token, das Claude per HTTP nutzen kann, um Code zu erstellen, Migrationen durchzuführen, Authentifizierung einzurichten und direkt auf eine echte URL zu deployen – ohne den Chat zu verlassen.

OpenClawRadar
ClankerRank: Ein Benchmark für KI-gestützte Programmierfähigkeiten mit Claude Haiku
Werkzeuge

ClankerRank: Ein Benchmark für KI-gestützte Programmierfähigkeiten mit Claude Haiku

Ein Entwickler hat ClankerRank erstellt, um die Kompetenz beim KI-gestützten Programmieren mithilfe von Claudes Haiku 4.5-Modell zu messen. Die Plattform stellt Nutzern identische Fehler vor, bewertet die Ausgaben mit verborgenen Testsuites und hat klare Kompetenzlücken unter Hunderten von Teilnehmern aufgezeigt.

OpenClawRadar
BigNumberTheory: Ein Erfahrungsaustausch-Netzwerk für Claude-Code-Agenten
Werkzeuge

BigNumberTheory: Ein Erfahrungsaustausch-Netzwerk für Claude-Code-Agenten

BigNumberTheory ist ein Community-Netzwerk, in dem Claude Code-Agenten Lektionen aus echten Debugging-Sitzungen teilen und empfangen. Die Einrichtung erfordert einen Befehl und ist derzeit kostenlos, mit über 700 geteilten Erfahrungen und mehr als 1.100 über das Netzwerk gelieferten Erfahrungen.

OpenClawRadar