TextGen (text-generation-webui) wird native Desktop-App mit portablen Builds
TextGen (früher text-generation-webui, auch bekannt als oobabooga) hat eine native Desktop-App-Version veröffentlicht. Das Projekt, das seit Dezember 2022 in Entwicklung ist, bietet nun portable Builds – einfach herunterladen, entpacken und doppelklicken Sie auf textgen. Keine Installation oder Dateien außerhalb des entpackten Ordners. Alle Chatverläufe und Einstellungen befinden sich in einem gebündelten user_data-Ordner.
Hauptfunktionen
- Privatsphäre: Null ausgehende Anfragen. Im Gegensatz zu LM Studio sendet es keine Daten zu Betriebssystem, CPU, App-Version oder Backend-Auswahl nach Hause.
- ik_llama.cpp-Builds: Enthält benutzerdefinierte Quantisierungstypen wie IQ4_KS und IQ5_KS für bessere Genauigkeit im Vergleich zu vanilla llama.cpp, das von LM Studio und Ollama verwendet wird.
- Integrierte Websuche: Verwendet die
ddgs-Python-Bibliothek. Zwei Modi: Tool-Calling mit demweb_search-Tool (funktioniert mit Qwen 3.6 und Gemma 4) oder ein Kontrollkästchen, das Suchergebnisse als Textanhänge abruft. - Tool-Calling: Unterstützt Single-File-.py-Tools (einfache benutzerdefinierte Funktionen), HTTP-MCP-Server und stdio-MCP-Server. Option zur Bestätigung/Ablehnung vor der Ausführung von Tool-Aufrufen. Anleitung hier.
- Benutzerdefinierte Charaktere: Erstellen Sie Charaktere für lockere Chats neben Anweisungsgesprächen.
- API-Kompatibilität: OpenAI- und Anthropic-Spec-konforme API. Funktioniert mit Claude Code:
ANTHROPIC_BASE_URL=http://127.0.0.1:5000 claude. - PDF-Extraktion: Verwendet PyMuPDF für genaue Textextraktion.
- Webseiten-Abruf: Verwendet
trafilatura, um Navigation/Textblöcke zu entfernen und Token in agentischen Schleifen zu sparen. - Jinja2-Vorlagen: Rendert Chatvorlagen über Python Jinja2 und vermeidet Abstürze in llama.cpps C++-Jinja-Neuimplementierung.
Verfügbare Builds
CUDA, Vulkan, Nur-CPU, Mac (Apple Silicon und Intel) und ROCm. Alle portabel.
Lizenz: AGPLv3. Quelle: https://github.com/oobabooga/textgen
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude schrieb 3.000 Codezeilen, anstatt pywikibot zu importieren – eine Fallstudie darüber, wie KI-Agenten bestehende Bibliotheken ignorieren
Ein Entwickler beauftragte Claude Code (Opus 4.7) damit, Tippfehler auf Fandom-Wikis zu korrigieren. Das Modell schrieb ~3.000 Zeilen Python, die pywikibot, mwparserfromhell und RETF-Regeln neu implementierten, anstatt sie zu importieren. Der Beitrag untersucht, warum dies geschieht und wie eine zweiminütige Suche den Codebase auf 1.259 Zeilen reduzierte.

Holisto Seed: Ein lokales LLM-Framework mit persistenter Identität und konsensualer Gedächtniskonsolidierung
Holisto Seed ist ein Relationales Individuations-Framework, das LLM-Agenten eine persistente Identität, biografisches Gedächtnis und ko-evolutionäre Beziehungen zu Nutzern verleiht. Es läuft vollständig lokal mit einem Git-basierten Versionskontrollsystem und verfügt über einen konsensualen Schlafzyklus zur Gedächtniskonsolidierung.

Dynamische Statusleiste für Claude Code zeigt Live-Updates
Ein Entwickler hat seine Claude Code-Statusleiste von statischem Text zu einer dynamischen Anzeige mit Echtzeit-Updates verbessert, die zeigt, woran Claude gerade arbeitet. Die Konfiguration ist als GitHub Gist verfügbar.

Mouser: Open-Source-Alternative zu Logitech Options+ für die MX Master 3S
Mouser ist ein leichtgewichtiges, quelloffenes Tool, das die Tasten der Logitech MX Master 3S Maus neu belegt, ohne die proprietäre Software von Logitech zu benötigen. Es läuft vollständig lokal ohne Telemetrie, unterstützt anwendungsbezogene Profile und umfasst DPI-Steuerung sowie Akkuüberwachung.