LM Studio-Erweiterungen ermöglichen Web-Bildanalyse für vision-fähige LLMs.

Ein Entwickler hat Plugins für LM Studio erstellt, die visionfähigen LLMs ermöglichen, Bilder aus dem Web abzurufen und direkt innerhalb der Anwendung zu analysieren. Die Plugins funktionieren ohne MCP/APIs oder Registrierung, indem sie einfache Skripte verwenden, die mit einem Klick von der LM Studio-Website installiert werden können.
Hauptfunktionen
Das Hauptplugin "analyze-images" ermöglicht LLMs:
- Bilder aus dem Web zur Analyse abzurufen
- Tools automatisch basierend auf der Aufgabe zu verketten
- Abgerufene Bilder in kleinere Vorschaubilder für die Chat-Einbettung zu konvertieren, um Unordnung zu vermeiden
- Nach Möglichkeit hochauflösende Bilder für die Analyse zu verwenden
- Bilder in Antworten einzubetten oder Markdown-Tabellengalerien zu verwenden, wenn Benutzer mehrere Bilder anfordern
Der Entwickler hat auch bestehende Plugins aktualisiert:
- Das Duck-Duck-Go-Plugin funktioniert jetzt mit Bildern
- Das Website-Besuch-Plugin funktioniert jetzt mit Bildern
Anforderungen und Einrichtung
Um diese Plugins zu verwenden, benötigen Sie:
- Ein visionfähiges Modell (Qwen 3.5 9b oder 27b werden empfohlen)
- LM Studio mit Plugin-Unterstützung
Der Entwickler teilte spezifische Qwen 3.5-Einstellungen, die gut funktionierten:
Temperatur: 1 Top-K-Sampling: 20 Wiederholungsstrafe: 1 Präsenzstrafe: 1.9 Top-P-Sampling: 0.95 Min-P-Sampling: 0
Er bemerkte, dass die Präsenzstrafe-Einstellung bei 1.9 half, Wiederholungsprobleme zu beheben und Schleifen zu verhindern.
Der verwendete System-Prompt war: "Sie sind ein fähiger, nachdenklicher und präziser Assistent. Priorisieren Sie stets, wahrheitsgemäß, nuanciert, aufschlussreich und effizient zu sein, und passen Sie Ihre Antworten speziell auf die Bedürfnisse und Vorlieben des Benutzers an. Recherchieren Sie, bevor Sie Fragen beantworten: Verwenden Sie sowohl logisches Denken als auch Tool-Aufrufe, um eine angemessene Schlussfolgerung zu synthetisieren."
Plugin-Links
- Analyze Images plugin: https://lmstudio.ai/vadimfedenko/analyze-images
- Duck-Duck-Go reworked: https://lmstudio.ai/vadimfedenko/duck-duck-go-reworked
- Visit Website reworked: https://lmstudio.ai/vadimfedenko/visit-website-reworked
Der Entwickler teilte auch eine Jinja Prompt Template auf Pastebin, die half, Tool-Aufruffehler zu beheben.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Entwickler baut LibraHQ-App, um Speicherproblem von KI-Agenten zu lösen
Ein Entwickler hat LibraHQ erstellt, eine kostenlose Notizen-App, die als gemeinsame Gedächtnisschicht zwischen Chatbots und Coding-Agents dient. Die App zeichnet wichtige Notizen und Entscheidungen aus Chats auf und speichert sie für zukünftige Sitzungen, um das Problem zu lösen, dass KI-Agents zuvor getroffene Entscheidungen vergessen.

Axe: Ein 12-MB-CLI für Single-Purpose-LLM-Agenten
Axe ist eine schlanke Go-Binärdatei, die fokussierte KI-Agenten ausführt, die in TOML-Dateien definiert sind. Es behandelt Agenten wie Unix-Programme und unterstützt stdin-Piping, Sub-Agenten-Delegation und Multi-Provider-LLM-Integration.

Relay erlaubt Claude Code-Sitzungen, sich gegenseitig Nachrichten zu senden, ohne Alt-Tab zu verwenden
Ein Plugin namens Relay nutzt die Kanalfunktion von Claude Code, um parallele Sitzungen direkt kommunizieren zu lassen, sodass man nicht mehr manuell Kontext zwischen Backend- und Frontend-Repos kopieren und einfügen muss.

tmux-claude: Überwachen Sie Claude-Code-Instanzen über Tmux-Fenster hinweg
tmux-claude ist ein Tool, das eine Live-Überwachung für Claude Code-Instanzen innerhalb von tmux-Sitzungen hinzufügt. Es bietet eine Statusleiste, ein interaktives Dashboard, einen erweiterten Fensterauswähler und Desktop-Benachrichtigungen, indem es lokale Sitzungsdateien ohne API-Aufrufe liest.