LM Studio-Erweiterungen ermöglichen Web-Bildanalyse für vision-fähige LLMs.

Ein Entwickler hat Plugins für LM Studio erstellt, die visionfähigen LLMs ermöglichen, Bilder aus dem Web abzurufen und direkt innerhalb der Anwendung zu analysieren. Die Plugins funktionieren ohne MCP/APIs oder Registrierung, indem sie einfache Skripte verwenden, die mit einem Klick von der LM Studio-Website installiert werden können.
Hauptfunktionen
Das Hauptplugin "analyze-images" ermöglicht LLMs:
- Bilder aus dem Web zur Analyse abzurufen
- Tools automatisch basierend auf der Aufgabe zu verketten
- Abgerufene Bilder in kleinere Vorschaubilder für die Chat-Einbettung zu konvertieren, um Unordnung zu vermeiden
- Nach Möglichkeit hochauflösende Bilder für die Analyse zu verwenden
- Bilder in Antworten einzubetten oder Markdown-Tabellengalerien zu verwenden, wenn Benutzer mehrere Bilder anfordern
Der Entwickler hat auch bestehende Plugins aktualisiert:
- Das Duck-Duck-Go-Plugin funktioniert jetzt mit Bildern
- Das Website-Besuch-Plugin funktioniert jetzt mit Bildern
Anforderungen und Einrichtung
Um diese Plugins zu verwenden, benötigen Sie:
- Ein visionfähiges Modell (Qwen 3.5 9b oder 27b werden empfohlen)
- LM Studio mit Plugin-Unterstützung
Der Entwickler teilte spezifische Qwen 3.5-Einstellungen, die gut funktionierten:
Temperatur: 1 Top-K-Sampling: 20 Wiederholungsstrafe: 1 Präsenzstrafe: 1.9 Top-P-Sampling: 0.95 Min-P-Sampling: 0
Er bemerkte, dass die Präsenzstrafe-Einstellung bei 1.9 half, Wiederholungsprobleme zu beheben und Schleifen zu verhindern.
Der verwendete System-Prompt war: "Sie sind ein fähiger, nachdenklicher und präziser Assistent. Priorisieren Sie stets, wahrheitsgemäß, nuanciert, aufschlussreich und effizient zu sein, und passen Sie Ihre Antworten speziell auf die Bedürfnisse und Vorlieben des Benutzers an. Recherchieren Sie, bevor Sie Fragen beantworten: Verwenden Sie sowohl logisches Denken als auch Tool-Aufrufe, um eine angemessene Schlussfolgerung zu synthetisieren."
Plugin-Links
- Analyze Images plugin: https://lmstudio.ai/vadimfedenko/analyze-images
- Duck-Duck-Go reworked: https://lmstudio.ai/vadimfedenko/duck-duck-go-reworked
- Visit Website reworked: https://lmstudio.ai/vadimfedenko/visit-website-reworked
Der Entwickler teilte auch eine Jinja Prompt Template auf Pastebin, die half, Tool-Aufruffehler zu beheben.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Erstellung eines selbstaktualisierenden Schreibstil-Leitfadens für KI-unterstützte Inhalte
Ein Team, das eine Spracherkennungsplattform namens Noren entwickelt, hat einen 117-zeiligen Markdown-Stilleitfaden erstellt, der sich nach jedem veröffentlichten Beitrag selbst neu schreibt. Dabei nutzt es Claude, um Regeln durchzusetzen und KI-typische Wörter wie 'Kadenz' und 'optimieren' zu verbieten.

Claude Code vs OpenCode: Wichtige technische Unterschiede, die ein Entwickler fand
Ein Entwickler vergleicht Claude Code und OpenCode in Bezug auf Kontext, Speicher, Tool-Nutzung, Subagenten, Berechtigungen, Sicherheit und Modellflexibilität und kommt zu dem Schluss, dass Claude Code für Produktions-Repos weiterhin die Nase vorn hat.

Logira: Echtzeitüberwachung von eBPF für KI-Agenten-Ausführungen
Logira ist ein reines Beobachtungstool für die Linux-Kommandozeile, das über eBPF während KI-Agenten-Läufen Exec-, Datei- und Netzwerkereignisse aufzeichnet, mit lokaler Speicherung pro Lauf in JSONL und SQLite sowie integrierten Erkennungsregeln für Zugriffe auf Anmeldedaten, Persistenzänderungen und verdächtige Muster.

Alfred Beta startet: Vereinfachte OpenClaw-Alternative für nicht-technische Benutzer
Alfred ist ein neues Beta-Tool, das etwa 70 % der Funktionalität von OpenClaw bietet, jedoch mit deutlich reduzierter Komplexität. Es zeichnet sich durch einfache Standardeinstellungen für App-Verbindungen, Speicher, Nutzungsmodi und Infrastruktur aus, während gleichzeitig Anpassungsmöglichkeiten bestehen.