Lokales KI-Bildkritik-Tool nutzt Ollama Vision-Modelle für Feedback

Ein Entwickler hat eine kostenlose Desktop-Anwendung veröffentlicht, die KI-Bildkritik mit lokalen Vision-Modellen über Ollama bietet. Das Tool analysiert KI-generierte Bilder und erstellt strukturierte Feedback-Berichte, ohne Cloud-Dienste zu benötigen.
Hauptfunktionen
- Läuft zu 100 % lokal mit Ollama-Vision-Modellen
- Verwendet standardmäßig llama3.2-vision, kann aber auf andere Vision-Modelle umgestellt werden
- Erstellt übersichtliche Berichte mit spezifischen Abschnitten
- Funktioniert sowohl mit Flux/SD3 Anime-Stil-Generierungen als auch mit fotorealistischen Bildern
Berichtsstruktur
- Was gut aussieht - Positive Aspekte des Bildes
- Was verbessert werden könnte - Bereiche, die Verbesserung benötigen
- Schnellbewertungen - Bewertungen für Anatomie, Farbharmonie und Stimmung
- Gesamtbewertung - Mit Begründung für die Einschätzung
- Prompt-Optimierungsvorschlag - Spezifische Formulierungen, die zu Prompts hinzugefügt werden können, um bessere nächste Generationen zu erhalten
Anforderungen
Das Tool erfordert, dass Ollama bereits installiert ist und ein Vision-Modell geladen wurde. Der Entwickler weist darauf hin, dass dieses Tool nicht für Sie geeignet ist, wenn Sie Ollama nicht eingerichtet haben.
Aktueller Status und Feedback-Anfrage
Der Entwickler hat Screenshots der Anwendungsoberfläche und zwei Beispielanalysen geteilt. Er sucht Feedback von Nutzern, die tatsächlich mit Vision-Modellen arbeiten, und fragt, welche zusätzlichen Funktionen nützlich wären. Genannte mögliche Verbesserungen umfassen mehr Bewertungskategorien, Stapelverarbeitungsfähigkeiten und verschiedene Fokusoptionen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

ZSE: Open-Source-LLM-Inferenz-Engine mit 3,9-Sekunden-Kaltstarts
ZSE ist eine Open-Source-Inferenz-Engine für LLMs, die den Speicherbedarf für 32B-Modelle von 64GB auf 19,3GB VRAM reduziert und mit einem vorquantisierten .zse-Format und speichergemappten Gewichten Kaltstarts von 3,9 Sekunden für 7B-Modelle erreicht.

Statespace: Erstellen Sie interaktive Web-Apps für OpenClaw-Agenten mit Markdown
Statespace ist ein kostenloses, quelloffenes Framework zum Erstellen und Teilen von KI-freundlichen Web-Apps, die OpenClaw-Agenten mit reinem Markdown navigieren und bedienen können. Es ermöglicht Ihnen, Werkzeuge, Komponenten und Anweisungen in Markdown-Dateien zu definieren, auf die Agenten über HTTP zugreifen.

Mein OpenClaw Bekam einen Physischen Körper: Roboterhund mit Augen, Beinen und Stimme

Workaround für die ChatGPT-Projektmigrationslücke: Exportskripte und Prompts
Ein Entwickler hat Python-Skripte und Claude-Prompts erstellt, um Konversationen von ChatGPT zu Claude zu migrieren, wenn der Datenexport von ChatGPT keine Projektmitgliedschaftsinformationen enthält. Die Lösung extrahiert Konversationen anhand von Titeln, die aus der Oberfläche erfasst wurden.