LetMeWatch: Python-Plugin fügt Claude Videoanalyse via FFmpeg-Szenenerkennung hinzu

✍️ OpenClawRadar📅 Veröffentlicht: 25. März 2026🔗 Source
LetMeWatch: Python-Plugin fügt Claude Videoanalyse via FFmpeg-Szenenerkennung hinzu
Ad

Ein Entwickler hat ein Python-Plugin namens LetMeWatch erstellt, das Claude ermöglicht, Videoinhalte zu analysieren, obwohl es keine native Videounterstützung hat. Das Tool adressiert den spezifischen Anwendungsfall, Bildschirmaufnahmen von Fehlern an Claude zur Diagnose zu senden.

So funktioniert es

Das Plugin nutzt die FFmpeg-Szenenerkennung, um nur Frames zu extrahieren, in denen sich die visuellen Inhalte tatsächlich ändern. Es versieht jeden extrahierten Frame mit einem Zeitstempel und gibt sie Claude in Batches weiter. Dieser Ansatz vermeidet die Nutzung von KI-Videomodellen oder komplexer Infrastruktur – er setzt auf Frame-Extraktion in Kombination mit Claudes bestehenden multimodalen Vision-Fähigkeiten.

Technische Umsetzung

  • In Python geschrieben (etwa 200 Codezeilen)
  • Nutzt FFmpeg zur Szenenerkennung
  • Extrahiert Frames nur bei visuellen Veränderungen
  • Fügt jedem Frame Zeitstempel hinzu
  • Sendet Frames in Batches an Claude
  • Funktioniert auf allen Plattformen
  • Open Source (verfügbar auf GitHub)
Ad

Praktische Anwendung

Der Entwickler testete das Tool, indem er einen Fehler in einer Todo-App aufzeichnete und den Befehl /video-last ausführte. Claude identifizierte erfolgreich die exakte Zeile mit dem Tippfehler durch das Anschauen der Aufnahme. Dies zeigt, wie das Tool zum Debuggen genutzt werden kann, indem Claude Bildschirmaufnahmen von Problemen analysiert.

Das Projekt ist verfügbar unter github.com/BinyaminEden/letmewatch und stellt eine praktische Lösung für Claudes derzeitige Videobeschränkungen dar, indem es bestehende Tools und Claudes Vision-Fähigkeiten nutzt.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Einführung von Lean Collab: Ein Multi-Agenten-Orchestrator für langanhaltende LLM-Aufgaben.
Werkzeuge

Einführung von Lean Collab: Ein Multi-Agenten-Orchestrator für langanhaltende LLM-Aufgaben.

Lean Collab ist ein Open-Source-Orchestrator, der entwickelt wurde, um langfristige LLM-Aufgaben mit koordinierten, parallelen Unteragenten zu verwalten.

OpenClawRadar
SOULS für KI-Agenten: Eine gemeinschaftsgetriebene Persönlichkeitsbibliothek
Werkzeuge

SOULS für KI-Agenten: Eine gemeinschaftsgetriebene Persönlichkeitsbibliothek

Ein Reddit-Nutzer hat ein Open-Source-Repository mit sorgfältig erstellten Persönlichkeitsdateien („Seelen“) für KI-Coding-Agenten erstellt. Das Repository enthält derzeit Jarvis, Gojo, Eren Yeager, René Descartes und Rapper und ruft zur Mitarbeit aus der Community auf.

OpenClawRadar
Messung des Claude Code MCP-Stacks: Cache-Freundlichkeit vs. Byte-Ersparnis und eine 2-Zeilen-Korrektur für den Prompt-Cache
Werkzeuge

Messung des Claude Code MCP-Stacks: Cache-Freundlichkeit vs. Byte-Ersparnis und eine 2-Zeilen-Korrektur für den Prompt-Cache

Greg Shevchenko benchmarkt MCP-Kompressoren und Retrieval-Schichten entlang zweier Achsen: Byte-Einsparungen und Cache-Freundlichkeit. Ein 2-Zeilen-Fix (rg-Treffer sortieren, Map-Einträge sortieren) steigert den Cache von ~0% auf 100% ohne Verlust bei den Byte-Einsparungen. Open-Source-Harness inklusive.

OpenClawRadar
Anthropics Multi-Agent-Harness-Design zur Verbesserung der Codequalität von Claude
Werkzeuge

Anthropics Multi-Agent-Harness-Design zur Verbesserung der Codequalität von Claude

Anthropics Blogbeitrag beschreibt ein Harness-Design mit mehreren Agenten, um Claudes Kontextangst und Selbstbewertungsverzerrung anzugehen, mit spezifischen Agentenrollen und Bewertungskriterien für Frontend- und Full-Stack-Entwicklung.

OpenClawRadar