LetMeWatch: Python-Plugin fügt Claude Videoanalyse via FFmpeg-Szenenerkennung hinzu

Ein Entwickler hat ein Python-Plugin namens LetMeWatch erstellt, das Claude ermöglicht, Videoinhalte zu analysieren, obwohl es keine native Videounterstützung hat. Das Tool adressiert den spezifischen Anwendungsfall, Bildschirmaufnahmen von Fehlern an Claude zur Diagnose zu senden.
So funktioniert es
Das Plugin nutzt die FFmpeg-Szenenerkennung, um nur Frames zu extrahieren, in denen sich die visuellen Inhalte tatsächlich ändern. Es versieht jeden extrahierten Frame mit einem Zeitstempel und gibt sie Claude in Batches weiter. Dieser Ansatz vermeidet die Nutzung von KI-Videomodellen oder komplexer Infrastruktur – er setzt auf Frame-Extraktion in Kombination mit Claudes bestehenden multimodalen Vision-Fähigkeiten.
Technische Umsetzung
- In Python geschrieben (etwa 200 Codezeilen)
- Nutzt FFmpeg zur Szenenerkennung
- Extrahiert Frames nur bei visuellen Veränderungen
- Fügt jedem Frame Zeitstempel hinzu
- Sendet Frames in Batches an Claude
- Funktioniert auf allen Plattformen
- Open Source (verfügbar auf GitHub)
Praktische Anwendung
Der Entwickler testete das Tool, indem er einen Fehler in einer Todo-App aufzeichnete und den Befehl /video-last ausführte. Claude identifizierte erfolgreich die exakte Zeile mit dem Tippfehler durch das Anschauen der Aufnahme. Dies zeigt, wie das Tool zum Debuggen genutzt werden kann, indem Claude Bildschirmaufnahmen von Problemen analysiert.
Das Projekt ist verfügbar unter github.com/BinyaminEden/letmewatch und stellt eine praktische Lösung für Claudes derzeitige Videobeschränkungen dar, indem es bestehende Tools und Claudes Vision-Fähigkeiten nutzt.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Ankündigung des Flyto Indexers: Verbesserte KI-Code-Refaktorisierung mit Quellabhängigkeitsanalyse
Flyto Indexer, ein MCP-Server, erstellt ein Symbolgraph Ihrer Codebasis, der KI bei der intelligenten Code-Refaktorisierung hilft, indem er Abhängigkeiten und Aufrufstellen analysiert.

ATLAS: Open-Source-Testzeit-Berechnungspipeline für Qwen3-14B erreicht Spitzenleistung im Bereich Coding
Ein College-Student hat ATLAS entwickelt, eine Open-Source-Testzeit-Rechenpipeline, die auf Qwen3-14B basiert und 74,6 % pass@1 bei LiveCodeBench v5-Problemen erreicht, bei Stromkosten von etwa 0,004 $ pro Aufgabe. Das System ist bei komplexen Problemen langsam, bietet aber eine vergleichbare Leistung wie Spitzenmodelle wie GPT-5 (84,6 %) und Claude 4.5 Sonnet (71,4 %).

ClawProxy: Selbst gehosteter KI-Routing-Proxy mit Dashboard
ClawProxy ist ein Open-Source, selbst gehosteter Proxy, der die Verwaltung mehrerer KI-API-Schlüssel und Modelle zentralisiert. Er bietet einen einheitlichen Endpunkt, intelligente Schlüsselrotation, Provider-Fallback und Echtzeit-Protokollierung über ein React-Dashboard.

Open-Source-MCP-Server ermöglicht es KI-Agenten, L402-Zahlungen über das Lightning-Netzwerk abzuwickeln.
Ein mit FastMCP erstelltes Python-MCP-Plugin fängt HTTP-402-Zahlungserforderlich-Antworten ab, bezahlt Lightning-Network-Rechnungen und ruft Daten für KI-Agenten ab. Das Repository enthält einen lokalen Dummy-Agenten zum Testen, ohne echte Gelder auszugeben.