LetMeWatch: PythonプラグインがFFmpegのシーン検出を介してClaudeに動画分析機能を追加

開発者は、Claudeがネイティブで動画をサポートしていないにもかかわらず、動画コンテンツを分析できるようにするLetMeWatchというPythonプラグインを作成しました。このツールは、バグのスクリーンレコーディングをClaudeに送信して診断するという特定のユースケースに対応しています。
仕組み
このプラグインは、FFmpegのシーン検出を使用して、視覚的に実際に変化があるフレームのみを抽出します。抽出された各フレームにタイムスタンプを付け、バッチでClaudeに送信します。このアプローチは、AI動画モデルや複雑なインフラストラクチャを使用せず、フレーム抽出とClaudeの既存のマルチモーダル視覚機能を組み合わせています。
技術的な実装
- Pythonで記述(約200行のコード)
- シーン検出にFFmpegを使用
- 視覚的な変化が発生した場合のみフレームを抽出
- 各フレームにタイムスタンプを追加
- フレームをバッチでClaudeに送信
- すべてのプラットフォームで動作
- オープンソース(GitHubで公開)
実用的な応用
開発者は、todoアプリのバグを録画し、/video-lastコマンドを実行してこのツールをテストしました。Claudeは録画を見て、タイプミスがある正確な行を特定することに成功しました。これは、問題のスクリーンレコーディングをClaudeに分析させることで、デバッグにどのように使用できるかを示しています。
このプロジェクトはgithub.com/BinyaminEden/letmewatchで公開されており、既存のツールとClaudeの視覚機能を使用して、Claudeの現在の動画制限に対する実用的な回避策を提供しています。
📖 Read the full source: r/ClaudeAI
👀 See Also

Claude Code用デザインスタジオプラグイン:9つの役割と16のコマンドを備えた仮想デザインチームを追加
Design Studioという新しいClaude Codeプラグインは、9つの専門役割、16のスラッシュコマンド、5つのエージェントを備え、完全なデザインチームをシミュレートします。技術スタックを自動検出し、参照ファイルにわたって8,000行以上のデザイン知識を含んでいます。

ローカルAI画像批評ツール、Ollama Visionモデルを活用してフィードバックを提供
開発者が、Ollamaのビジョンモデルを利用してAI生成画像をローカルで分析する無料デスクトップアプリケーションを作成しました。このツールは、改善提案やプロンプトのアップグレードを含む構造化されたフィードバックレポートを提供します。

Mike: セルフホスティングとマルチモデルに対応したオープンソース法律AI
Mikeは、HarveyやLegoraに代わるオープンソースの代替品であり、ドキュメントチャット、表形式抽出、ワークフローテンプレートを提供します。すべて自己ホスティング可能で、ClaudeやGeminiのAPIキーを使用できます。

OpenClawベンチマークが示す:Qwen3.5:27B、エージェントタスクで他のローカルLLMを凌駕
OpenClawを使用した22の実践的なエージェントタスクにおける7つのローカルLLMのベンチマークで、qwen3.5:27b-q4_K_Mが59.4%を記録し、2位のqwen3.5:35bの23.2%を大きく上回りました。ほとんどのモデルはメール機能のような基本的なツールを見つけることすらできませんでした。