監視塔:Claude Code APIトラフィックを監視するローカルプロキシ

Watchtowerの機能
Watchtowerは、ローカルHTTPプロキシとリアルタイムWebダッシュボードを組み合わせたツールです。Claude Code(またはCodex CLI)とそのバックエンドAPI間のすべてのAPIトラフィックを傍受します。これにより、開発者はすべてのリクエスト、Server-Sent Events(SSE)ストリーム、ツール定義、システムプロンプト、トークン使用量、レート制限をリアルタイムで確認できます。
主な機能と開発動機
このツールはClaude Code自体を使用して構築されました。開発者によると、Claude Codeは通常、ユーザーメッセージごとに2〜3回のAPI呼び出しを行います:クォータチェック、トークンカウント、そして実際のストリーミングリクエストです。また、完全に異なるシステムプロンプトと小さなツールセットを持つサブエージェントを生成します。メインのシステムプロンプトだけでも20,000トークンを超えると報告されています。通常、この内部通信はユーザーには見えません。
セットアップと使用方法
インストールはnpmで行います:
npm install -g watchtower-ai && watchtower-ai
使用するには、環境変数を設定してプロキシを指定しながらClaude Codeを実行します:
ANTHROPIC_BASE_URL=http://localhost:8024 claude
ダッシュボードインターフェースはブラウザでhttp://localhost:8025に開きます。
プロジェクト詳細
プロキシサーバー、プロバイダー検出、SSE解析、ダッシュボードUIを含むプロジェクト全体がClaude Codeを使用して構築されました。MITライセンスの下でリリースされており、無料のオープンソースで、有料プランやアカウント要件はありません。
開発者は、このツールが推論トレースを確認したい開発者、トークン消費パターンを理解したい開発者、またはより優れたAIエージェントを構築するためにエージェントハーネスの仕組みを学びたい開発者にとって有用であると述べています。
📖 全文を読む: r/ClaudeAI
👀 See Also

OpenClawローカルエージェント実装:ミッドレンジハードウェア向けTurboQuantキャッシング搭載
OpenClaw向けのワンクリックアプリが、TurboQuantキャッシュとコンテキストウォーミングを活用し、MacBook Air(16GB RAM)などの中間スペックデバイスでローカルモデルを実行できるようになりました。この実装では、信頼性の高いツール呼び出しを実現するためにllama.cppにパッチを適用し、Gemma 4とQWEN 3.5で毎秒10~15トークンの処理速度を達成しています。

クロードがガーミンのBLEプロトコルをリバースエンジニアリングし、ネイティブランニングセンサーを偽装するのにどう役立ったか
開発者がClaudeを使ってGarminの非公開BLEプロトコルをリバースエンジニアリングし、ESP32をネイティブHRMストラップのように見せかけ、デュアルアイデンティティ切り替えとランニングダイナミクスのリバースエンジニアリングを実現した。
AIttache: 本番環境を破壊できない読み取り専用MCPサーバー
AIttacheは、ターミナル、サーバー、天気、Steamなど25以上の読み取り専用コネクタを備えたMCPサーバーで、物理的に何も変更できません。LLMに自律性ではなくログのコンテキストを提供するために構築されました。

Qwen2-0.5Bをllama.cppでローカルタスク自動化向けにファインチューニング
開発者は、LoRAを用いて約1000件のカスタム例でQwen2-0.5Bをファインチューニングし、llama.cpp経由でCPU上でローカル実行可能な300MBのGGUFモデルを作成しました。このモデルは自然言語タスクを受け取り、タスクタイプを検出し、CLIコマンドとホットキーを含む実行計画を生成します。