Открытая панель Grafana отслеживает затраты и использование Claude Code через OpenTelemetry

Панель Grafana для отслеживания затрат и использования Claude Code теперь доступна в открытом доступе. Созданная SRE-инженером, заметившим, что возможность сбора метрик OpenTelemetry (OTel) в Claude Code появилась незаметно, панель получает OTel-метрики в любой бэкенд, совместимый с Prometheus, включая Prometheus, VictoriaMetrics, Mimir или Thanos.
Что она показывает
- Затраты с разбивкой по модели, проекту и пользователю
- Использование токенов с течением времени
- Коэффициент попадания в кеш — важнейший рычаг для предсказуемости счетов
- Активное время, количество измененных строк кода, коммитов и PR, открытых Claude
- Разбивка решений о редактировании (принять vs. отклонить)
Пользовательские метки для группировки
Используйте OTEL_RESOURCE_ATTRIBUTES для добавления пользовательских меток и группировки данных по команде или проекту. Это упрощает отнесение затрат к конкретным командам или инициативам.
Как получить
- Статья с полным руководством по настройке: rockdarko.dev
- Прямая загрузка из Grafana Labs: Dashboard ID 25255
- Репозиторий (лицензия MIT): github.com/rockdarko/claude-code-metrics-prometheus
Вдохновленная существующей панелью Azure Application Insights для Claude Code, эта реализация ориентирована на команды, использующие стек наблюдаемости с открытым исходным кодом. Панель имеет лицензию MIT и готова к импорту в ваш экземпляр Grafana.
📖 Прочитать полный источник: r/ClaudeAI
👀 Смотрите также

re_gent: Git для ИИ-агентов кодинга – Контроль версий активности агента
re_gent — это инструмент с открытым исходным кодом, который обеспечивает контроль версий для сессий ИИ-агентов, отслеживая каждый вызов инструмента, сохраняя подсказки и различия в файлах, и предоставляя команды, такие как `rgt log`, `rgt blame` и `rgt rewind` (скоро появится).

Каркас Scaffold решает проблемы с памятью кода и рабочими процессами Claude
Scaffold — это 17-навыковый фреймворк для Claude Code, который обеспечивает постоянную память, принудительное принятие решений и контрольные точки рабочих процессов. Он использует 3-уровневую систему маршрутизации моделей для экономии токенов и может быть установлен через меню плагинов Claude Code.

Бенчмарки производительности локальных LLM на Mac Mini с OpenClaw и LM Studio
Пользователь Reddit опубликовал показатели производительности для локального запуска модели Unsloth gpt-oss-20b-Q4_K_S.gguf на Mac Mini с 32 ГБ оперативной памяти, достигнув 34 токенов в секунду с временем до первого токена 0,7 секунды с использованием OpenClaw 2026.3.8 и LM Studio 0.4.6+1.

Echo-TTS портирован на Apple Silicon с использованием MLX для нативного TTS с клонированием голоса
Echo-TTS, 2.4-миллиардная диффузионная модель преобразования текста в речь с клонированием голоса, была портирована с CUDA для нативной работы на Apple M-серии с использованием MLX. На базовом 16 ГБ Mac mini M4 создание 5-секундного клона голоса занимает около 10 секунд, а 30-секундные клоны — около 60 секунд.