Monitor de Tokens de IA: Ferramenta macOS Rastreia Uso e Custo Local do Claude

AI Token Monitor: Monitoramento Local do Uso do Claude
Um desenvolvedor criou o AI Token Monitor, um aplicativo da barra de menus do macOS que monitora o uso do Claude AI lendo arquivos de sessão locais. A ferramenta fornece rastreamento em tempo real sem exigir chaves de API ou acesso à conta.
Como Funciona
O aplicativo lê arquivos de sessão locais do Claude armazenados em ~/.claude/projects/**/*.jsonl. Todos os dados permanecem na máquina do usuário, sem informações enviadas para servidores externos, exceto por um recurso opcional de classificação (opt-in) que compartilha apenas estatísticas diárias agregadas—nenhum código ou conversas.
Resultados do Rastreamento de Um Usuário
Após 35 dias de rastreamento:
- 6,5 milhões de tokens consumidos—equivalente a US$ 4.924 no preço da API
- Média de 304 mil tokens por dia em mais de 1.000 mensagens
- Distribuição de modelos: 78% Opus 4.6, 21% Haiku 4.5, 1% Sonnet 4.6
- Dia de pico: 4 de março com 698 mil tokens
Recursos Disponíveis
- Exibição do equivalente de custo em tempo real na barra de menus
- Tendências de uso diárias, semanais e mensais
- Análise de uso por modelo
- Mapa de calor de atividade no estilo GitHub
- Rastreamento da taxa de acertos no cache (para análise de eficiência de prompts)
- Classificação opcional para comparar uso com outros
Insights Obtidos com o Rastreamento
O desenvolvedor descobriu:
- Uso do Haiku maior que o esperado, com leituras significativas do cache
- Os dias mais produtivos não correlacionaram com o maior uso de tokens
- Padrões de uso entre dias da semana e fins de semana diferiram substancialmente
Disponibilidade e Feedback
A ferramenta é de código aberto sob licença MIT e atualmente disponível apenas para macOS Apple Silicon via download .dmg. O desenvolvedor está buscando feedback sobre estatísticas adicionais úteis, interesse em uma versão para Windows e experiências com o recurso de classificação.
📖 Read the full source: r/ClaudeAI
👀 See Also

Referência: Gemma4 12B vs Qwen3 8B quantizado em Mac Mini de 24GB
Um desenvolvedor testou o Gemma4 12B contra o Qwen3:8b-q4_K_M em um Mac Mini de 24GB usando dois prompts. O Qwen3 processou os prompts 4-5x mais rápido, enquanto o Gemma4 gerou a saída um pouco mais rápido.

Desenvolvedor constrói servidor MCP conectando 18 ferramentas de e-commerce ao Claude
Um desenvolvedor criou um servidor MCP que integra 18 plataformas e ferramentas de e-commerce com o Claude, permitindo consultas que cruzam dados de múltiplas fontes. O projeto foi construído principalmente usando Claude Code (Opus) em dias, em vez de meses.

Problemas no Fluxo de Trabalho Multiagente do OpenClaw: Paralisações, Perda de Contexto e Ineficiência de Tokens
Um desenvolvedor relata que fluxos de trabalho multiagente do OpenClaw frequentemente travam com agentes paralisados, sofrem vazamento de contexto apesar da documentação personalizada e consomem tokens excessivos sem gerar saída. A configuração usou modelos Gemini 3 Pro/Codex com um orquestrador COO e agentes de tarefas especializados.

Reddit MCP Personalizado para Claude Desktop/Código Compartilhado no GitHub
Um desenvolvedor lançou um MCP do Reddit personalizado projetado para Claude Desktop e Claude Code para integrar a pesquisa do Reddit diretamente no fluxo de trabalho. A ferramenta está documentada no GitHub e disponível para uso gratuito.