CostHawk Lança Painel Público para Consumo de Tokens do Claude Code, Codex e Cursor

A CostHawk lançou um Ranking de Ferramentas de IA público que classifica usuários do Claude Code, OpenAI Codex CLI e Cursor pelo consumo total de tokens. O ranking é atualizado a cada 5 minutos e inclui detalhamentos por ferramenta, como participação de tokens, mix de operadores (ferramenta única vs. múltiplas ferramentas) e momentum diário. As temporadas mensais são reiniciadas à meia-noite, horário Central.
Contagens de tokens, identificadores de modelo, timestamps de sincronização e IDs de projeto com hash são rastreados, mas o serviço explicitamente não armazena prompts, respostas ou código-fonte. Os dados são analisados localmente a partir dos diretórios de dados das ferramentas de desenvolvedor antes de saírem da máquina, com criptografia AES-256-GCM para chaves de API. As opções de conexão incluem chaves de API Admin, chaves proxy encapsuladas ou telemetria MCP. O recurso de sincronização automática é opcional (COSTHAWK_AUTO_SYNC=true) e padrão desligado.
Conectando uma Ferramenta Local
Execute o seguinte comando em um terminal:
npm exec --yes costhawk@latest -- --loginIsso autentica a máquina e instala o servidor MCP CostHawk para Claude Code, Codex CLI, Cursor e Gemini CLI. Após a conexão, os tokens são reportados sob um identificador de projeto com hash.
O ranking atualmente não mostra atividade (tudo zerado) porque nenhum operador sincronizou ainda — o site informa “Nenhuma atividade no ranking ainda” e “CARREGANDO DADOS MOSTRANDO 0 DE 0 OPERADORES.” As classificações mensais serão preenchidas à medida que os usuários optarem pela sincronização.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Executando o Claude Code Offline em um M3 Pro com Qwen3.6: 4 Correções Que Fizeram Funcionar
Quatro correções de variáveis de ambiente fazem o Claude Code funcionar totalmente offline em um M3 Pro com Qwen3.6 (MoE, ~3B ativos), completando um ciclo de incidente de SRE desde a investigação até o PR sem que nenhum dado saia da máquina.

Hypura: Agendador de inferência de LLM com consciência de camada de armazenamento para Apple Silicon
Hypura é um agendador de inferência baseado em Rust que posiciona tensores do modelo nas camadas GPU, RAM e NVMe para executar modelos que excedem a memória física em Macs Apple Silicon. Ele permite executar um Mixtral 8x7B de 31GB em um Mac Mini de 32GB a 2,2 tok/s e um Llama 70B de 40GB a 0,3 tok/s, onde o llama.cpp padrão trava.

Observação: Uma Ferramenta de Anotação em Markdown para Fluxos de Trabalho de Código no Claude
Remark é um aplicativo nativo para macOS que permite aos desenvolvedores anotar arquivos Markdown inline para fluxos de trabalho de revisão de código do Claude. Ele exporta anotações como JSON para o agente e integra-se por meio de uma habilidade instalada no diretório .claude/skills/.

agentcache: Biblioteca Python para Cache de Prefixo de LLM Multi-Agente
agentcache é uma biblioteca Python que permite que frameworks de LLM multiagente compartilhem prefixos de prompt em cache, alcançando até 76% de taxas de acerto no cache e reduzindo o tempo de inferência pela metade em testes com GPT-4o-mini.