CC-Canary: Detecte Regressões no Claude Code com Análise Local de JSONL

✍️ OpenClawRadar📅 Publicado: April 24, 2026🔗 Source
CC-Canary: Detecte Regressões no Claude Code com Análise Local de JSONL
Ad

CC-Canary é uma ferramenta de detecção de deriva para o Claude Code, empacotada como duas Skills de Agente instaláveis. Ela escaneia os logs de sessão em JSONL que o Claude Code já escreve em ~/.claude/projects/, detecta se o modelo tem derivado no seu próprio trabalho e produz um relatório forense compartilhável. Sem rede, sem conta, sem telemetria, sem daemon em segundo plano — executa sobre dados já no seu disco. Status: 0.x / pré-alfa.

Instalação

Instale via npx skills:

npx skills add delta-hq/cc-canary

Ou instale skills individuais:

npx skills add delta-hq/cc-canary --skill cc-canary npx skills add delta-hq/cc-canary --skill cc-canary-html

Requisitos: Python 3.8+ no PATH. macOS/Linux/WSL para abertura automática do relatório HTML (caso contrário, exibe o caminho).

Uso

Em uma sessão do Claude Code:

/cc-canary 60d /cc-canary-html 30d

A janela padrão é de 60 dias; aceita 7d, 14d, 30d, 60d, 90d, 180d.

O Que Você Obtém

  • Veredito — ESTÁVEL / SUSPEITA DE REGRESSÃO / REGRESSÃO CONFIRMADA / INCONCLUSIVO
  • Tabela de métricas principais — comparação antes vs depois com faixas verde/amarelo/vermelho
  • Barras de tendência semanal — custo (USD, verificado contra o ccusage), razão leitura:edição, loops de raciocínio, tokens/turno
  • Comparação entre versões — mesmo usuário, diferentes versões do modelo, controlando pela mistura de tarefas
  • Data de inflexão detectada automaticamente — quebra no índice de saúde composto
  • Conclusões com classificação lado do modelo / lado do usuário / ambíguo
  • Apêndices — profundidade de pensamento por hora do dia, mudança de frequência de palavras, transição de visibilidade do pensamento em três períodos, taxas de comportamento por turno
Ad

Métricas Acompanhadas

  • Razão Leitura:Edição — leituras de arquivo por edição; proxy para profundidade de investigação
  • Participação de Escrita nas Mutações — Escrita / (Edição + Escrita); alta participação = reescrever em vez de edições cirúrgicas
  • Loops de Raciocínio / 1K chamadas de ferramenta — frases como "deixe-me tentar novamente", "oh, espere", "na verdade"
  • Taxa de Frustração — taxa de palavras de frustração em seus prompts
  • Taxa de Redação de Pensamento — fração de blocos de pensamento redigidos vs visíveis
  • Comprimento Médio do Pensamento — proxy para profundidade de raciocínio
  • Turnos de API por Turno de Usuário — chamadas de API por mensagem do usuário
  • Tokens por Turno de Usuário — volume total de tokens por mensagem do usuário

Mais apêndices para parada prematura, erros auto-admitidos, vocabulário de atalho, interrupções do usuário, etc.

Como Funciona

  1. Escaneamento — Script Python (apenas stdlib) percorre ~/.claude/projects/**/*.jsonl, filtra por janela, exclui sessões de subagentes.
  2. Deduplicação — Mensagens do assistente são deduplicadas por (message.id, requestId) porque o Claude Code escreve a mesma mensagem em múltiplos JSONLs quando sessões são retomadas ou ramificadas.
  3. Agregação — Métricas por sessão: mix de ferramentas, razão leitura:edição, frases de loop de raciocínio, erros auto-admitidos, paradas prematuras, interrupções, uso de tokens, custo (taxas atuais do Claude 4.x), profundidade de pensamento por hora do dia.
  4. Detecção de inflexão — Índice de saúde composto por dia; argmax de |antes − depois| sobre datas candidatas com piso de 0,75σ. Usa divisão por mediana de timestamp se nenhuma quebra for significativa.
  5. Pré-renderização do relatório — Script escreve esqueleto markdown/HTML com todas as tabelas e gráficos de barras preenchidos. ~20 espaços narrativos deixados para Claude preencher.
  6. Preenchimento e salvamento — Claude lê o esqueleto, escreve a narrativa, salva o arquivo final. Tempo total de execução: ~2,5s script + 10–20s narrativa de Claude.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

Código aberto da pilha "the-vibe": Regras de Markdown para Manter a Consistência do Código Claude
Tools

Código aberto da pilha "the-vibe": Regras de Markdown para Manter a Consistência do Código Claude

Um desenvolvedor disponibilizou como código aberto 'the-vibe-stack' — um conjunto de regras Markdown projetado para manter o Claude Code no caminho certo durante sessões longas, impondo um esquema rígido. A abordagem visa reduzir o desvio lógico e o desperdício de tokens, garantindo uma saída previsível.

OpenClawRadar
GrapeRoot: Ferramenta de código aberto reduz o uso de tokens do Claude Code em 40-80%
Tools

GrapeRoot: Ferramenta de código aberto reduz o uso de tokens do Claude Code em 40-80%

GrapeRoot é um servidor MCP local gratuito e de código aberto que fica entre sua base de código e o Claude Code, reduzindo o uso de tokens em 40-80% ao rastrear o que o modelo já viu e enviando apenas as alterações relevantes de código.

OpenClawRadar
Operador OpenClaw Kubernetes com Suporte Embarcado Ollama
Tools

Operador OpenClaw Kubernetes com Suporte Embarcado Ollama

Um membro da comunidade criou um operador OpenClaw Kubernetes que inclui suporte embutido para Ollama, permitindo que agentes de IA sejam executados com modelos locais no mesmo namespace. A configuração inclui comandos de instalação, detalhes de configuração para modelos Ollama locais e na nuvem, e instruções de acesso ao painel.

OpenClawRadar
Ponte Claude Code para Aplicativos de Chat para Interação Remota
Tools

Ponte Claude Code para Aplicativos de Chat para Interação Remota

Um projeto do GitHub chamado cc-connect conecta o Claude Code a plataformas de mensagens como Slack e Telegram, permitindo interação remota sem expor sua máquina local. O agente é executado localmente enquanto uma pequena ponte retransmite mensagens entre o agente e os aplicativos de chat.

OpenClawRadar