Vazamento do Código-Fonte do Claude Revela Modo Anti-Destilação, Modo Disfarçado e Detecção de Frustração

✍️ OpenClawRadar📅 Publicado: April 1, 2026🔗 Source
Vazamento do Código-Fonte do Claude Revela Modo Anti-Destilação, Modo Disfarçado e Detecção de Frustração
Ad

A Anthropic enviou acidentalmente um arquivo .map com seu pacote npm do Claude Code contendo o código-fonte completo e legível da ferramenta CLI. O pacote foi removido desde então, mas o código foi amplamente espelhado e analisado no Hacker News. Isso segue outro vazamento recente da especificação do modelo da Anthropic.

Anti-destilação: injetando ferramentas falsas para envenenar imitadores

Em claude.ts (linhas 301-313), há uma flag chamada ANTI_DISTILLATION_CC. Quando ativada, o Claude Code envia anti_distillation: ['fake_tools'] em suas requisições de API, instruindo o servidor a injetar silenciosamente definições de ferramentas isca no prompt do sistema. Isso é projetado para poluir dados de treinamento se alguém estiver gravando tráfego de API para treinar modelos concorrentes.

A ativação requer quatro condições: a flag de tempo de compilação ANTI_DISTILLATION_CC, o ponto de entrada CLI, um provedor de API próprio e a flag do GrowthBook tengu_anti_distill_fake_tool_injection retornando verdadeiro. Um proxy MITM que remove o campo anti_distillation dos corpos das requisições contornaria isso completamente. Definir a variável de ambiente CLAUDE_CODE_DISABLE_EXPERIMENTAL_BETAS para um valor verdadeiro desativa todo o mecanismo.

Um segundo mecanismo anti-destilação em betas.ts (linhas 279-298) implementa sumarização de texto do conector no lado do servidor. Quando ativado, a API armazena em buffer o texto do assistente entre chamadas de ferramentas, resume-o e retorna o resumo com uma assinatura criptográfica. Isso significa que gravações de tráfego de API capturariam apenas resumos, não cadeias completas de raciocínio.

Ad

Modo secreto: IA que esconde sua IA

O arquivo undercover.ts implementa um modo que remove todos os vestígios de elementos internos da Anthropic quando o Claude Code é usado em repositórios não internos. Ele instrui o modelo a nunca mencionar codinomes internos como "Capybara" ou "Tengu", canais internos do Slack, nomes de repositórios ou a própria frase "Claude Code". A linha 15 afirma: "NÃO há força-OFF. Isso protege contra vazamentos de codinomes do modelo."

Você pode forçá-lo a LIGAR com CLAUDE_CODE_UNDERCOVER=1, mas não há como forçá-lo a DESLIGAR. Em builds externos, toda a função é eliminada como código morto para retornos triviais. Isso significa que commits e PRs de autoria de IA de funcionários da Anthropic em projetos de código aberto não terão nenhuma indicação de que uma IA os escreveu.

Detecção de frustração via regex

userPromptKeywords.ts contém um padrão regex que detecta frustração do usuário: /\b(wtf|wth|ffs|omfg|shit(ty|tiest)?|dumbass|horribl (incompleto na fonte). Isso sugere que o sistema tenta identificar usuários frustrados através de correspondência de palavras-chave.

Outras descobertas

  • Atestação de cliente nativo abaixo do runtime JS
  • 250.000 chamadas de API desperdiçadas por dia
  • KAIROS: um modo de agente autônomo não lançado

O vazamento ocorreu apenas dez dias após a Anthropic enviar ameaças legais à OpenCode, forçando-os a remover a autenticação do Claude integrada porque ferramentas de terceiros estavam usando as APIs internas do Claude Code para acessar o Opus com taxas de assinatura em vez de preços por token.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

🦀
News

Claude Code v2.1.207: Modo Automático GA, Correção de Congelamento do Terminal e Reforço de Segurança

O modo auto agora está estável sem necessidade de opt-in no Bedrock/Vertex/Foundry. Corrige congelamento do terminal em saídas longas, injeção de shell em plugins e mais.

OpenClawRadar
🦀
News

Assistente Canvas LMS via OpenClaw e Composio

Um usuário do Reddit compartilhou como construiu um assistente para Canvas LMS usando OpenClaw e Composio CLI. O bot tem acesso a três cursos e pode executar tarefas como gerar um arquivo Excel dos alunos matriculados, verificar links quebrados e identificar quais alunos não visualizaram as páginas obrigatórias. Não é apenas responder perguntas—ele faz o trabalho.

OpenClawRadar
Assinantes da UE relatam limites não divulgados de uso do Claude Pro – Possível violação da lei do consumidor
News

Assinantes da UE relatam limites não divulgados de uso do Claude Pro – Possível violação da lei do consumidor

Uma postagem no Reddit detalha como o marketing do Claude Pro promete 'sem limites', mas usuários da UE enfrentam cobranças extras e limites de sessão não divulgados, possivelmente violando as diretivas de consumo da UE.

OpenClawRadar
Bug do Plugin Claude Code Telegram: Notificações MCP Descartadas Silenciosamente — Solução via Polling de Arquivos e Injeção no tmux
News

Bug do Plugin Claude Code Telegram: Notificações MCP Descartadas Silenciosamente — Solução via Polling de Arquivos e Injeção no tmux

Um plugin do Telegram para o Claude Code funciona corretamente, mas as mensagens de entrada são descartadas silenciosamente porque o Claude Code ignora notificações MCP no transporte stdio. Uma solução alternativa usa polling de arquivo e tmux send-keys com latência de ~5-9s.

OpenClawRadar