O limite de taxa não documentado do pool OAuth da Anthropic requer o prompt do sistema Claude Code

Um desenvolvedor que construía um proxy de LLM descobriu que o tratamento de limite de taxa da Anthropic para tokens OAuth depende do conteúdo do prompt do sistema, não dos cabeçalhos ou do tipo de token.
O problema
O desenvolvedor tinha uma configuração funcional com:
- SDK da Anthropic com authToken
- Cabeçalhos beta (claude-code-20250219, oauth-2025-04-20)
- user-agent: claude-cli/2.1.75
- x-app: cli
Haiku funcionou bem, mas Sonnet retornou persistentes erros de limite de taxa 429 sem cabeçalho retry-after, sem cabeçalhos de limite de taxa, apenas "message": "Error". Enquanto isso, um agente de IA (executando OpenClaw) no mesmo servidor com o mesmo token OAuth não teve problemas com o Sonnet 4.6.
A solução
Após examinar o código-fonte do provedor da Anthropic do OpenClaw (@mariozechner/pi-ai), o desenvolvedor encontrou este código:
// Para tokens OAuth, DEVEMOS incluir a identidade do Claude Code
if (isOAuthToken) {
params.system = [{
type: "text",
text: "You are Claude Code, Anthropic's official CLI for Claude.",
}];
}
Adicionar esta única linha ao proxy corrigiu imediatamente os erros de limite de taxa do Sonnet.
Como funciona
A API direciona as solicitações para o pool de limite de taxa do Claude Code (que é separado e maior que o pool regular da API) com base em se seu prompt do sistema se identifica como Claude Code. Este comportamento não está documentado na documentação do SDK ou da API.
Correção prática
Se você está usando tokens OAuth da Anthropic e recebendo erros 429 misteriosos, adicione "You are Claude Code, Anthropic's official CLI for Claude." ao seu prompt do sistema.
📖 Read the full source: r/ClaudeAI
👀 See Also

Dicas Úteis da Comunidade OpenClaw: Um Mergulho Profundo na Otimização de Agentes de IA
Descubra dicas valiosas da comunidade OpenClaw sobre como otimizar agentes de codificação de IA para melhor desempenho e eficiência. Essas percepções podem revolucionar seus projetos de IA.

Prevenindo o desvio de saída em longos threads do Claude ancorando respostas de alta qualidade
Um usuário descreve como as respostas do Claude pioram após 30-40 mensagens e como eles ancoram a melhor saída no meio do tópico para iniciar novas conversas.
Claude + MCP Browser: Usuários relatam acesso web turbinado
Um usuário do Claude explica como conectar o Claude a um navegador externo via MCP permitiu que ele navegasse em sites anteriormente inacessíveis, e se pergunta se o Claude pode usar os tokens de modelo do navegador.

13 Mentiras que as IAs Contam e os Prompts que Pegam Cada Uma
Um usuário do Reddit cataloga 13 tipos de enganação de IA — desde concordar com ideias ruins até trabalho pela metade — e compartilha um prompt para detectar cada um.