El grupo de límite de tasa OAuth no documentado de Anthropic requiere el mensaje del sistema Claude Code

Un desarrollador que construía un proxy de LLM descubrió que el manejo del límite de tasa de Anthropic para tokens OAuth depende del contenido del prompt del sistema, no de los encabezados o tipo de token.
El problema
El desarrollador tenía una configuración funcional con:
- SDK de Anthropic con authToken
- Encabezados beta (claude-code-20250219, oauth-2025-04-20)
- user-agent: claude-cli/2.1.75
- x-app: cli
Haiku funcionaba bien, pero Sonnet devolvía persistentes errores 429 de límite de tasa sin encabezado retry-after, sin encabezados de límite de tasa, solo "message": "Error". Mientras tanto, un agente de IA (ejecutando OpenClaw) en el mismo servidor con el mismo token OAuth no tenía problemas con Sonnet 4.6.
La solución
Después de examinar el código fuente del proveedor de Anthropic de OpenClaw (@mariozechner/pi-ai), el desarrollador encontró este código:
// Para tokens OAuth, DEBEMOS incluir la identidad de Claude Code
if (isOAuthToken) {
params.system = [{
type: "text",
text: "You are Claude Code, Anthropic's official CLI for Claude.",
}];
}
Agregar esta línea al proxy resolvió inmediatamente los errores de límite de tasa de Sonnet.
Cómo funciona
La API dirige las solicitudes al grupo de límite de tasa de Claude Code (que es separado y más alto que el grupo regular de la API) según si tu prompt del sistema se identifica como Claude Code. Este comportamiento no está documentado en la documentación del SDK ni en la de la API.
Solución práctica
Si estás usando tokens OAuth de Anthropic y recibes misteriosos errores 429, agrega "You are Claude Code, Anthropic's official CLI for Claude." a tu prompt del sistema.
📖 Read the full source: r/ClaudeAI
👀 Ver también

35 Días de Claude Code: Por Qué 3 Agentes Paralelos es el Verdadero Límite
Análisis de más de 1.800 turnos de Claude Code muestra que el cuello de botella no es el contexto, sino la capacidad humana de integración. Una fórmula simple N ≈ 1 / (fracción de tiempo esperándote) explica el límite de 3 agentes.

Habilidades del agente: Deja de escribir SOP, empieza a construir sistemas de límites
Un post en Reddit argumenta que añadir más habilidades o herramientas a un agente de IA lo hace más frágil. La solución: conjunto mínimo completo de herramientas, máxima claridad de límites.

Automatización estable del navegador OpenClaw usando depuración remota de Chrome y Playwright
Un desarrollador reporta éxito con la bandera --remote-debugging-port=9222 de Chrome y chromium.connect_over_cdp() de Playwright para mantener sesiones persistentes del navegador en OpenClaw, resolviendo problemas de desconexión con el navegador integrado y el relé de la extensión de Chrome.

Rutina de precodificación con Claude Code: 5 servidores MCP antes de escribir una línea
Un desarrollador comparte una rutina de 60-90 segundos que utiliza 5 servidores MCP (memoria, grafo de código base, búsqueda Tavily, documentación Context7) y hooks de seguridad para reducir drásticamente las alucinaciones y ediciones desperdiciadas.