Anthropics undokumentiertes OAuth-Rate-Limit-Pool erfordert Claude Code System-Prompt

✍️ OpenClawRadar📅 Veröffentlicht: 13. April 2026🔗 Source
Anthropics undokumentiertes OAuth-Rate-Limit-Pool erfordert Claude Code System-Prompt
Ad

Ein Entwickler, der einen LLM-Proxy baute, entdeckte, dass die Ratenlimit-Verarbeitung von Anthropic für OAuth-Tokens vom Inhalt des System-Prompts abhängt, nicht von Headern oder Tokentyp.

Das Problem

Der Entwickler hatte eine funktionierende Einrichtung mit:

  • Anthropic SDK mit authToken
  • Beta-Headern (claude-code-20250219, oauth-2025-04-20)
  • user-agent: claude-cli/2.1.75
  • x-app: cli

Haiku funktionierte einwandfrei, aber Sonnet lieferte hartnäckige 429-Ratenlimit-Fehler ohne Retry-After-Header, ohne Ratenlimit-Header, nur "message": "Error". Währenddessen hatte ein KI-Agent (der OpenClaw ausführte) auf demselben Server mit demselben OAuth-Token keine Probleme mit Sonnet 4.6.

Die Lösung

Nach der Untersuchung des Anthropic-Provider-Quellcodes von OpenClaw (@mariozechner/pi-ai) fand der Entwickler diesen Code:

// Für OAuth-Tokens MÜSSEN wir die Claude Code-Identität einbeziehen
if (isOAuthToken) {
    params.system = [{
        type: "text",
        text: "You are Claude Code, Anthropic's official CLI for Claude.",
    }];
}

Das Hinzufügen dieser einen Zeile zum Proxy behebt die Sonnet-Ratenlimit-Fehler sofort.

Ad

Wie es funktioniert

Die API leitet Anfragen basierend darauf, ob Ihr System-Prompt sich als Claude Code identifiziert, an das Claude Code-Ratenlimit-Pool weiter (das separat und höher ist als das reguläre API-Pool). Dieses Verhalten ist weder in den SDK-Dokumenten noch in den API-Dokumenten beschrieben.

Praktische Lösung

Wenn Sie Anthropic OAuth-Tokens verwenden und mysteriöse 429-Fehler erhalten, fügen Sie "You are Claude Code, Anthropic's official CLI for Claude." zu Ihrem System-Prompt hinzu.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen
Tipps

OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen

Die standardmäßige Heartbeat-Funktion von OpenClaw kann API-Budgets durch die Überprüfung von Aufgaben alle 30 Minuten und das Laden vollständiger Kontextdateien, des Speichers und des Chat-Verlaufs jedes Mal belasten. Die Quelle empfiehlt, die aktiven Stunden zu ändern, günstigere Basismodelle zu verwenden, manuell nur bei Bedarf auf Premium-Modelle umzuschalten und /new zu verwenden, um Sitzungen zurückzusetzen.

OpenClawRadar
KV-Cache-Quantisierungsprobleme bei lokalen Codierungs-Agents bei hohen Kontextlängen
Tipps

KV-Cache-Quantisierungsprobleme bei lokalen Codierungs-Agents bei hohen Kontextlängen

Eine Reddit-Analyse identifiziert aggressive KV-Cache-Quantisierung als Ursache für unendliche Korrekturschleifen und fehlerhafte JSON-Ausgaben in lokalen Coding-Agents wie Qwen3-Coder und GLM 4.7 bei Kontextlängen über 30k. Gemischte Präzision oder reduzierte Kontextgröße werden als Workarounds empfohlen.

OpenClawRadar
Arbeiteragenten sollten nicht direkt Speicher schreiben: Ein Kurator-Agent-Muster
Tipps

Arbeiteragenten sollten nicht direkt Speicher schreiben: Ein Kurator-Agent-Muster

Ein Reddit-Beitrag beschreibt ein Memory-Curator-Muster, das verhindert, dass Worker-Agenten direkt in den gemeinsamen Speicher schreiben, indem Ereignisse durch eine Validierungs- und Bereichsschicht geleitet werden.

OpenClawRadar
Reddit-Benutzer teilt Prompt-Struktur, um Code-Ausgabe-Drift von Claude bei komplexen Aufgaben zu reduzieren
Tipps

Reddit-Benutzer teilt Prompt-Struktur, um Code-Ausgabe-Drift von Claude bei komplexen Aufgaben zu reduzieren

Ein Reddit-Nutzer fand heraus, dass die Verwendung einer strukturierten Prompt-Anordnung für längere Claude Code-Aufgaben hilft, Output-Drift zu verhindern. Der Ansatz beinhaltet die Definition spezifischer Elemente wie Aufgabenumfang, benötigte Dateien, Erfolgskriterien und Vermeidungsparameter vor der Ausführung.

OpenClawRadar