Claude Code Limiter: Selbst gehosteter Ratenbegrenzer für geteilte Claude Code-Abonnements

✍️ OpenClawRadar📅 Veröffentlicht: 29. März 2026🔗 Source
Claude Code Limiter: Selbst gehosteter Ratenbegrenzer für geteilte Claude Code-Abonnements
Ad

Was es löst

Wenn mehrere Entwickler ein Claude Code Max Abonnement ohne Nutzungskontrollen teilen, kann ein einzelner Benutzer die Ratenbegrenzungen von Anthropic erschöpfen, indem er zu viele Anfragen sendet (z.B. 50 Anfragen pro Stunde), was alle anderen für den Tag aussperrt. Es gibt keine eingebaute Möglichkeit, dies zu verhindern.

Funktionen

  • Pro-Modell-Quoten — z.B. opus: 5/Tag, sonnet: 25/Tag, haiku: 50/Tag pro Benutzer
  • Kreditbudgets — Einzelnes tägliches Budget über alle Modelle hinweg (opus = 10 Credits, sonnet = 3, haiku = 1). Benutzer entscheiden, wie sie es ausgeben.
  • Gleitende 24-Stunden-Fenster — Kein Ausnutzen von Mitternacht-Resets
  • Tageszeitregeln — Teure Modelle auf Arbeitszeiten beschränken
  • Echtzeit-Dashboard — Live-Nutzungsfeed, pro-Benutzer-Aufschlüsselungen, Nutzungsdiagramme
  • Notausschalter — Sofortiger Zugriffsentzug und erzwungene Abmeldung eines Benutzers, remote
  • Manipulationssicher — 6 Sicherheitsebenen inklusive managed-settings.json-Erzwingung, Dateiberechtigungen, Integritätsprüfungs-Watchdog und serverseitiger Verfolgung

Wie es funktioniert

Einrichtung:

  1. Server selbst hosten — Einzelner Docker-Befehl auf jedem VPS, Cloud oder Ihrem Netzwerk
  2. Benutzer im Dashboard hinzufügen — Namen, Limits, Kreditbudget festlegen → Installationscode erhalten
  3. Auf jedem Rechner installieren — sudo npx @howincodes/claude-code-limiter setup --code CLM-xxx --server https://your-server
  4. Fertig — Der Hook prüft Limits bei jeder Anfrage über Claude Codes managed-settings.json (höchste Prioritätskonfiguration, kann nicht von Benutzern überschrieben werden)

Benutzererfahrung: Wenn ein Benutzer sein Limit überschreitet, sieht er: "Tägliches Opus-Limit erreicht. Heute 5/5 Anfragen verwendet. Gesamtnutzung heute: opus: 5/5 (0 übrig) sonnet: 12/25 (13 übrig) haiku: 3/50 (47 übrig) Kreditguthaben: 15/100 Wechseln Sie zu einem anderen Modell oder versuchen Sie es später erneut."

Ad

Technische Details

  • Client-Hook: Keine npm-Abhängigkeiten, nur Node.js-Built-ins. Installiert in managed-settings.json mit allowManagedHooksOnly: true, sodass Benutzer keine Umgehungshooks hinzufügen können.
  • Server: Express + SQLite + Vanilla JS Dashboard. Einzelner Docker-Container, einzelner Volume-Mount.
  • Offline-fähig: Hook speichert Limits lokal zwischen, funktioniert bei nicht erreichbarem Server, synchronisiert bei wiederhergestellter Verbindung.
  • Fail-closed: Wenn jemand die Konfigurationsdateien löscht, werden alle Anfragen blockiert (nicht erlaubt).

Links

Open Source. Selbst hostbar. MIT-Lizenz.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

GLM-5-Turbo zeigt niedrige Tool-Call-Fehlerraten in Benutzertests
Werkzeuge

GLM-5-Turbo zeigt niedrige Tool-Call-Fehlerraten in Benutzertests

Das z-ai/glm-5-turbo-Modell zeigt in Tests eine durchschnittliche Tool-Call-Fehlerrate von 0,57 %, was deutlich niedriger ist als die ~3 %-Rate von GLM-5. Ein Nutzer berichtete, es erfolgreich mit einem CLI-Tool verwendet zu haben, um einen 97.000 Wörter umfassenden Fantasy-Roman mit minimalen Problemen zu schreiben.

OpenClawRadar
Im Inneren von vLLM: Anatomie eines Hochdurchsatz-LLM-Inferenzsystems
Werkzeuge

Im Inneren von vLLM: Anatomie eines Hochdurchsatz-LLM-Inferenzsystems

Aleksa Gordić zerlegt die Kernkomponenten von vLLM: Engine, KV-Cache-Manager, Paged Attention und Continuous Batching. Behandelt fortgeschrittene Funktionen wie Chunked Prefill und disaggregiertes P/D.

OpenClawRadar
Windows-System-Tray-App zur Echtzeit-Überwachung der Claude-API-Nutzung
Werkzeuge

Windows-System-Tray-App zur Echtzeit-Überwachung der Claude-API-Nutzung

Ein Entwickler hat eine schlanke Windows-Tray-Anwendung erstellt, die die Claude-API-Kontingentnutzung in Echtzeit anzeigt, einschließlich 5-Stunden- und 7-Tage-Fenstern, heutigen Token-Zählungen und Erschöpfungsprognosen. Die App unterstützt Koreanisch, Englisch, Chinesisch und Japanisch in der Benutzeroberfläche und ist Open Source auf GitHub.

OpenClawRadar
OpenClaw CoreBrain-Plugin: Persistenter Speicher für KI-Codierungs-Agenten
Werkzeuge

OpenClaw CoreBrain-Plugin: Persistenter Speicher für KI-Codierungs-Agenten

Ein neues Plugin namens CoreBrain löst die Speicherprobleme von OpenClaw, indem es Informationen außerhalb des Kontextfensters in einem Wissensgraphen speichert und sie vor jeder Abfrage automatisch einfügt, wodurch Werkzeugaufrufe und optionale Speicheraufrufe überflüssig werden.

OpenClawRadar