Claude Code Limiter: Selbst gehosteter Ratenbegrenzer für geteilte Claude Code-Abonnements

Was es löst
Wenn mehrere Entwickler ein Claude Code Max Abonnement ohne Nutzungskontrollen teilen, kann ein einzelner Benutzer die Ratenbegrenzungen von Anthropic erschöpfen, indem er zu viele Anfragen sendet (z.B. 50 Anfragen pro Stunde), was alle anderen für den Tag aussperrt. Es gibt keine eingebaute Möglichkeit, dies zu verhindern.
Funktionen
- Pro-Modell-Quoten — z.B. opus: 5/Tag, sonnet: 25/Tag, haiku: 50/Tag pro Benutzer
- Kreditbudgets — Einzelnes tägliches Budget über alle Modelle hinweg (opus = 10 Credits, sonnet = 3, haiku = 1). Benutzer entscheiden, wie sie es ausgeben.
- Gleitende 24-Stunden-Fenster — Kein Ausnutzen von Mitternacht-Resets
- Tageszeitregeln — Teure Modelle auf Arbeitszeiten beschränken
- Echtzeit-Dashboard — Live-Nutzungsfeed, pro-Benutzer-Aufschlüsselungen, Nutzungsdiagramme
- Notausschalter — Sofortiger Zugriffsentzug und erzwungene Abmeldung eines Benutzers, remote
- Manipulationssicher — 6 Sicherheitsebenen inklusive managed-settings.json-Erzwingung, Dateiberechtigungen, Integritätsprüfungs-Watchdog und serverseitiger Verfolgung
Wie es funktioniert
Einrichtung:
- Server selbst hosten — Einzelner Docker-Befehl auf jedem VPS, Cloud oder Ihrem Netzwerk
- Benutzer im Dashboard hinzufügen — Namen, Limits, Kreditbudget festlegen → Installationscode erhalten
- Auf jedem Rechner installieren —
sudo npx @howincodes/claude-code-limiter setup --code CLM-xxx --server https://your-server - Fertig — Der Hook prüft Limits bei jeder Anfrage über Claude Codes managed-settings.json (höchste Prioritätskonfiguration, kann nicht von Benutzern überschrieben werden)
Benutzererfahrung: Wenn ein Benutzer sein Limit überschreitet, sieht er: "Tägliches Opus-Limit erreicht. Heute 5/5 Anfragen verwendet. Gesamtnutzung heute: opus: 5/5 (0 übrig) sonnet: 12/25 (13 übrig) haiku: 3/50 (47 übrig) Kreditguthaben: 15/100 Wechseln Sie zu einem anderen Modell oder versuchen Sie es später erneut."
Technische Details
- Client-Hook: Keine npm-Abhängigkeiten, nur Node.js-Built-ins. Installiert in managed-settings.json mit
allowManagedHooksOnly: true, sodass Benutzer keine Umgehungshooks hinzufügen können. - Server: Express + SQLite + Vanilla JS Dashboard. Einzelner Docker-Container, einzelner Volume-Mount.
- Offline-fähig: Hook speichert Limits lokal zwischen, funktioniert bei nicht erreichbarem Server, synchronisiert bei wiederhergestellter Verbindung.
- Fail-closed: Wenn jemand die Konfigurationsdateien löscht, werden alle Anfragen blockiert (nicht erlaubt).
Links
- GitHub: github.com/howincodes/claude-code-limiter
- npm (client): @howincodes/claude-code-limiter
- npm (server): @howincodes/claude-code-limiter-server
- Docker: ghcr.io/howincodes/claude-code-limiter:latest
Open Source. Selbst hostbar. MIT-Lizenz.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Fähigkeiten-Ersteller-Tool für OpenClaw hilft Entwicklern, Workflows zu verpacken
Ein Entwickler hat eine Fähigkeit namens skills-creator erstellt, die Nutzer durch die Erstellung qualitativ hochwertiger Fähigkeiten für OpenClaw führt und häufige Fallstricke wie vage Beschreibungen und dokumentationsähnliche Anleitungen adressiert. Sie ist auf ClawHub verfügbar und bietet einen designgetriebenen Ansatz mit Beschreibungsformeln, Checklisten und Komplexitätsstufen.

Dual DGX Sparks vs. Mac Studio M3 Ultra: Praktischer Vergleich für den lokalen Betrieb von Qwen3.5 397B
Ein Entwickler verglich das lokale Ausführen von Qwen3.5 397B auf einem 10.000 US-Dollar teuren Mac Studio M3 Ultra 512GB und einem 10.000 US-Dollar teuren Dual-DGX-Spark-Setup. Das Mac Studio erreichte 30–40 Tok/s mit 800 GB/s Bandbreite, aber langsamer Vorauffüllung, während die Sparks 27–28 Tok/s mit schnellerer Rechenleistung, aber komplexer Einrichtung lieferten.

PinchBench-Ergebnisse: Erster OpenClaw-spezifischer Benchmark für KI-Codierungsagenten
Der erste OpenClaw-spezifische Benchmark, PinchBench, bewertet 32 KI-Modelle nach Erfolgsquote, Kosten und Geschwindigkeit, wobei Googles Gemini-3-Flash-Preview mit 95,1 % Erfolgsquote für 0,72 $ anführt.

Pi-Coding-Agent mit Qwen 35B Q2: Dateisystem als externen Speicher nutzen und Kontextschutz erzwingen
Ein Reddit-Nutzer hat einen Stack um den Pi-Coding-Agenten mit Qwen 35B Q2_K_XL-Quantisierung gebaut, der Schutzmechanismen durchsetzt – bearbeitet keine Ausgaben über 100 Zeilen, begrenzt Denkblöcke auf 2000 Zeichen und überwacht den Kontext bei 65 %/80 % – und das Dateisystem als Gedächtnis des Modells behandelt, nicht den Kontextfenster.