Otterly: Leiten Sie OpenClaw durch Ihr Claude Code-Abonnement

Otterly (npm-Paket) ist ein leichtgewichtiges Tool, das Ihre lokale Claude CLI als OpenAI-kompatiblen HTTP-Server auf localhost:11434 bereitstellt. Jedes Tool, das die OpenAI Chat Completions API spricht – Cursor, Aider, Continue, OpenClaw oder einfaches curl – kann darauf zugreifen, und jede Anfrage wird über Ihr bestehendes Claude Code-Abonnement abgerechnet, anstatt nutzungsbasierte API-Kosten pro Token zu zahlen.
Dies löst ein spezifisches Problem: Nach der Richtlinienänderung von Anthropic am 4. April, die OpenClaw von den Claude Code-Abonnements abschnitt, waren OpenClaw-Nutzer von Pro- und Max-Tarifen gezwungen, separate nutzungsbasierte API-Kosten pro Token für Arbeiten zu zahlen, die zuvor unter dem Abonnement liefen. Der Kreditpool des Agent SDK-Mechanismus leert sich bei dauerhafter Nutzung schnell. Ein Benutzer, der mehrere OpenClaw-Instanzen auf einem Raspberry Pi zu Hause betrieb, sah unmittelbar nach der Änderung steigende Kosten.
Wie es funktioniert
Otterly nutzt Ihre authentifizierte Claude Code-Sitzung. Die erste Anfrage nach längerer Inaktivität kann langsam sein, während die Sitzung neu authentifiziert wird, aber nachfolgende Anfragen fügen nur etwa 3–7 Millisekunden Overhead gegenüber der rohen API hinzu. Das OpenClaw-Rezept zur Verbindung mit Otterlys Endpunkt ist in der README dokumentiert.
Bekannte Einschränkungen
- Teilt Claude Code-Ratenlimits: Wenn Sie das 5-Stunden-Limit in Claude Code erreichen, ist Otterly blockiert, bis es zurückgesetzt wird.
- Stub-Parameter: Einige OpenAI-spezifische Parameter (
logit_bias,n>1,seed) sind nicht implementiert. - Nur Einzelbenutzer: Läuft auf Ihrem Rechner für Ihr Abonnement. Setzen Sie es nicht öffentlich frei oder verkaufen Sie den Zugriff weiter.
Die FAQ auf der Otterly-Website ist ehrlich darüber, was das Tool kann und was nicht, insbesondere in Bezug auf Self-Hosting, Teamnutzung und Einhaltung der Nutzungsbedingungen von Anthropic.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

Quanta-SDK v0.9.2 fügt einen MCP-Server für die Ausführung von Quantenschaltkreisen über KI-Agenten hinzu.
Quanta-SDK v0.9.2 enthält jetzt einen MCP-Server (Model Context Protocol), der KI-Agenten wie Claude oder GPT Werkzeuge zur Ausführung und Interpretation von Quantenschaltkreisen bereitstellt. Der Server bietet über 20 Werkzeuge, darunter Schaltkreisausführung auf IBM-Hardware, Ergebnisinterpretation, Rauschanalyse und quantenbasierte Finanzpreisgestaltung.

mcp-optimizer reduziert den Token-Verschleiß durch inaktive MCP-Server in Claude Code
mcp-optimizer ist ein Plugin, das Token-Verschwendung durch MCP-Server in Claude Code angeht, indem es die Werkzeugnutzung analysiert und optimierte Konfigurationen erstellt. Es umfasst vier Hilfsprogramme: mcp-doctor für Server-Integritätsprüfungen, mcp-audit für Nutzungsanalysen, mcp-optimize zur Erstellung projektlokaler Konfigurationen und mcp-to-skills zur Umwandlung von Werkzeugen in bedarfsgesteuerte Skills.

Claude Code lädt Tool-Schemata per ToolSearch lazy, um Token zu sparen
Claude Code verschiebt das Laden von Tool-Schemata, indem nur die Tool-Namen vorab gesendet werden und ein ToolSearch-Aufruf erforderlich ist, um die Schemata vor der Nutzung zu laden. Diese Architektur reduziert den Token-Verbrauch erheblich.

GrapeRoot: Open-Source-Tool reduziert Claude Code Token-Verbrauch um 40–80 %
GrapeRoot ist ein kostenloser, quelloffener lokaler MCP-Server, der zwischen Ihrer Codebasis und Claude Code sitzt und die Token-Nutzung um 40-80% reduziert, indem er verfolgt, was das Modell bereits gesehen hat, und nur relevante Codeänderungen sendet.