OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen

Die Standardeinstellungen von OpenClaw können durch die Heartbeat-Funktion zu unerwartet hoher API-Budgetbelastung führen. Diese Funktion überprüft standardmäßig alle 30 Minuten Aufgaben, und jede Überprüfung lädt die vollständigen Kontextdateien, den Speicher und den Chat-Verlauf, wodurch Zehntausende von Tokens für grundlegende Statusprüfungen an die API gesendet werden.
Einstellungen, die sofort geändert werden sollten
- Aktive Stunden festlegen: Beschränken Sie Heartbeat in den Einstellungen auf Ihre tatsächlichen Arbeitszeiten, um nächtlichen Token-Verbrauch zu stoppen.
- Ihr Standard-Basismodell ändern: Verwenden Sie für grundlegende Agentenaufgaben günstigere Modelle wie Gemini Flash oder DeepSeek anstelle von Premium-Modellen wie Claude 3.5 Sonnet oder Opus.
- Große Modelle nur bei Bedarf aufrufen: Schalten Sie manuell nur dann auf Premium-Modelle um, wenn Sie umfangreiche Schlussfolgerungen oder komplexe Programmierung benötigen.
- Den /new-Befehl verwenden: Geben Sie
/newein, um Sitzungen nach großen Aufgaben hart zurückzusetzen und zu vermeiden, dass toter Kontext in Ihre nächste Eingabe gezogen wird.
Die Quelle weist darauf hin, dass die Verwendung von Premium-Modellen für alles dazu führen kann, dass sich die Kosten schnell summieren, und dass sich der Kontext schnell aufbaut, da OpenClaw standardmäßig Ihren gesamten Chat-Verlauf mitzieht.
📖 Read the full source: r/openclaw
👀 Siehe auch

MiniMax M2.7 Q8_0 128K auf 2x3090 mit CPU-Offloading – Benchmarks und Konfiguration aus der Praxis
Ein Benutzer führt erfolgreich MiniMax M2.7 mit Q8_0 und 128K Kontext auf zwei RTX 3090 plus DDR4 RAM aus, erreicht ~50 tps Prompt-Verarbeitung und ~10 tps Token-Generierung und teilt seine llama-Server-Flags.

Einsatzbericht: Qwen 3.6 27B auf einem M2 MacBook Pro (32 GB) – quälend langsam, aber intelligente Ausgabe
Der Betrieb von Qwen 3.6 27B IQ4_XS auf einem M2 MacBook Pro mit 32 GB RAM liefert anfangs 7,9 t/s, bei 52k Kontext sinkt die Geschwindigkeit auf 3,1 t/s. Die Codequalität beeindruckt, aber die Speicherbandbreite ist der Engpass.

Cron-Jobs mit KI-Fallback können unerwartete API-Kosten verursachen, wenn Tools hängen bleiben
Ein Benutzer meldete, dass ein Cron-Job in OpenClaw, der alle 10 Minuten einen E-Mail-Posteingang mit himalaya überprüft, etwa 60 US-Dollar an API-Guthaben verbrauchte, als die IMAP-Verbindung hängen blieb. Dies löste bei jedem Timeout Claude-Agenten aus, obwohl die Anweisung lautete, KI nur für eingehende E-Mails zu nutzen.

Claude-Nutzer berichten von schnelleren Sitzungen, indem sie Markdown anstelle von Word-Dokumenten anfordern.
Ein Claude-Benutzer entdeckte, dass die Anfrage nach Markdown statt Word-Dokumenten die Antwortzeit und den Token-Verbrauch erheblich reduziert. Die KI gibt von Natur aus Markdown aus, während die Erstellung von .docx-Dateien das Starten einer Python-Umgebung und das Ausführen von Konvertierungsskripten erfordert.