OpenClaw-Benutzer melden 143 Millionen verarbeitete Token für 94 US-Dollar über OpenRouter.

Ein Reddit-Nutzer teilte detaillierte Kostendaten aus dem Betrieb von OpenClaw-Multi-Agent-Systemen, die erhebliche Einsparungen im Vergleich zur direkten API-Nutzung bei großen Anbietern demonstrieren.
Kostenvergleich und Konfigurationsdetails
Der Nutzer verarbeitete an einem einzigen Tag 143,0 Millionen Tokens für Gesamtkosten von 94,16 US-Dollar, während er drei Phasen eines siebenphasigen SaaS-Produktlaunches abschloss. Das entspricht 0,000000658 US-Dollar pro Token oder etwa 0,66 US-Dollar pro 1 Million Tokens.
Zum Vergleich nannte der Nutzer typische Direktpreise großer Anbieter:
- Claude Sonnet (Anthropic): etwa 3 US-Dollar pro 1 Mio. Input-Tokens und 15 US-Dollar pro 1 Mio. Output-Tokens
- GPT-4o (OpenAI): etwa 5 US-Dollar pro 1 Mio. Input-Tokens und 15 US-Dollar pro 1 Mio. Output-Tokens
- Ältere GPT-4-Klassen-Preise: oft 10+ US-Dollar gemischt, abhängig von der Nutzung
Der Nutzer merkte an, dass 143 Millionen Tokens über Claude Sonnet oder GPT-4-Preise typischerweise 400 bis 1500+ US-Dollar kosten würden, abhängig vom Input/Output-Mix.
Konfigurationsoptimierungen zur Kostensenkung
Der Nutzer identifizierte mehrere Konfigurationseinstellungen, die die Kosten in OpenClaw dramatisch reduzieren:
- Routen über OpenRouter statt direkt die OpenAI- oder Anthropic-APIs anzusprechen
- Das automatische Rotationsmodell als Standard verwenden, basierend auf Agent und Fähigkeit rotiert
- Kontextkomprimierung aktivieren, damit Agenten nicht ständig massive Verläufe erneut senden
- Gleichzeitige Agenten begrenzen, um unkontrollierten parallelen Token-Verbrauch zu verhindern
- Ein Orchestrator-Muster verwenden, damit Agenten nicht unnötig ständig mit dem Modell kommunizieren
Der Nutzer betrieb OpenClaw-artige Multi-Agent-Pipelines mit Komponenten wie Orchestrator-Agent, Backend-Agent, Frontend-Agent, QA-Agent, Architektur-Agent und Daten-Agent. Er betonte, dass Token-Ökonomie für KI-SaaS, Agenten-Frameworks, autonome Entwicklungssysteme oder OpenClaw-artige Pipelines erheblich wichtig ist, und merkte an, dass "1.000 US-Dollar pro Woche für Tokens zu verbrennen versus 100 US-Dollar der Unterschied zwischen einem coolen Projekt und etwas ist, das tatsächlich skalieren kann."
📖 Read the full source: r/openclaw
👀 Siehe auch

Selbstüberwachtes Feintuning an eigenen Fehlern steigert kleine Modelle auf 80 % bei HumanEval
Ein Entwickler trainierte Qwen 2.5 7B auf selbst generierten Codierungspaaren und erreichte 112/164 HumanEval (+87 Probleme) ohne von Menschen geschriebene Trainingsdaten. Der Ansatz lässt sich auf Llama 3.2 3B und Qwen 3 4B übertragen.

Anthropic startet Claude Partner Network mit 100 Millionen US-Dollar Investition
Anthropic startet das Claude Partner Network mit einer anfänglichen Investition von 100 Millionen US-Dollar für 2026, das Schulungen, technischen Support und gemeinsame Marktentwicklung für Organisationen bietet, die Unternehmen bei der Einführung von Claude unterstützen. Partner erhalten Zugang zu technischen Zertifizierungen, einem Partner-Portal mit Schulungsmaterialien und einem Code-Modernisierung-Starterkit für die Migration von Legacy-Code.

Claude Desktop 1.1.4498 Versionshinweise: Dock-Bounce, Shell-Umgebungserweiterung und Government Cloud-Unterstützung
Claude Desktop 1.1.4498 fügt Dock-Bounce-Benachrichtigungen für die Aufmerksamkeit des Benutzers hinzu, erweitert die Extraktion der Shell-Umgebung um Claude-spezifische Variablen und führt die Erkennung von Regierungs-/benutzerdefinierten Bereitstellungen ein. Das Update reduziert außerdem das Timeout für Chrome-Bridge-Tool-Aufrufe von 120 auf 10 Sekunden.

Tokenmaxxing ist die neue Stoppuhr: Warum Ihre KI-Richtlinie kohärent sein muss
Brian Meeker argumentiert gegen Eitelkeitsmetriken wie Tokenmaxxing und teilt die Vier-Punkte-KI-Politik seines Teams: kein Zwang, generierten Code verstehen, ohne KI-Tools überlebensfähig sein, sich um Teamkollegen und Kunden kümmern.