Analyse: Die tatsächlichen Rechenkosten von Anthropic für Claude Code-Nutzer liegen weit unter dem genannten Betrag von 5.000 US-Dollar.

✍️ OpenClawRadar📅 Veröffentlicht: 11. März 2026🔗 Source
Analyse: Die tatsächlichen Rechenkosten von Anthropic für Claude Code-Nutzer liegen weit unter dem genannten Betrag von 5.000 US-Dollar.
Ad

Ein kürzlicher Forbes-Artikel behauptete, Anthropics 200-Dollar-pro-Monat-Plan 'Claude Code Max' könne etwa 5.000 Dollar an Rechenleistung verbrauchen, was darauf hindeutet, dass das Unternehmen bei der Inferenz Geld verliert. Diese Analyse untersucht, warum diese Zahl irreführend ist.

API-Preise vs. tatsächliche Rechenkosten

Die Zahl von 5.000 Dollar stammt aus Anthropics Einzelhandels-API-Preisen: 5 Dollar pro Million Eingabe-Tokens und 25 Dollar pro Million Ausgabe-Tokens für Opus 4.6. Zu diesen Preisen könnte ein intensiver Nutzer tatsächlich 5.000 Dollar pro Monat an API-äquivalenter Nutzung anhäufen.

Allerdings spiegeln die API-Preise nicht wider, was es Anthropic tatsächlich kostet, diese Tokens zu bedienen. Um die realen Inferenzkosten abzuschätzen, betrachten Sie die wettbewerbsfähigen Preise für ähnliche Modelle auf OpenRouter:

  • Qwen 3.5 397B-A17B (vergleichbar mit Opus 4.6): 0,39 Dollar pro Million Eingabe-Tokens, 2,34 Dollar pro Million Ausgabe-Tokens
  • Kimi K2.5 1T Parameter mit 32B aktiv: 0,45 Dollar pro Million Eingabe-Tokens, 2,25 Dollar pro Million Ausgabe-Tokens
  • DeepInfra Cache-Lesevorgänge bei Kimi K2.5: 0,07 Dollar/MTok vs. Anthropics 0,50 Dollar/MTok
Ad

Die eigentliche Rechnung

Diese OpenRouter-Anbieter führen Unternehmen mit Gewinnmargen und nehmen keine enormen Verluste in Kauf. Wenn sie vergleichbare Modelle zu etwa 10 % des API-Preises von Anthropic bedienen können, liegen die tatsächlichen Rechenkosten wahrscheinlich in diesem Bereich.

Daher:

  • Intensiver Nutzer, der 5.000 Dollar an API-äquivalenten Tokens verbraucht ≈ 500 Dollar an tatsächlichen Rechenkosten
  • Verlust bei extremen Power-Usern: 300 Dollar pro Monat (nicht 4.800 Dollar)
  • Die meisten Nutzer erreichen die Limits nicht: Anthropic sagt, dass weniger als 5 % der Abonnenten von wöchentlichen Obergrenzen betroffen wären
  • Typische Nutzung des Max-20x-Plans bei etwa 50 % des wöchentlichen Token-Budgets ≈ kostendeckend oder profitabel für Anthropic

Wer trägt tatsächlich Kosten von 5.000 Dollar?

Die Zahl von 5.000 Dollar stammt aus Cursors interner Analyse. Für Cursor ist die Zahl ungefähr korrekt, weil sie Anthropics Einzelhandels-API-Preise (oder nahe daran) für den Zugang zu Opus 4.6 zahlen.

Entwickler wünschen sich Anthropic-Modelle in Cursor aufgrund der Markenbekanntheit und der aktuellen Leistungsvorteile gegenüber günstigeren Open-Weight-Alternativen.

Weitere Implikationen

Anthropic ist insgesamt nicht profitabel aufgrund von Trainingskosten, Forschergehältern und Rechenleistungsverpflichtungen – nicht wegen der Inferenz. Pro Nutzer und pro Token für die Inferenz ist Anthropic wahrscheinlich im Durchschnitt bei Claude-Code-Abonnenten profitabel.

Das Narrativ 'KI-Inferenz ist ein Geldgrab' spielt den Frontier Labs in die Hände, indem es Wettbewerb entmutigt und ihre Gräben tiefer erscheinen lässt, als sie sind.

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch

🦀
Nachrichten

NYC & LAUSD verhängen strenge KI-Verbote an Schulen: Wie sich das auf Entwickler und EdTech auswirkt

New York City hat KI in K-8-Klassen verboten, LAUSD hat ein einjähriges Moratorium für die KI-Nutzung aller Schüler verhängt. Hier die Aufschlüsselung für Entwickler, die Bildungswerkzeuge bauen.

OpenClawRadar
Opus 4.7 Token-Effizienz: Deutsche Prompts verbrauchen bis zu 2x mehr Tokens als Englische
Nachrichten

Opus 4.7 Token-Effizienz: Deutsche Prompts verbrauchen bis zu 2x mehr Tokens als Englische

Ein Claude Pro-Abonnent berichtet, dass die Verwendung von Deutsch mit Opus 4.7 innerhalb von Sekunden 100% der Session-Tokens verbrauchte, während Englisch 37% benötigte. Die Ineffizienz des Tokenizers liegt an zusammengesetzten Substantiven und Umlauten, was zu einem 1,5- bis 2-fachen Token-Verbrauch führt.

OpenClawRadar
Anthropic startet Claude Code Channels für Messaging-Integration
Nachrichten

Anthropic startet Claude Code Channels für Messaging-Integration

Anthropic hat Claude Code Channels eingeführt, die es Entwicklern ermöglichen, über Telegram oder Discord direkt mit Claude Code-Sitzungen zu kommunizieren, mit vollem Zugriff auf Werkzeuge wie Dateibearbeitungen, Testläufe und Git-Operationen. Die Funktion erfordert einen kostenpflichtigen Anthropic-Plan und unterstützt zwei Plattformen im Vergleich zu OpenClaws 20+.

OpenClawRadar
Die Analyse der Inferenzpreise zeigt eine 4,4-fache Preisspanne für dasselbe Modell bei verschiedenen Anbietern.
Nachrichten

Die Analyse der Inferenzpreise zeigt eine 4,4-fache Preisspanne für dasselbe Modell bei verschiedenen Anbietern.

Die Analyse der Inferenzpreise für Llama 3.1 70B Instruct zeigt eine 4,4-fache Kostenunterschied zwischen Anbietern, mit DeepInfra bei 0,20 $/0,27 $ pro Million Tokens und Together bei 0,88 $/0,88 $. Bei Reasoning-Modellen erreicht die Spanne etwa das 30-fache zwischen DeepSeek R1 und OpenAI o1.

OpenClawRadar