Microsoft kündigt Claude-Code-Lizenzen – KI-Agenten zu teuer für Skalierung

✍️ OpenClawRadar📅 Veröffentlicht: 23. Mai 2026🔗 Source
Microsoft kündigt Claude-Code-Lizenzen – KI-Agenten zu teuer für Skalierung
Ad

Microsoft kündigt die meisten direkten Claude Code-Lizenzen für den internen Gebrauch und verlagert die Ingenieure zurück auf GitHub Copilot CLI, wie The Verge berichtet. Die Kehrtwende kommt sechs Monate, nachdem das Unternehmen den Zugang zu Claude Code geöffnet hatte und Tausende von Entwicklern, Produktmanagern und Designern ermutigte, mit dem agentischen Codierungstool zu experimentieren. Es wurde zu beliebt – und zu teuer.

Wichtige Details

  • Microsofts Foundry-Deal mit Anthropic (5 Milliarden US-Dollar Investition, 30 Milliarden US-Dollar Azure-Computing-Verpflichtung) ist nicht betroffen. Nur die internen direkten Claude Code-Lizenzen werden gestrichen.
  • Uber-CTO Praveen Neppalli Naga sagte The Information im April, dass das Unternehmen sein gesamtes KI-Coding-Tools-Budget für 2026 bereits in nur vier Monaten aufgebraucht habe, nachdem es die Nutzung durch interne Ranglisten gefördert hatte.
  • Meta hat eine Rangliste namens „Claudeonomics“, die den KI-Tokenverbrauch pro Mitarbeiter verfolgt. Amazon pusht „Toxenmaxx“ – maximieren Sie den Tokenverbrauch.
  • Goldman Sachs prognostiziert, dass agentische KI den Tokenverbrauch bis 2030 um das 24-fache steigern könnte, auf bis zu 120 Billiarden Token pro Monat.
  • Gartner prognostiziert, dass die Inferenzkosten für ein LLM mit einer Billion Parametern bis 2030 im Vergleich zu 2025 um ~90 % sinken werden, aber die gesamten KI-Ausgaben von Unternehmen werden dennoch steigen, da agentische Modelle weitaus mehr Token pro Aufgabe benötigen und KI-Anbieter die Kosteneinsparungen nicht vollständig an die Kunden weitergeben.

Nvidia-Vizepräsident Bryan Catanzaro fasste es zusammen: „Für mein Team sind die Rechenkosten weit höher als die Kosten für die Mitarbeiter.“

Ad

Fazit

Die Ökonomie der KI-Agenten ist umgekehrt: Billigere Token bedeuten nicht unbedingt niedrigere Rechnungen. Wie Microsoft und Uber feststellen, übersteigt der Tokenverbrauch die Preisrückgänge, wenn Agenten in großem Maßstab eingesetzt werden. Wenn Sie für KI-Tools im Jahr 2026 budgetieren, planen Sie Kosten ein, die 3- bis 5-mal über dem Basiswert liegen – es sei denn, die Anbieter wechseln zu Festpreis- oder nutzungsbegrenzten Plänen.

📖 Vollständige Quelle lesen: HN AI Agents

Ad

👀 Siehe auch

🦀
Nachrichten

Claude Code 2.1.260: Diff-Bedienfeld, /reload-plugins, Fable 5.1-Korrekturen

Claude Code v2.1.260 fügt ein Vollbild-Diff-Panel hinzu, /reload-plugins für Headless-Sitzungen und behebt Fehler in Fable 5.1, Berechtigungen und mehr.

OpenClawRadar
Die Analyse der Inferenzpreise zeigt eine 4,4-fache Preisspanne für dasselbe Modell bei verschiedenen Anbietern.
Nachrichten

Die Analyse der Inferenzpreise zeigt eine 4,4-fache Preisspanne für dasselbe Modell bei verschiedenen Anbietern.

Die Analyse der Inferenzpreise für Llama 3.1 70B Instruct zeigt eine 4,4-fache Kostenunterschied zwischen Anbietern, mit DeepInfra bei 0,20 $/0,27 $ pro Million Tokens und Together bei 0,88 $/0,88 $. Bei Reasoning-Modellen erreicht die Spanne etwa das 30-fache zwischen DeepSeek R1 und OpenAI o1.

OpenClawRadar
NHS England zieht sich von Open Source zurück: Offener Brief fordert Rücknahme der SDLC-8-Richtlinie
Nachrichten

NHS England zieht sich von Open Source zurück: Offener Brief fordert Rücknahme der SDLC-8-Richtlinie

Ein offener Brief mit 74 Unterschriften fordert NHS England auf, SDLC-8 zurückzuziehen – eine Richtlinie, die den gesamten NHS-Quellcode verbirgt – und bekräftigt Prinzip 12 des NHS Service Standard: 'Machen Sie neuen Quellcode offen.'

OpenClawRadar
Claude Code 2.1.132: Multiagent-Dokumentation, Zeitplan-Gate, Änderungen der Fähigkeitsbegrenzung
Nachrichten

Claude Code 2.1.132: Multiagent-Dokumentation, Zeitplan-Gate, Änderungen der Fähigkeitsbegrenzung

Release v2.1.132 fügt Dokumentation für Managed Agents zu Multiagent-Sitzungen, Ergebnissen und Webhooks hinzu; führt ein standardmäßig ablehnendes Gate für proaktive /schedule-Angebote ein; senkt das dokumentierte Skill-Limit von 64 auf 20 pro Agent.

OpenClawRadar