Claude Code A/B-Test reduziert „High“-Aufwand stillschweigend auf das frühere „Low“-Niveau
Entwickler, die Claude Code verwenden, haben diese Woche möglicherweise einen plötzlichen Leistungsabfall bemerkt. Laut einem Bericht des X-Benutzers @argofowl führt Anthropic einen serverseitigen A/B-Test durch, der die effektive Anstrengungsstufe für bestimmte Sitzungen stillschweigend reduziert. Die Änderung betrifft Claude Code Version 2.1.236 und höher, wo das Modell nun "hoch" als 10 von 100 interpretiert – genau der Wert, den "niedrig" früher verwendet hat. Ältere Versionen und Opus 5 sind nicht betroffen, und im Änderungsprotokoll wird dies nicht erwähnt.
Wichtige Details
- Betroffene Version: Claude Code 2.1.236+ (insbesondere nach 2.1.237 festgestellt)
- Änderung: Die Anstrengungsskala wird serverseitig verkleinert; "hoch" wird nun auf 10/100 abgebildet statt auf den bisherigen höheren Wert.
- Umfang: Nur eingeschriebene Sitzungen – es ist ein A/B-Test, nicht jeder sieht es.
- Erkennung: Wenn sich "hoch" für dich wie "niedrig" anfühlt, gehörst du zur Testgruppe.
- Kein Eintrag im Änderungsprotokoll: Die Änderung wurde ohne öffentliche Dokumentation vorgenommen.
Der Berichterstatter @argofowl verbrachte einen Nachmittag damit, zu glauben, dass ihre eigenen Werkzeuge defekt seien, bevor er das Problem entdeckte. Sie drückten ihre Frustration über die undurchsichtigen Testpraktiken von Anthropic aus: "heilige Scheiße Anthropic, ihr seid manchmal unerträglich."
Analyse
Dies ist keine clientseitige Korrektur – es ist eine serverseitige Konfiguration, die beeinflusst, wie das Modell Anstrengungsparameter interpretiert. Wenn Sie Version 2.1.236 oder höher verwenden und eine geringere Ausgabequalität feststellen, wenn Sie die Anstrengung auf "hoch" setzen, könnten Sie Teil dieses Experiments sein. Um den Test zu vermeiden, können Sie auf eine ältere Version (z. B. 2.1.235 oder früher) pinnen oder darauf warten, dass Anthropic die Änderung ausrollt oder zurücknimmt. Da es sich um einen A/B-Test handelt, kann Ihre Erfahrung variieren.
Für Entwickler, die auf konsistentes Verhalten von KI-Codierungsagenten angewiesen sind, ist eine solche stillschweigende Änderung besorgniserregend. Es gibt noch keine offizielle Stellungnahme von Anthropic, und die Änderung wird in keinem öffentlichen Änderungsprotokoll erwähnt. Wenn Sie betroffen sind, überprüfen Sie Ihre Claude-Code-Version und erwägen Sie gegebenenfalls ein Downgrade, um stabile Leistung zu gewährleisten.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Die verborgene Finanzblase in der KI-Infrastruktur – Kernaussagen
Eine kritische Analyse des Booms bei den Investitionen in KI-Infrastruktur, die vor einer nicht nachhaltigen Blase ähnlich wie bei früheren Technologiecrashs warnt. Das PDF argumentiert, dass die massiven Kapitalausgaben für GPUs und Rechenzentren die tatsächliche Umsatzgenerierung bei weitem übersteigen.

Manifest fügt GitHub Copilot als vierten KI-Anbieter für OpenClaw-Routing hinzu
Manifest unterstützt jetzt die Weiterleitung von OpenClaw-Anfragen über GitHub Copilot-Abonnements und schließt sich damit Anthropic, OpenAI und Minimax als verfügbare Anbieter an. Dies ermöglicht Entwicklern, ihre bestehenden Copilot-Pläne für Code-Aufgaben über für die Entwicklung gebaute Modelle zu nutzen.

Atlassian aktiviert standardmäßige Datenerfassung für KI-Training
Atlassian hat standardmäßige Datenerfassung in seinen Produkten aktiviert, um KI-Modelle zu trainieren, laut einer Quelle auf Hacker News mit 312 Punkten und 75 Kommentaren.

HN-Daten bestätigen: Anteil der arXiv-Papiere sinkt, LLM-Hype-Höhepunkt hinter uns?
Dylan Castillo nutzte Claude, um HN BigQuery-Daten zu analysieren, und stellte fest, dass der Anteil der Frontpage-Geschichten, die auf arXiv verlinken, in den letzten Monaten rapide abgenommen hat, nach einem von LLMs dominierten Höhepunkt in den Jahren 2023–2026.