Claude Code A/B-Test reduziert „High“-Aufwand stillschweigend auf das frühere „Low“-Niveau
Entwickler, die Claude Code verwenden, haben diese Woche möglicherweise einen plötzlichen Leistungsabfall bemerkt. Laut einem Bericht des X-Benutzers @argofowl führt Anthropic einen serverseitigen A/B-Test durch, der die effektive Anstrengungsstufe für bestimmte Sitzungen stillschweigend reduziert. Die Änderung betrifft Claude Code Version 2.1.236 und höher, wo das Modell nun "hoch" als 10 von 100 interpretiert – genau der Wert, den "niedrig" früher verwendet hat. Ältere Versionen und Opus 5 sind nicht betroffen, und im Änderungsprotokoll wird dies nicht erwähnt.
Wichtige Details
- Betroffene Version: Claude Code 2.1.236+ (insbesondere nach 2.1.237 festgestellt)
- Änderung: Die Anstrengungsskala wird serverseitig verkleinert; "hoch" wird nun auf 10/100 abgebildet statt auf den bisherigen höheren Wert.
- Umfang: Nur eingeschriebene Sitzungen – es ist ein A/B-Test, nicht jeder sieht es.
- Erkennung: Wenn sich "hoch" für dich wie "niedrig" anfühlt, gehörst du zur Testgruppe.
- Kein Eintrag im Änderungsprotokoll: Die Änderung wurde ohne öffentliche Dokumentation vorgenommen.
Der Berichterstatter @argofowl verbrachte einen Nachmittag damit, zu glauben, dass ihre eigenen Werkzeuge defekt seien, bevor er das Problem entdeckte. Sie drückten ihre Frustration über die undurchsichtigen Testpraktiken von Anthropic aus: "heilige Scheiße Anthropic, ihr seid manchmal unerträglich."
Analyse
Dies ist keine clientseitige Korrektur – es ist eine serverseitige Konfiguration, die beeinflusst, wie das Modell Anstrengungsparameter interpretiert. Wenn Sie Version 2.1.236 oder höher verwenden und eine geringere Ausgabequalität feststellen, wenn Sie die Anstrengung auf "hoch" setzen, könnten Sie Teil dieses Experiments sein. Um den Test zu vermeiden, können Sie auf eine ältere Version (z. B. 2.1.235 oder früher) pinnen oder darauf warten, dass Anthropic die Änderung ausrollt oder zurücknimmt. Da es sich um einen A/B-Test handelt, kann Ihre Erfahrung variieren.
Für Entwickler, die auf konsistentes Verhalten von KI-Codierungsagenten angewiesen sind, ist eine solche stillschweigende Änderung besorgniserregend. Es gibt noch keine offizielle Stellungnahme von Anthropic, und die Änderung wird in keinem öffentlichen Änderungsprotokoll erwähnt. Wenn Sie betroffen sind, überprüfen Sie Ihre Claude-Code-Version und erwägen Sie gegebenenfalls ein Downgrade, um stabile Leistung zu gewährleisten.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Wikipedia verbietet KI-generierte Inhalte, erlaubt aber eingeschränkte KI-Nutzung mit menschlicher Prüfung
Wikipedia hat offiziell seinen 260.000 Bearbeitern verboten, KI wie ChatGPT zum Verfassen von Artikeln zu verwenden, und verweist dabei auf Bedenken hinsichtlich Genauigkeit und Zuverlässigkeit. Bearbeiter dürfen KI weiterhin für Übersetzungen und Korrekturlesen mit menschlicher Genehmigung nutzen.

UW-Forscher planen, KI-Training mit von Lehrkräften getragenen Kameras durchzuführen, Eltern können widersprechen
Forscher der University of Washington planten, dass Vorschullehrerinnen und -lehrer Kameras am Körper tragen, um Kinder für das Training von KI-Modellen aufzuzeichnen, mit einem Opt-out-Einwilligungsmodell.

OpenClaw befähigt Entwickler mit KI-Agenten, während GethCity mit denkenden Netzwerken innoviert.
OpenClaw bringt einen KI-Agenten-Service auf den Markt, der das Programmieren schneller und effizienter macht, während GethCity ein Netzwerk einführt, das menschliche Denkprozesse nachahmt. Entdecken Sie die Innovationen, die die Automatisierung vorantreiben.

Claude Code v2.1.223: Sicherheitsupdates, /teleport-Hinweis und /review-Alias
Claude Code v2.1.223 fügt Wildcards für Marktplatz-Einstellungen hinzu, einen /teleport-Hinweis und behebt einen Bash-Berechtigungs-Bypass.