Claude Code v2.1.278 setzt den Auto-Modus standardmäßig auf den serverseitigen Klassifikator
Claude Code v2.1.278 ändert, wie der Auto-Modus seinen Klassifikator auswählt. Für Claude-API- und Enterprise-Nutzer sowie alle, die auf Bedrock, Vertex, Foundry oder Gateways laufen, verwendet der Auto-Modus jetzt standardmäßig den serverseitigen Klassifikator. Der praktische Vorteil: Dieser Pfad berechnet keinen Overhead für den Klassifikator.
Was sich geändert hat
- Der serverseitige Klassifikator ist jetzt Standard für Claude-API-Nutzer, Enterprise-Nutzer und Bereitstellungen auf Bedrock, Vertex, Foundry und Gateways.
- Kein berechneter Klassifikator-Overhead auf diesem serverseitigen Pfad.
- Opt-out-Flag:
CLAUDE_CODE_AUTO_MODE_SERVER=0deaktiviert den serverseitigen Klassifikator auf Bedrock, Vertex, Foundry und Gateways. - Warnung bei kostenpflichtigem Fallback: Die CLI warnt, wenn sie auf einen Pfad zurückfällt, der Klassifikator-Arbeit berechnet.
Prüfen, welcher Klassifikator in Ihrer Sitzung verwendet wird
v2.1.278 fügt der /status-Ausgabe eine Zeile Auto-Modus-Server hinzu. Führen Sie /status in einer Sitzung aus, und Sie sehen, ob der Auto-Modus-Klassifikator dieser Sitzung auf dem Server läuft oder lokal zurückfällt. Nützlich, wenn Sie Kosten- oder Verhaltensunterschiede zwischen Umgebungen debuggen.
Opt-out
Wenn Sie auf Bedrock, Vertex, Foundry oder einem Gateway arbeiten und den clientseitigen Klassifikator beibehalten möchten, setzen Sie die Umgebungsvariable vor dem Start:
CLAUDE_CODE_AUTO_MODE_SERVER=0 claude
Laut den Versionshinweisen gilt dieses Opt-out speziell für diese vier Bereitstellungspfade; Claude-API- und Enterprise-Nutzer erhalten den serverseitigen Klassifikator standardmäßig.
Abrechnungsdetails
Die Veröffentlichung verweist für das vollständige Abrechnungsverhalten des Auto-Modus-Klassifikators auf Anthropics Dokumentation: https://code.claude.com/docs/en/auto-mode-classifier-billing. Wenn Sie Kosten pro Token oder pro Anfrage bei einer Gateway- oder Cloud-Marketplace-Bereitstellung verfolgen, lesen Sie diese Seite, bevor Sie die Umgebungsvariable umstellen – der ganze Sinn der Standardänderung ist, dass der serverseitige Pfad der günstigere ist.
Für wen das relevant ist
Alle, die den Claude Code Auto-Modus über Bedrock, Vertex, Foundry oder ein selbstverwaltetes Gateway betreiben, sowie Enterprise-Konten, die Klassifikator-Positionen auf ihrer Rechnung überwachen.
📖 Read the full source: GitHub Claude-Code
👀 Siehe auch

Infomaniak überträgt Mehrheitsstimmrechte an Stiftung, um die Schweizer Cloud-Unabhängigkeit zu sichern
Infomaniak sichert seine langfristige Unabhängigkeit, indem es die Mehrheitsstimmrechte an eine Schweizer Stiftung des öffentlichen Interesses übertragen hat. Eine Übernahme ist ohne Zustimmung der Stiftung nicht möglich.

Feinabgestimmte Qwen3-Kleinstmodelle übertreffen Spitzen-LLMs bei spezifischen Aufgaben zu geringeren Kosten
Destillierte Qwen3-Modelle (0,6B bis 8B Parameter) übertrafen oder erreichten Spitzen-API-Modelle wie GPT-5, Gemini und Claude bei 6 von 9 Aufgaben, einschließlich Funktionsaufrufen und Text2SQL, mit Kosten von nur 3 US-Dollar pro Million Anfragen gegenüber 378 US-Dollar für vergleichbare Leistung.

Subquadratic stellt 12 Millionen Token Kontextfenster für KI-Modelle vor
Subquadratic veröffentlicht ein 12-Millionen-Token-Kontextfenster und sprengt damit frühere Grenzen für LLM-Inferenz, sodass ganze Codebasen in einem einzigen Durchlauf verarbeitet werden können.

Revolutionieren Sie die API-Überwachung über Anbieter hinweg mit onWatch.
Entdecken Sie, wie <strong>onWatch</strong>, ein leistungsstarkes neues Tool, die Verfolgung Ihrer AI-API-Nutzung über mehrere Anbieter hinweg optimiert, sodass Sie innerhalb der Grenzen bleiben und die Ressourcenzuteilung optimieren können.