Claude Code v2.1.237: Prompt-Caching-Fix für LLM-Gateways + integrierter prägnanter Ausgabestil
Claude Code v2.1.237 ist da, mit zwei Änderungen, die den Alltag beeinflussen: eine Korrektur für das Prompt-Caching bei Nutzung über ein LLM-Gateway oder eine benutzerdefinierte Basis-URL sowie ein neuer integrierter 'Kompakt'-Ausgabestil.
Prompt-Caching-Fix für Gateways
Wenn Sie Claude Code mit einem LLM-Gateway (wie LiteLLM oder einem Unternehmens-Proxy) oder einer benutzerdefinierten Basis-URL verwenden, war das Prompt-Caching in früheren Versionen offenbar defekt. Das widerspricht dem Zweck – Caching sorgt dafür, dass große Kontextfenster schnell und kosteneffizient bleiben. v2.1.237 behebt dies, sodass Sitzungen über diese Einrichtungen wieder die üblichen Cache-Treffer erzielen.
Neuer 'Kompakt'-Ausgabestil
Es gibt auch einen neuen Ausgabestil namens Kompakt. Aus dem Änderungsprotokoll: "Claude führt mit Ergebnissen und überspringt Präambel und Erzählung, erledigt die Arbeit aber ebenso gründlich." In der Praxis bedeutet das weniger Füllwörter wie "Ich werde nun Ihre Codebasis analysieren" und mehr direkte Antworten. Sie können ihn umschalten, indem Sie /config ausführen und unter Ausgabestil Kompakt auswählen.
Dies ist eine globale Einstellung, die nach Auswahl für alle Ihre Sitzungen gilt. Wenn Sie bisher benutzerdefinierte Prompts verwendet haben, um Kürze zu erzwingen, ist dies jetzt eine erstklassige Option.
Für wen das ist
- Teams, die Claude Code über ein LLM-Gateway oder eine benutzerdefinierte Basis-URL leiten – der Caching-Fix ist wichtig für Leistung und Token-Kosten.
- Entwickler, die weniger Erzählung und schnellere Antworten wünschen – der Kompakt-Stil ist einen Versuch wert.
Das Release ist auf GitHub als v2.1.237 markiert. Aktualisieren Sie mit npm update -g @anthropic-ai/claude-code oder Ihrem üblichen Installationsprogramm.
📖 Vollständige Quelle lesen: GitHub Claude-Code
👀 Siehe auch

Untersuchung der Machbarkeit von OpenClaw auf einem Chromebook
OpenClaw auf einem Chromebook auszuführen, könnte einfacher sein, als Sie denken. Unsere neueste Erkundung von OpenClawRadar geht den Nutzererfahrungen und -anforderungen nach, um zu klären, ob Chromebooks diesen KI-Coding-Agenten bewältigen können.
Qwen3 27B übertrifft Gemma 4 26B in echtem Tool-Einsatz für lokale KI-Videopipeline
Ein lokaler KI-Videopipeline-Test zeigt, dass Qwen3 27B Tool-Calling sauber handhabt, während Gemma 4 26B in Schleifen stecken blieb. Außerdem werden Said Image Turbo für lokale Bildgenerierung und OpenCode-Orchestrierung mit 174K Kontext behandelt.

Anthropic stellt festes erweitertes Denken ein und zwingt Claude-Modelle zu adaptivem Denken
Anthropic stellt die manuelle erweiterte Denkweise (festes Budget) auf Opus 4.6 und Sonnet 4.6 ein und entfernt sie vollständig auf Opus 4.7 (gibt 400-Fehler zurück). Adaptives Denken wird standardmäßig erzwungen, was aufgrund wahrgenommener Kostensenkungsmaßnahmen in der Community für Gegenwind sorgt.

Qwen3-30B-A3B vs Qwen3.5-35B-A3B Leistungsvergleich auf RTX 5090
Ein direkter Benchmark-Vergleich von Qwen3-30B-A3B und Qwen3.5-35B-A3B auf einer RTX 5090 zeigt, dass das 30B-Modell bei der Texterzeugung 35 % schneller ist, während das 3.5-Modell dank flacher Token-Skalierung im Gegensatz zum 21 %-Rückgang des 30B-Modells lange Kontexte besser verarbeitet.