Anthropic stellt festes erweitertes Denken ein und zwingt Claude-Modelle zu adaptivem Denken

Anthropic stellt die Möglichkeit, adaptives Denken in Claude Code und Claude API zu deaktivieren, ein. Ab sofort wird die manuelle erweiterte Denkweise (thinking: {type: "enabled", budget_tokens: N}) auf Claude Opus 4.7 nicht mehr unterstützt – sie gibt einen 400-Fehler zurück. Für Opus 4.6 und Sonnet 4.6 ist die manuelle Konfiguration noch funktionsfähig, aber veraltet und wird in einer zukünftigen Modellversion entfernt.
Die Änderung bedeutet, dass adaptives Denken (thinking: {type: "adaptive"} mit effort-Parameter) zum standardmäßigen und einzigen Modus wird. Benutzer, die zuvor adaptives Denken deaktiviert hatten, um die Qualität zu erhalten – mit Hinweis auf eine merkliche Verschlechterung der Claude Code-Ausgaben – verlieren diese Möglichkeit.
Wichtige Details
- Opus 4.7: Manuelles erweitertes Denken vollständig deaktiviert; verwenden Sie adaptives Denken mit effort-Parameter.
- Opus 4.6 & Sonnet 4.6: Adaptives Denken empfohlen; manueller Modus veraltet, wird entfernt.
- API-Benutzer: Können kein festes Reasoning-Budget wählen, selbst wenn sie bereit sind, für zusätzliche Tokens zu zahlen.
Reaktion der Community
Der /r/ClaudeAI-Thread (von u/CaffeineBrogrammer) hinterfragt die Begründung: Wenn adaptives Denken die Leistung verbessert, wie Anthropic behauptet, warum verschwand der Qualitätsabfall in Claude Code, wenn es deaktiviert wurde? Und warum wird die Option für zahlende API-Kunden entfernt, die eine vorhersagbare Reasoning-Tiefe wünschen? Skeptiker sehen darin eine Kostensenkungsmaßnahme, die als Verbesserung getarnt wird.
Für wen es relevant ist
Entwickler, die Claude Code, Claude API mit erweitertem Denken oder konsistente Reasoning-Budgets für qualitätssensitive Aufgaben verwenden.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Google: 75 % des neuen Codes sind KI-generiert, Code-Migration mit Agents 6x schneller
Google berichtet, dass 75 % des neuen Codes KI-generiert sind, gegenüber 25 % im Jahr 2024. Eine komplexe Code-Migration wurde mit Gemini-Agenten sechsmal schneller abgeschlossen. In einigen Organisationen haben Ingenieure KI-Nutzungsziele, die an Leistungsbeurteilungen gekoppelt sind.

Qwen3.5-122B-A10B-MINT-MLX läuft reibungslos auf dem M5 Pro mit 64 GB RAM.
Ein Benutzer berichtet von einer erfolgreichen lokalen Bereitstellung des Qwen3.5-122B-A10B-MINT-MLX-Modells auf einem M5 Pro mit 64 GB RAM und erreicht eine Generierungsgeschwindigkeit von 39,58 Token/Sekunde mit spezifischen VRAM-Zuweisungsbefehlen.

Claude-Code v2.1.108 fügt Steuerung der Prompt-Zwischenspeicherung, eine Zusammenfassungsfunktion und die Entdeckung von Slash-Befehlen hinzu.
Claude-Code v2.1.108 führt die Umgebungsvariablen ENABLE_PROMPT_CACHING_1H und FORCE_PROMPT_CACHING_5M zur Cache-TTL-Steuerung ein, fügt eine über /config oder /recap konfigurierbare Sitzungszusammenfassungsfunktion hinzu und ermöglicht dem Modell, integrierte Slash-Befehle über das Skill-Tool zu entdecken.

Google unterzeichnet geheimen Pentagon-Vertrag für 'jede rechtmäßige' Nutzung von KI
Laut einem Bericht hat Google einen Geheimvertrag mit dem US-Verteidigungsministerium unterzeichnet, der es dem Militär erlaubt, die KI-Modelle des Unternehmens für „jeden rechtmäßigen Regierungszweck“ zu nutzen – mit Einschränkungen bei Massenüberwachung und autonomen Waffen, die jedoch nur eine unverbindliche Vereinbarung darstellen.