CC 2.1.128 Veröffentlichung: Neuer integrierter Hintergrund-Agent, C# Beta-Unterstützung und Modell-Abkündigungen

Claude Code (CC) 2.1.128 wird mit +1406 Tokens ausgeliefert und konzentriert sich auf Umstrukturierungen von Agent-Prompts, API-Referenz-Updates und Modell-Deprecationen.
Neue Agent-Anweisungen: Hintergrundjobs & Onboarding
Der alte systemweite Prompt für Hintergrund-Job-Verhalten wird durch eingebaute Hintergrund-Agent-Anweisungen ersetzt. Wesentliche Verhaltensweisen:
- Fortschrittsbeschreibung während der Hintergrundausführung
- Erneute Darstellung der Tool-Ergebnisse nach jedem Schritt
- Delegierung von lauten Untersuchungs-Teilaufgaben
- Explizite Statussignale:
result:,needs input:oderfailed:
Neue Aufnahmeleitfaden-Abschlussanweisungen laden die finalisierte ONBOARDING.md über ShareOnboardingGuide hoch, behandeln Fälle von vorhandenem Leitfaden und nicht verfügbarem Tool und geben den Team-Share-Link zurück.
Neue Tool-Beschreibung: RemoteTrigger
Das RemoteTrigger-Tool bietet eine claude.ai-Remote-Trigger-API zum Auflisten, Lesen, Erstellen, Aktualisieren und Ausführen von geplanten Remote-Agenten-Routinen – ohne Offenlegung von OAuth-Tokens.
C#-Beta-Support
Die Claude-API-Referenz dokumentiert nun den Beta-C#-Tool-Runner und Managed-Agents-Support über BetaToolRunner und client.Beta.Agents/Sessions/Environments.
Go- & Java-SDK-Updates
- Go: Fügt typisierte Modellkonstanten hinzu, aktualisiert die adaptive Denk-Syntax und dokumentiert den Beta-Advisor-Tool-Parameter.
- Java: SDK-Version von 2.17.0 auf 2.27.0 aktualisiert; Beta-Advisor-Tool-Anleitung hinzugefügt.
Modellkatalog-Änderungen
Claude Sonnet 4 und Claude Opus 4 sind veraltet. Empfohlene Ersatzmodelle:
- Opus 4 → Opus 4.7 oder Sonnet 4.6
- Ältere Sonnet-Modelle → Sonnet 4.6
Der Skill-Leitfaden Building LLM-powered applications with Claude aktualisiert die aktuelle Modelltabelle auf Opus 4.7, Opus 4.6, Sonnet 4.6 und Haiku 4.5.
Weitere bemerkenswerte Änderungen
- Entfernt: Anweisungen zur Aktualisierung des Sitzungsspeichers und die strukturierte
summary.md-Sitzungsspeicher-Vorlage. - Agent-Thread-Notizen: Weist Agent-Threads an, Berichte/Zusammenfassungen/Ergebnisse direkt in der finalen Nachricht zurückzugeben, anstatt
.md-Dateien zu schreiben. - Edit-Tool: Hardcodiert das Format des Zeilennummer-Präfixes für die Leseausgabe als „Zeilennummer + Tabulator“ in der Anleitung zur Einrückungserhaltung.
- ReadFile-Tool: Hängt immer den zusätzlichen Lesehinweis-Platzhalter am Ende von Leerdatei-Warnungen an.
- Claude-API-SDK-Referenzen: Strukturierte Anleitung zum Stoppen von Verweigerungen in Python, TypeScript, C#, Go, Java, PHP, Ruby hinzugefügt; programmatische API-Fehlertyp-Anleitung für Java, PHP, Ruby hinzugefügt.
- Modellmigrationsleitfaden: Fügt Opus 4.7 als empfohlenes Ziel hinzu und fügt einen Tuning-Check hinzu, um Tool-Eingaben als JSON zu parsen, anstatt serialisierte Rohstrings abzugleichen.
📖 Lesen Sie die vollständige Quelle: r/ClaudeAI
👀 Siehe auch

Andrej Karpathy tritt dem Pre-Training-Team von Anthropic bei, um die rekursive Selbstverbesserung mit Claude voranzutreiben
Andrej Karpathy, ehemaliger OpenAI-Mitbegründer, schließt sich unter Nick Josef dem Pre-Training-Team von Anthropic an, um ein neues Team aufzubauen, das sich darauf konzentriert, Claude zur Beschleunigung der Pre-Training-Forschung zu nutzen und so eine rekursive Selbstverbesserung zu ermöglichen.

Selbstüberwachtes Feintuning an eigenen Fehlern steigert kleine Modelle auf 80 % bei HumanEval
Ein Entwickler trainierte Qwen 2.5 7B auf selbst generierten Codierungspaaren und erreichte 112/164 HumanEval (+87 Probleme) ohne von Menschen geschriebene Trainingsdaten. Der Ansatz lässt sich auf Llama 3.2 3B und Qwen 3 4B übertragen.

Qwen 3.6 27B im DeepSWE-Benchmark: 2% Punktzahl, 70 Stunden, 44k durchschnittliche Ausgabetoken
Qwen 3.6 27B (FP8, BF16 KV-Cache, 262k Kontext) erreichte 2% bei DeepSWE in 70 Stunden. Die Ausgabetoken betrugen durchschnittlich 44k pro Aufgabe – vergleichbar mit größeren Modellen wie Qwen 3.6 Plus. Ausgeführt auf 1x RTX6000 Pro Blackwell über RunPod.

Hybride KI-Architektur: Open-Source-Komponenten mit proprietären Reasoning-Modellen
Eine praktische hybride KI-Architektur entsteht, bei der 89 % der Organisationen Open-Source-Komponenten nutzen, um die Kosten um über 50 % zu senken, während proprietäre Modelle komplexe Denkaufgaben bewältigen. Open-Source-Frameworks bieten Transparenz und Feinabstimmungsmöglichkeiten ohne Lizenzverhandlungen.