Claude CLI v2.1.154 bricht lokales vLLM — Einzeiliger Patch behebt es

Claude CLI v2.1.154 hat Unterstützung für Workflows eingeführt, dabei aber drei neue API-Nachrichtenrollen (ctx, msg und system) hinzugefügt, die die Kompatibilität mit lokalen vLLM-Servern gebrochen haben. Der Fix ist eine einzeilige Änderung in vLLMs Anthropic-Protokolldefinitionen.
Das Problem
Claude CLI-Versionen ≥2.1.154 senden jetzt Nachrichten mit Rollen über user und assistant hinaus. vLLMs Anthropic-API-Endpunkt akzeptierte nur die ursprünglichen zwei Rollen, was dazu führte, dass Anfragen von der CLI bei einem lokalen vLLM-Instance fehlschlugen.
Der einzeilige Patch
Der Patch aktualisiert das role-Feld in vllm/entrypoints/anthropic/protocol.py, um die neuen Rollen zu erlauben:
--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
class AnthropicMessage(BaseModel):
"""Message structure"""
- role: Literal["user", "assistant"]
+ role: Literal["user", "assistant", "ctx", "msg", "system"]Das war's. Nach Anwendung dieser Änderung können Sie die neuesten Claude CLI-Workflows mit vLLM-basierten lokalen Modellen wie MiniMax-M2.7 (das einzige vom Autor getestete Modell) verwenden.
Wenn Sie einen lokalen anthropic-kompatiblen Endpunkt auf vLLM betreiben, wenden Sie diesen Patch an, um mit Claude CLI ≥2.1.154 weiterzuarbeiten.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

Stiller Erfolg: Ein Dev-Ansatz für Cron-Job-Benachrichtigungen
Ein Entwickler auf r/openclaw stellt keine Erfolgsbenachrichtigungen mehr für gesunde Cron-Jobs zu, sondern alarmiert nur bei Authentifizierungsfehlern, Zustandskorruption oder wiederholten Fehlschlägen.

Drei übersehene Engpässe in KI-Agent-Workflows: Aufnahme, Kontextmanagement und Modell-Routing
Eine tiefgehende Analyse der drei oft übersehenen Schichten bei der Optimierung von KI-Agenten: saubere Eingabeaufbereitung, Kontextfensterverwaltung über mehrere Schritte hinweg und aufgabengerechte Modelllenkung. Praktische Lösungen umfassen die Verwendung strukturierten Parsings, zusammengefasster Schrittausgaben, typisierter Schemata und der Anpassung von Modellen an die Aufgabenkomplexität.

Fehlstellen in Beiträgen zum Claude Code Workflow: Wiederherstellung, Einschränkungen und Berechtigungsverwaltung
Happy-Path-Claude-Code-Workflows sind üblich, aber sie vernachlässigen die Wiederherstellung nach schlechten Bearbeitungen, die Durchsetzung von Einschränkungen und das Berechtigungsmanagement – entscheidend für den praktischen Einsatz.

OpenClaw-Agenten werden nach Woche 1 reaktionslos: Probleme mit der Telegram-Integration?
Benutzer berichten, dass OpenClaw-Agenten nach der ersten Woche verstummen, und vermuten Probleme mit der Telegram-Integration oder der Langzeitlaufzeit. Neustarts helfen vorübergehend.