Claude CLI v2.1.154 bricht lokales vLLM — Einzeiliger Patch behebt es

✍️ OpenClawRadar📅 Veröffentlicht: 30. Mai 2026🔗 Source
Claude CLI v2.1.154 bricht lokales vLLM — Einzeiliger Patch behebt es
Ad

Claude CLI v2.1.154 hat Unterstützung für Workflows eingeführt, dabei aber drei neue API-Nachrichtenrollen (ctx, msg und system) hinzugefügt, die die Kompatibilität mit lokalen vLLM-Servern gebrochen haben. Der Fix ist eine einzeilige Änderung in vLLMs Anthropic-Protokolldefinitionen.

Das Problem

Claude CLI-Versionen ≥2.1.154 senden jetzt Nachrichten mit Rollen über user und assistant hinaus. vLLMs Anthropic-API-Endpunkt akzeptierte nur die ursprünglichen zwei Rollen, was dazu führte, dass Anfragen von der CLI bei einem lokalen vLLM-Instance fehlschlugen.

Ad

Der einzeilige Patch

Der Patch aktualisiert das role-Feld in vllm/entrypoints/anthropic/protocol.py, um die neuen Rollen zu erlauben:

--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
 class AnthropicMessage(BaseModel):
     """Message structure"""
-    role: Literal["user", "assistant"]
+    role: Literal["user", "assistant", "ctx", "msg", "system"]

Das war's. Nach Anwendung dieser Änderung können Sie die neuesten Claude CLI-Workflows mit vLLM-basierten lokalen Modellen wie MiniMax-M2.7 (das einzige vom Autor getestete Modell) verwenden.

Wenn Sie einen lokalen anthropic-kompatiblen Endpunkt auf vLLM betreiben, wenden Sie diesen Patch an, um mit Claude CLI ≥2.1.154 weiterzuarbeiten.

📖 Vollständige Quelle lesen: r/LocalLLaMA

Ad

👀 Siehe auch

Stiller Erfolg: Ein Dev-Ansatz für Cron-Job-Benachrichtigungen
Tipps

Stiller Erfolg: Ein Dev-Ansatz für Cron-Job-Benachrichtigungen

Ein Entwickler auf r/openclaw stellt keine Erfolgsbenachrichtigungen mehr für gesunde Cron-Jobs zu, sondern alarmiert nur bei Authentifizierungsfehlern, Zustandskorruption oder wiederholten Fehlschlägen.

OpenClawRadar
Drei übersehene Engpässe in KI-Agent-Workflows: Aufnahme, Kontextmanagement und Modell-Routing
Tipps

Drei übersehene Engpässe in KI-Agent-Workflows: Aufnahme, Kontextmanagement und Modell-Routing

Eine tiefgehende Analyse der drei oft übersehenen Schichten bei der Optimierung von KI-Agenten: saubere Eingabeaufbereitung, Kontextfensterverwaltung über mehrere Schritte hinweg und aufgabengerechte Modelllenkung. Praktische Lösungen umfassen die Verwendung strukturierten Parsings, zusammengefasster Schrittausgaben, typisierter Schemata und der Anpassung von Modellen an die Aufgabenkomplexität.

OpenClawRadar
Fehlstellen in Beiträgen zum Claude Code Workflow: Wiederherstellung, Einschränkungen und Berechtigungsverwaltung
Tipps

Fehlstellen in Beiträgen zum Claude Code Workflow: Wiederherstellung, Einschränkungen und Berechtigungsverwaltung

Happy-Path-Claude-Code-Workflows sind üblich, aber sie vernachlässigen die Wiederherstellung nach schlechten Bearbeitungen, die Durchsetzung von Einschränkungen und das Berechtigungsmanagement – entscheidend für den praktischen Einsatz.

OpenClawRadar
OpenClaw-Agenten werden nach Woche 1 reaktionslos: Probleme mit der Telegram-Integration?
Tipps

OpenClaw-Agenten werden nach Woche 1 reaktionslos: Probleme mit der Telegram-Integration?

Benutzer berichten, dass OpenClaw-Agenten nach der ersten Woche verstummen, und vermuten Probleme mit der Telegram-Integration oder der Langzeitlaufzeit. Neustarts helfen vorübergehend.

OpenClawRadar