Claude CLI v2.1.154 rompe vLLM local — Un parche de una línea lo soluciona

✍️ OpenClawRadar📅 Publicado: 30 de mayo de 2026🔗 Source
Claude CLI v2.1.154 rompe vLLM local — Un parche de una línea lo soluciona
Ad

Claude CLI v2.1.154 introdujo soporte para flujos de trabajo, pero al hacerlo añadió tres nuevos roles de mensajes en la API (ctx, msg y system) que rompieron la compatibilidad con servidores locales de vLLM. La solución es un cambio de una línea en las definiciones del protocolo Anthropic de vLLM.

El problema

Las versiones de Claude CLI ≥2.1.154 ahora envían mensajes con roles más allá de user y assistant. El endpoint de la API Anthropic de vLLM solo aceptaba los dos roles originales, provocando que las solicitudes del CLI fallaran al apuntar a una instancia local de vLLM.

Ad

El parche de una línea

El parche actualiza el campo role en vllm/entrypoints/anthropic/protocol.py para permitir los nuevos roles:

--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
 class AnthropicMessage(BaseModel):
     """Message structure"""
-    role: Literal["user", "assistant"]
+    role: Literal["user", "assistant", "ctx", "msg", "system"]

Eso es todo. Tras aplicar este cambio, puedes usar los flujos de trabajo más recientes de Claude CLI con modelos locales basados en vLLM como MiniMax-M2.7 (el único modelo probado por el autor).

Si ejecutas un endpoint local compatible con Anthropic en vLLM, aplica este parche para seguir funcionando con Claude CLI ≥2.1.154.

📖 Lee la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Usuario de Claude Comparte el Prompt 'No Gestiones Mis Sentimientos' para Retroalimentación Técnica Directa
Consejos

Usuario de Claude Comparte el Prompt 'No Gestiones Mis Sentimientos' para Retroalimentación Técnica Directa

Un usuario de Claude recomienda configurar un prompt específico en las preferencias del usuario para reducir el preámbulo de validación y obtener comentarios técnicos más directos. El prompt le indica a Claude que omita las frases diplomáticas y proporcione críticas directas sobre el trabajo técnico y creativo.

OpenClawRadar
El grupo de límite de tasa OAuth no documentado de Anthropic requiere el mensaje del sistema Claude Code
Consejos

El grupo de límite de tasa OAuth no documentado de Anthropic requiere el mensaje del sistema Claude Code

Al usar tokens OAuth de Anthropic, la API dirige las solicitudes al grupo de límite de tasa de Claude Code según si tu prompt del sistema se identifica como Claude Code. Agregar "Eres Claude Code, la CLI oficial de Anthropic para Claude." a tu prompt del sistema resuelve misteriosos errores 429.

OpenClawRadar
Hábitos Prácticos para una Interacción Crítica con LLM
Consejos

Hábitos Prácticos para una Interacción Crítica con LLM

Una publicación de Reddit describe técnicas específicas para evitar el sesgo de confirmación al trabajar con LLMs, incluyendo modos de instrucción personalizados como 'strawberry' para explicaciones neutrales y 'socrates' para escrutinio adversario, además de evaluar la composición de los datos de entrenamiento.

OpenClawRadar
Presupuesto de la API de OpenClaw Agotado: Configuraciones que Debes Cambiar Inmediatamente
Consejos

Presupuesto de la API de OpenClaw Agotado: Configuraciones que Debes Cambiar Inmediatamente

La función Heartbeat predeterminada de OpenClaw puede agotar los presupuestos de API al verificar tareas cada 30 minutos y cargar archivos de contexto completos, memoria e historial de chat cada vez. La fuente recomienda cambiar las Horas Activas, usar modelos base más económicos, cambiar manualmente a modelos premium solo cuando sea necesario y usar /new para reiniciar sesiones.

OpenClawRadar