Claude CLI v2.1.154 rompe vLLM local — Un parche de una línea lo soluciona

Claude CLI v2.1.154 introdujo soporte para flujos de trabajo, pero al hacerlo añadió tres nuevos roles de mensajes en la API (ctx, msg y system) que rompieron la compatibilidad con servidores locales de vLLM. La solución es un cambio de una línea en las definiciones del protocolo Anthropic de vLLM.
El problema
Las versiones de Claude CLI ≥2.1.154 ahora envían mensajes con roles más allá de user y assistant. El endpoint de la API Anthropic de vLLM solo aceptaba los dos roles originales, provocando que las solicitudes del CLI fallaran al apuntar a una instancia local de vLLM.
El parche de una línea
El parche actualiza el campo role en vllm/entrypoints/anthropic/protocol.py para permitir los nuevos roles:
--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
class AnthropicMessage(BaseModel):
"""Message structure"""
- role: Literal["user", "assistant"]
+ role: Literal["user", "assistant", "ctx", "msg", "system"]Eso es todo. Tras aplicar este cambio, puedes usar los flujos de trabajo más recientes de Claude CLI con modelos locales basados en vLLM como MiniMax-M2.7 (el único modelo probado por el autor).
Si ejecutas un endpoint local compatible con Anthropic en vLLM, aplica este parche para seguir funcionando con Claude CLI ≥2.1.154.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

Usuario de Claude Comparte el Prompt 'No Gestiones Mis Sentimientos' para Retroalimentación Técnica Directa
Un usuario de Claude recomienda configurar un prompt específico en las preferencias del usuario para reducir el preámbulo de validación y obtener comentarios técnicos más directos. El prompt le indica a Claude que omita las frases diplomáticas y proporcione críticas directas sobre el trabajo técnico y creativo.

El grupo de límite de tasa OAuth no documentado de Anthropic requiere el mensaje del sistema Claude Code
Al usar tokens OAuth de Anthropic, la API dirige las solicitudes al grupo de límite de tasa de Claude Code según si tu prompt del sistema se identifica como Claude Code. Agregar "Eres Claude Code, la CLI oficial de Anthropic para Claude." a tu prompt del sistema resuelve misteriosos errores 429.

Hábitos Prácticos para una Interacción Crítica con LLM
Una publicación de Reddit describe técnicas específicas para evitar el sesgo de confirmación al trabajar con LLMs, incluyendo modos de instrucción personalizados como 'strawberry' para explicaciones neutrales y 'socrates' para escrutinio adversario, además de evaluar la composición de los datos de entrenamiento.

Presupuesto de la API de OpenClaw Agotado: Configuraciones que Debes Cambiar Inmediatamente
La función Heartbeat predeterminada de OpenClaw puede agotar los presupuestos de API al verificar tareas cada 30 minutos y cargar archivos de contexto completos, memoria e historial de chat cada vez. La fuente recomienda cambiar las Horas Activas, usar modelos base más económicos, cambiar manualmente a modelos premium solo cuando sea necesario y usar /new para reiniciar sesiones.