Claude CLI v2.1.154 Quebra vLLM Local — Correção de Uma Linha Resolve

O Claude CLI v2.1.154 introduziu suporte a workflows, mas ao fazer isso adicionou três novos papéis de mensagens na API (ctx, msg e system) que quebraram a compatibilidade com servidores vLLM locais. A correção é uma alteração de uma linha nas definições do protocolo Anthropic do vLLM.
O Problema
Versões do Claude CLI ≥2.1.154 agora enviam mensagens com papéis além de user e assistant. O endpoint da API Anthropic do vLLM só aceitava os dois papéis originais, fazendo com que as requisições do CLI falhassem ao apontar para uma instância local do vLLM.
O Patch de Uma Linha
O patch atualiza o campo role em vllm/entrypoints/anthropic/protocol.py para permitir os novos papéis:
--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
class AnthropicMessage(BaseModel):
"""Estrutura da mensagem"""
- role: Literal["user", "assistant"]
+ role: Literal["user", "assistant", "ctx", "msg", "system"]É isso. Após aplicar esta alteração, você pode usar os workflows mais recentes do Claude CLI com modelos locais baseados em vLLM, como o MiniMax-M2.7 (o único modelo testado pelo autor).
Se você executa um endpoint compatível com Anthropic no vLLM local, aplique este patch para continuar funcionando com o Claude CLI ≥2.1.154.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

4 Arquivos Que Fizeram Claude Code Escrever Código Seguro de Banco de Dados em Produção
Um desenvolvedor compartilha quatro arquivos—CLAUDE.md, MEMORY.md, framework.md, decisions/log.md—mais uma ponte Python com chaves de idempotência e guardas de escrita que permitem que o Claude Code escreva com segurança em um banco de dados de produção do Convex.

Por que a maioria das falhas no pipeline do Claude se deve aos prompts, não aos modelos — e como corrigir com habilidades
Uma postagem no Reddit argumenta que a causa raiz das falhas em pipelines de Claude é tratar prompts como habilidades. A solução: definir contratos de entrada, esquemas de saída e um arquivo de aprendizados — transformando uma habilidade no que você promove para v1.

8 Meses de Uso Diário: 9 Dicas Práticas com Claude (Não Codificação)
Um usuário do Reddit compartilha 9 lições aprendidas em 8 meses de uso diário do Claude para escrita e pesquisa—não código—abordando edição, gerenciamento de contexto, configuração de estilo e uso do Claude como parceiro de pensamento.

Token Master: Conceito Arquitetônico para Economizar 30-70% nos Custos de Agentes de IA
Uma abordagem arquitetônica detalhada para roteamento inteligente multi-modelo que pode reduzir drasticamente o consumo de tokens.