Claude CLI v2.1.154 ломает локальный vLLM — исправление в одну строку

✍️ OpenClawRadar📅 Опубликовано: 30 мая 2026 г.🔗 Source
Claude CLI v2.1.154 ломает локальный vLLM — исправление в одну строку
Ad

Claude CLI v2.1.154 добавил поддержку рабочих процессов, но вместе с этим ввёл три новые роли сообщений API (ctx, msg и system), которые нарушили совместимость с локальными серверами vLLM. Исправление заключается в изменении одной строки в определениях протокола Anthropic в vLLM.

Проблема

Claude CLI версий ≥2.1.154 теперь отправляет сообщения с ролями, отличными от user и assistant. Конечная точка API Anthropic от vLLM принимала только исходные две роли, из-за чего запросы от CLI к локальному экземпляру vLLM завершались ошибкой.

Ad

Патч из одной строки

Патч обновляет поле role в файле vllm/entrypoints/anthropic/protocol.py, чтобы разрешить новые роли:

--- a/vllm/entrypoints/anthropic/protocol.py
+++ b/vllm/entrypoints/anthropic/protocol.py
@@ -65,7 +65,7 @@ class AnthropicContentBlock(BaseModel):
 class AnthropicMessage(BaseModel):
     """Message structure"""
-    role: Literal["user", "assistant"]
+    role: Literal["user", "assistant", "ctx", "msg", "system"]

Вот и всё. После применения этого изменения вы сможете использовать новейшие рабочие процессы Claude CLI с локальными моделями на основе vLLM, такими как MiniMax-M2.7 (единственная модель, протестированная автором).

Если вы запускаете локальную конечную точку, совместимую с Anthropic, на vLLM, примените этот патч, чтобы продолжить работу с Claude CLI ≥2.1.154.

📖 Читать полный источник: r/LocalLLaMA

Ad

👀 Смотрите также

Память рабочего процесса против инструментов: почему загрузка контекста эффективнее гигантских промптов
Советы

Память рабочего процесса против инструментов: почему загрузка контекста эффективнее гигантских промптов

Вместо того чтобы запихивать инструкции в промпты, загружайте чек-листы для конкретных рабочих процессов по мере необходимости — чек-лист релиза, правила горячего исправления, шаги миграции — и убирайте их, когда работа завершена.

OpenClawRadar
Как я взаимодействую с ИИ-моделями в 2026 году по сравнению с прошлым годом: 3 ключевых изменения
Советы

Как я взаимодействую с ИИ-моделями в 2026 году по сравнению с прошлым годом: 3 ключевых изменения

Разработчик делится тремя конкретными изменениями: перейти от шаблонов промптов к переиспользуемым навыкам, писать цели вместо пошаговых инструкций и использовать команды /loop для долгих проектов в Claude Code и Codex.

OpenClawRadar
Claude Code лучше работает в качестве рецензента кода, чем генератора.
Советы

Claude Code лучше работает в качестве рецензента кода, чем генератора.

Разработчик делится, что Claude Code выдает более обоснованные результаты при использовании для проверки существующего кода, а не для генерации с нуля. Ключевые практики включают начало сессий с текущими реализациями, ведение файлов контекста проекта и перезапуск сессий при ухудшении ответов.

OpenClawRadar
ИИ-агенты раскрыли мои небрежные промпты: чёткость побеждает более умные модели
Советы

ИИ-агенты раскрыли мои небрежные промпты: чёткость побеждает более умные модели

Пост на Reddit показывает, что ИИ-агенты не исправляют нечеткие задачи — они просто делают обратную связь мгновенной. Настоящая проблема заключалась в недостаточной ясности со стороны пользователя.

OpenClawRadar