Qwen3.6-27B помещается в один 24-ГБ GPU, превосходит бывший 397B MoE на SWE-bench

✍️ OpenClawRadar📅 Опубликовано: 29 апреля 2026 г.🔗 Source
Qwen3.6-27B помещается в один 24-ГБ GPU, превосходит бывший 397B MoE на SWE-bench
Ad

Qwen3.6-27B вышел 22 апреля, представив плотную модель на 27B, которая помещается в один 24-ГБ GPU в Q4_K_M (~16,8 ГБ) и набирает 77,2 на SWE-bench Verified — побив предыдущую модель MoE на 397B (76,2). Для разработчиков, запускающих локальные агенты кодирования на потребительском оборудовании, это меняет порог для способных агентных моделей.

Ключевые характеристики и архитектура

  • Длина контекста 262K
  • Лицензия Apache 2.0
  • Линейное внимание Gated DeltaNet (3 из 4 подслоев) с Gated Attention для остальных
  • «Сохранение рассуждений» переносит цепочки мыслей между витками, уменьшая избыточную генерацию токенов и повышая эффективность кэша KV в длительных агентных сессиях
Ad

Требования к оборудованию

В Q4_K_M модель использует ~16,8 ГБ VRAM, комфортно размещаясь на одной 24-ГБ карте (например, RTX 3090/4090, A10G). Для сравнения, Qwen3-Coder-Next (80B MoE, 3B активных) требует 45–80 ГБ при той же квантизации, ограничиваясь двух-GPU конфигурациями или Apple Silicon с единой памятью от 48 ГБ.

Оговорки и подводные камни

  • НЕ используйте CUDA 13.2 — она выдаёт мусор. Остановитесь на CUDA 13.1 или 12.x.
  • Для пользователей, уже запускающих Coder-Next на оборудовании от 48 ГБ для агентных задач, переход не очевидно полезен.
  • Для пользователей с одним GPU, застрявших на старых или слабых локальных моделях кодирования, Qwen3.6-27B сейчас является самым способным вариантом в tier 24 ГБ.

📖 Читать полный источник: r/LocalLLaMA

Ad

👀 Смотрите также

Агенты ИИ предпочитают структурированные запросы вместо естественного языка в тесте сервера Cala MCP.
Новости

Агенты ИИ предпочитают структурированные запросы вместо естественного языка в тесте сервера Cala MCP.

Команда Cala создала MCP-сервер с тремя способами доступа к графу знаний: запросы на естественном языке, структурированный язык запросов и прямое обход сущностей/связей. Агенты отказались от естественного языка в течение нескольких минут, выбрав структурированные запросы и обход графа без подсказок.

OpenClawRadar
macOS Tahoe 26.5 обновление упоминает Claude AI в примечаниях к выпуску
Новости

macOS Tahoe 26.5 обновление упоминает Claude AI в примечаниях к выпуску

В примечаниях к выпуску macOS Tahoe 26.5 от Apple указан Claude AI наряду с инженерными командами, что является первым известным случаем официального упоминания ИИ в журнале изменений Apple.

OpenClawRadar
错误:Claude Code Telegram插件中MCP通知静默丢失——通过文件轮询和tmux注入的解决方案
Новости

错误:Claude Code Telegram插件中MCP通知静默丢失——通过文件轮询和tmux注入的解决方案

Плагин Telegram для Claude Code работает корректно, но входящие сообщения молча теряются, поскольку Claude Code игнорирует MCP-уведомления на stdio-транспорте. В качестве обходного решения используется опрос файлов и tmux send-keys с задержкой 5–9 с.

OpenClawRadar
Claude Code v2.1.223: Исправления безопасности, подсказка /teleport и псевдоним /review
Новости

Claude Code v2.1.223: Исправления безопасности, подсказка /teleport и псевдоним /review

Claude Code v2.1.223 добавляет подстановочные знаки владельца для настроек маркетплейса, подсказку /teleport и исправляет обход разрешений Bash.

OpenClawRadar