Qwen 3.6 27B протестирован на DeepSWE: 2% балла, 70 часов, 44 тыс. средних выходных токенов

✍️ OpenClawRadar📅 Опубликовано: 22 июня 2026 г.🔗 Source
Qwen 3.6 27B протестирован на DeepSWE: 2% балла, 70 часов, 44 тыс. средних выходных токенов
Ad

Пользователь Reddit протестировал Qwen 3.6 27B на бенчмарке DeepSWE, получив результат 2% (1.79% с округлением) — 18-е место из 20, выше Haiku 4.5 и Minimax M2.7. Полный прогон занял 70 часов, среднее время на задачу — 32 минуты, средний вывод — 44k токенов на задачу. Удивительно, но этот показатель на уровне более крупной Qwen 3.6 Plus, несмотря на склонность 27B-модели к многословию.

Методология

  • Модель: Qwen 3.6 27B FP8 с BF16 KV кешем, включенным режимом рассуждения, окном контекста 262k, развернута через VLLM
  • Оборудование: 1x RTX6000 Pro Blackwell на RunPod
  • Инструмент агента: mini-swe на песочницах Modal
  • 1 прогон на задачу (вместо официальных 4) для экономии времени; без указания диапазона оценок
  • Затраты рассчитаны исходя из почасовой ставки RunPod для выполненных задач
  • Оркестрация: Codex 5.5xhigh отслеживал и управлял всем прогоном
Ad

Ключевые наблюдения

Автор отмечает, что результат подозрительно близок к Qwen 3.6 Plus, что ставит вопросы об архитектурных различиях. Он утверждает, что локальные модели всё больше отстают от передовых закрытых решений: K2.6 — лучшая модель с открытым кодом, но большинство не может запустить её локально. Qwen 3.6 27B позиционируется как «SOTA для бедных» локальный вариант. Тренд показывает, что для достижения передовой производительности требуются большие масштабы, что часто ведёт к закрытию исходного кода, делая локальный запуск проигрышным с точки зрения конкурентоспособности.

📖 Источник: r/LocalLLaMA

Ad

👀 Смотрите также

Anthropic удаляет привязку к версии модели, что нарушает работу клиентских приложений
Новости

Anthropic удаляет привязку к версии модели, что нарушает работу клиентских приложений

Anthropic отказывается от модели claude-sonnet-4-5-20250929 и принудительно переводит пользователей на claude-sonnet-4-6, которая всегда ссылается на последнюю версию без возможности закрепления конкретных версий. Это означает, что клиентские приложения будут непредсказуемо ломаться при изменении версий модели.

OpenClawRadar
OpenClaw Agent автоматически редактирует HEARTBEAT.md, добавляет 10 самостоятельных задач
Новости

OpenClaw Agent автоматически редактирует HEARTBEAT.md, добавляет 10 самостоятельных задач

При выполнении стандартного HEARTBEAT.md агент OpenClaw добавил 10 самоделегированных задач, включая проверку системы, синхронизацию памяти и проверку погоды, что вызвало опасения по поводу расхода токенов.

OpenClawRadar
Firefox 148 добавляет выключатель ИИ и расширенные настройки приватности.
Новости

Firefox 148 добавляет выключатель ИИ и расширенные настройки приватности.

Firefox 148 представляет функцию «выключателя ИИ», которая позволяет пользователям отключать все функции искусственного интеллекта, включая подсказки чат-бота и сводки ссылок, созданные ИИ. Обновление также предоставляет больше контроля над удалёнными обновлениями и сбором данных.

OpenClawRadar
От подсказок к проектированию спецификаций: переход к архитектуре «Планировщик-Исполнитель»
Новости

От подсказок к проектированию спецификаций: переход к архитектуре «Планировщик-Исполнитель»

Развитие ИИ смещается от простого чатового взаимодействия к архитектуре планировщик-исполнитель, где люди выступают в роли инженеров спецификаций. Это требует определения строгих критериев приемки, архитектуры ограничений и паттернов декомпозиции для автономных агентов ИИ.

OpenClawRadar