Qwen3.5-35B-A3B-UD-Q6_K_XL Протестировано в производственных рабочих процессах разработки

Разработчик на r/LocalLLaMA поделился подробными результатами тестирования модели Qwen3.5-35B-A3B-UD-Q6_K_XL в сценариях производственной разработки. Пользователь провёл как бенчмарк-тестирование, так и практическое применение на реальных клиентских проектах.
Показатели производительности
Модель показала результаты бенчмарков 1504pp2048 и 47.71 tg256. Скорость генерации токенов была стабильной при распределении на две видеокарты и увеличилась до 80 токенов в секунду (tps) при работе на одной видеокарте.
Методология тестирования в продакшене
Разработчик тестировал модель на пяти различных проектах, используя Git Worktrees для отката к известным спецификациям и функциям. Спецификации для этих тестов были сгенерированы Claude, при этом разработчик использовал план Max Pro в течение последнего года.
- Тестирование проводилось на проектах JavaScript, Go и Rust
- Использовались Git Worktrees для контроля версий во время тестирования
- Большинство "багов" требовали лишь 5-минутных правок или могли быть исправлены вторым промптом
- Опыт сравнивался с использованием Sonnet 4
Практические результаты и бизнес-последствия
Разработчик сообщил, что Qwen3.5 "справился блестяще" для выполняемой им работы, особенно отметив высокую производительность на проектах Go и Rust. Это заставило серьёзно задуматься о переходе от API-моделей к гибридному подходу: использование передовых моделей через API для генерации спецификаций и ревью, а локальных моделей — для разработки.
Тестирование подняло вопросы о соотношении инвестиций в оборудование и затрат на подписки. Разработчик уже потратил $2000 на Claude Pro Max с июня 2025 года, а потенциальные затраты могут достичь $6800 к 2027 году при продолжении подписок. Это привело к рассмотрению покупки RTX 6000 Pro как бизнес-инвестиции.
Ранее разработчик использовал Qwen Coder для автодополнения кода, но обнаружил, что Qwen3.5 выводит возможности локальных моделей на новый уровень для производственного использования.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

Приложение Claude Desktop добавляет функцию проектов в интерфейс совместной работы.
В настольном приложении Claude теперь доступна функция «Проекты» в интерфейсе Cowork, позволяющая пользователям организовывать задачи и контекст в выделенных рабочих пространствах. Файлы и инструкции остаются на локальном компьютере пользователя, с возможностью импортировать существующие проекты или создавать новые.

Детерминированная архитектура компилятора для многошаговых LLM-процессов демонстрирует высокие результаты в тестах.
Детерминированная архитектура компиляции для структурированных рабочих процессов LLM использует типизированные реестры узлов, контракты параметров и статическую валидацию для компиляции графов рабочих процессов заранее. Бенчмарки показывают, что она превосходит GPT-4.1 и Claude Sonnet 4.6 при глубине рабочих процессов от 3 до 12+ узлов.

Плагин Creative Excellence для Claude Code повышает качество анимации с помощью тезиса взаимодействия
Новый плагин с открытым исходным кодом для Claude Code решает проблему создания шаблонных анимаций, внедряя подход 'интерактивной концепции', при котором Claude должен сначала описать идею движения, прежде чем писать код. Плагин включает 8 поднавыков, охватывающих GSAP, Framer Motion, CSS-анимации и принципы дизайна из изученных репозиториев.

Плагин SLOP добавляет агентам OpenClaw осведомленность о состоянии приложений в реальном времени.
Новый плагин OpenClaw интегрируется с SLOP (State Layer for Observable Programs), предоставляя ИИ-агентам структурированный доступ к состоянию приложений и контекстным действиям. Плагин автоматически обнаруживает приложения с поддержкой SLOP через каталог ~/.slop/providers/ и мост расширения Chrome.