Qwen3.5-35B-A3B-UD-Q6_K_XL Протестировано в производственных рабочих процессах разработки

Разработчик на r/LocalLLaMA поделился подробными результатами тестирования модели Qwen3.5-35B-A3B-UD-Q6_K_XL в сценариях производственной разработки. Пользователь провёл как бенчмарк-тестирование, так и практическое применение на реальных клиентских проектах.
Показатели производительности
Модель показала результаты бенчмарков 1504pp2048 и 47.71 tg256. Скорость генерации токенов была стабильной при распределении на две видеокарты и увеличилась до 80 токенов в секунду (tps) при работе на одной видеокарте.
Методология тестирования в продакшене
Разработчик тестировал модель на пяти различных проектах, используя Git Worktrees для отката к известным спецификациям и функциям. Спецификации для этих тестов были сгенерированы Claude, при этом разработчик использовал план Max Pro в течение последнего года.
- Тестирование проводилось на проектах JavaScript, Go и Rust
- Использовались Git Worktrees для контроля версий во время тестирования
- Большинство "багов" требовали лишь 5-минутных правок или могли быть исправлены вторым промптом
- Опыт сравнивался с использованием Sonnet 4
Практические результаты и бизнес-последствия
Разработчик сообщил, что Qwen3.5 "справился блестяще" для выполняемой им работы, особенно отметив высокую производительность на проектах Go и Rust. Это заставило серьёзно задуматься о переходе от API-моделей к гибридному подходу: использование передовых моделей через API для генерации спецификаций и ревью, а локальных моделей — для разработки.
Тестирование подняло вопросы о соотношении инвестиций в оборудование и затрат на подписки. Разработчик уже потратил $2000 на Claude Pro Max с июня 2025 года, а потенциальные затраты могут достичь $6800 к 2027 году при продолжении подписок. Это привело к рассмотрению покупки RTX 6000 Pro как бизнес-инвестиции.
Ранее разработчик использовал Qwen Coder для автодополнения кода, но обнаружил, что Qwen3.5 выводит возможности локальных моделей на новый уровень для производственного использования.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

IronBee: Открытый слой верификации для Claude Code и Cursor
IronBee — это открытый слой верификации, который заставляет AI-агентов для программирования тестировать изменения в реальном браузере перед завершением задач. В ходе тестирования он обнаружил ошибки в 82% сессий Claude Code, которые были бы отправлены без проверки.

GrapeRoot Pro добавляет Undo Shield для предотвращения удаления вашего проекта Claude Code
После сообщений на Reddit о том, что Claude Code удаляет целые проекты, GrapeRoot Pro представляет Undo Shield — функцию, которая отслеживает граф сессии Claude и блокирует разрушительные команды, такие как rm -rf, для файлов, которые активно редактировались.

Локальный терминал CRM со встроенным сервером MCP для интеграции с Claude
Разработчик создал персональную CRM, которая работает в терминале с локальным хранилищем SQLite и включает встроенный MCP-сервер, предоставляя Claude доступ к 18 инструментам для управления контактами, сделками и напоминаниями.

Новый API структурированных данных предлагает подписочные цены для агентов LLM.
Разработчик выпустил структурированный API данных, который нормализует цены на подписки для стриминговых платформ, сервисов совместных поездок, приложений для знакомств и других платформ на основе подписок. API предоставляет единообразные JSON-схемы, цены с учетом региона (где доступно) и MCP-совместимые конечные точки для потребления агентами LLM без скрапинга.