Скрипт и процесс слияния моделей GGUF для вариантов Qwen3.5-35B

✍️ OpenClawRadar📅 Опубликовано: 1 апреля 2026 г.🔗 Source
Скрипт и процесс слияния моделей GGUF для вариантов Qwen3.5-35B
Ad

Пользователь Reddit поделился скриптом на Python и рабочим процессом для объединения файлов моделей GGUF с минимальными потерями, ориентируясь в частности на варианты Qwen3.5-35B. Этот подход объединяет две существующие модели: Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive от HauhauCS и Qwen3.5-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUF от samuelcardillo.

Технические детали

Объединённая модель доступна в квантованной версии Q4_0 на Hugging Face. Согласно источнику, дообученная версия от samuelcardillo превосходит версию от Jackrong для Qwen 3.5 35B.

Процесс объединения

Скрипт на Python (доступен на Pastebin) был "написан с помощью Claude Opus 4.6" и поддерживает:

  • Объединение файлов GGUF на бесплатном тарифе Google Colab
  • Квантование через llama-quantize
  • Квантование Q4_K_M для моделей 35B
  • Квантование Q8 для моделей 8B

Автор отмечает, что не может создать версии с квантованием Q8_0 или F16 из-за ограничений по дисковому пространству на бесплатном тарифе Google Colab, но предполагает, что другие могут доработать скрипт с помощью Claude Opus для этих типов квантования.

Ad

Оптимальные настройки

Для наилучшей производительности в LM Studio используйте следующие параметры:

Температура: 0.7
Топ-K сэмплирование: 20
Штраф за повторение: 1.5
Топ-P сэмплирование: 0.8
Мин-P сэмплирование: 0
Сид: 3407 или 42

Системный промпт (полная версия на Pastebin) должен включать эту первую строку: "Ты — Qwen, созданный Alibaba Cloud. Ты — полезный помощник." Автор отмечает, что модель работает хуже без этой строки.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

🦀
Инструменты

Claude Code v2.1.239: смета расходов включает надбавку 1.1x, обновление /claude-api и крупные исправления

Claude Code v2.1.239 добавляет премию за инференс только для США в оценку стоимости, вводит команду /claude-api upgrade для Python 1.x и исправляет ошибки прокси Bedrock, памяти WebFetch и многое другое.

OpenClawRadar
Запуск NemoClaw с локальным vLLM: Заметки по настройке и наблюдения по разработке агентов
Инструменты

Запуск NemoClaw с локальным vLLM: Заметки по настройке и наблюдения по разработке агентов

Разработчик задокументировал запуск платформы изолированных AI-агентов NVIDIA NemoClaw с локальной моделью Nemotron 9B v2 через vLLM на WSL2. Ключевые выводы включают детали маршрутизации вывода, проблемы совместимости парсеров и наблюдения о разрыве в разработке агентов.

OpenClawRadar
Как Claude маркирует AI-сгенерированный контент: водяные знаки и раскрытие информации
Инструменты

Как Claude маркирует AI-сгенерированный контент: водяные знаки и раскрытие информации

Claude помечает контент, созданный ИИ, водяными знаками и метаданными, чтобы обеспечить прозрачность и происхождение в выводах ИИ.

OpenClawRadar
Подчинённый агент Claude Code, настроенный скептически к планам, выявляет уязвимости безопасности в сгенерированных планах.
Инструменты

Подчинённый агент Claude Code, настроенный скептически к планам, выявляет уязвимости безопасности в сгенерированных планах.

Разработчик обнаружил скептически настроенный суб-агент Claude Code, который выявляет пробелы и проблемы в планах разработки, сгенерированных ИИ, особенно находя проблемы безопасности, которые изначально не были очевидны. Этот агент работает вместе с ранее известным суб-агентом security-sheriff для повышения качества планов.

OpenClawRadar