Qwen2-0.5B, доработанный для локальной автоматизации задач с использованием llama.cpp

✍️ OpenClawRadar📅 Опубликовано: 22 марта 2026 г.🔗 Source
Qwen2-0.5B, доработанный для локальной автоматизации задач с использованием llama.cpp
Ad

Разработчик дообучил Qwen2-0.5B для автоматизации задач, создав модель, которая работает полностью локально на CPU без необходимости в GPU или облачных API. Проект под названием ACE доступен на GitHub.

Что он делает

  • Принимает задачи на естественном языке (например, "скопируй логи в резервную копию")
  • Определяет тип задачи: атомарная, повторяющаяся или требующая уточнения
  • Генерирует планы выполнения, состоящие из CLI-команд и горячих клавиш
  • Работает полностью локально на CPU (без GPU и облачных API)

Технические детали

  • Базовая модель: Qwen2-0.5B
  • Обучение: дообучение LoRA на примерно 1000 пользовательских примеров задач
  • Квантование: формат GGUF Q4_K_M (размер файла 300 МБ)
  • Вывод: llama.cpp
  • Время вывода: 3-10 секунд на процессорах i3/i5
Ad

Основные сложности при обучении

  • Качество данных: пришлось перегенерировать набор данных 2-3 раза из-за некачественных примеров
  • Переобучение: потребовалось несколько итераций для стабилизации потерь на валидации
  • Обработка токена EOS: модель не прекращала генерацию, пока не была исправлена конфигурация токенизатора
  • Конвертация в GGUF: потребовался тип данных BF16 + квантование imatrix для получения стабильных результатов

Ограничения (v0.1)

  • Требует полных путей к файлам (пока нет интеллектуального поиска файлов)
  • Только вывод на CPU (медленнее на старом оборудовании)
  • Базовое выполнение (без визуального понимания)

Тесты производительности

  • i5 (2018+) с SSD: 3-5 секунд
  • i3 (2015+) с SSD: 5-10 секунд
  • Старое оборудование (Pentium + HDD): 30-90 секунд

Разработчик ищет отзывы о производительности на разном оборудовании, крайних случаях, которые ломают модель, и запросы на функции для v0.2.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

OpenAlly: Локальный ИИ-помощник для Android с управлением телефоном
Инструменты

OpenAlly: Локальный ИИ-помощник для Android с управлением телефоном

OpenAlly — это приложение для Android, которое запускает ИИ-ассистента локально на вашем телефоне через встроенный процесс Node.js, с 51 встроенным навыком и возможностями управления телефоном через компаньон Aster. Оно подключается к 19+ мессенджерам и поддерживает 18 провайдеров моделей с вашими собственными API-ключами.

OpenClawRadar
Отправляйте агентов OpenClaw как участников встречи с голосом, чатом и демонстрацией экрана
Инструменты

Отправляйте агентов OpenClaw как участников встречи с голосом, чатом и демонстрацией экрана

Новый навык позволяет агентам OpenClaw присоединяться к Google Meet, Teams и Zoom в качестве полноценных участников с голосом (STT/TTS), чатом, видео-аватаром и демонстрацией экрана.

OpenClawRadar
Бесплатный оптимизатор сессий Claude: оценщик токенов, компрессор промптов и планировщик сессий
Инструменты

Бесплатный оптимизатор сессий Claude: оценщик токенов, компрессор промптов и планировщик сессий

Разработчик создал бесплатный инструмент без регистрации для управления лимитами использования Claude с тремя функциями: оценщик токенов для предварительного просмотра потребления промптов, компрессор промптов, сокращающий промпты на 40-60% за счёт удаления лишних фраз, и планировщик сессий, группирующий задачи для минимизации перезагрузки контекста.

OpenClawRadar
Gemma4 26B-A4B обеспечивает быструю локальную работу с поддержкой веб-поиска и изображений.
Инструменты

Gemma4 26B-A4B обеспечивает быструю локальную работу с поддержкой веб-поиска и изображений.

Модель gemma-4-26B-A4B демонстрирует производительность около 145 токенов в секунду на RTX 4090 и включает поддержку веб-поиска MCP и работы с изображениями в чат-приложениях. В блоге подробно описана настройка и использование на разных платформах, включая Mac и iPhone.

OpenClawRadar