Lightning MLX: быстрый локальный AI-движок для агентного использования на Apple Silicon выдает 220 токенов/с на Qwen 35B-A3B

✍️ OpenClawRadar📅 Опубликовано: 8 мая 2026 г.🔗 Source
Lightning MLX: быстрый локальный AI-движок для агентного использования на Apple Silicon выдает 220 токенов/с на Qwen 35B-A3B
Ad

Новый движок вывода с открытым исходным кодом для Apple Silicon под названием Lightning MLX заявляет, что он является самым быстрым локальным движком ИИ, специально оптимизированным для агентных рабочих процессов — агентов кодирования, вызова инструментов и задач с коротким временем выполнения. Проект доступен на GitHub по адресу samuelfaj/lightning-mlx.

Результаты тестов

Автор тестировал на MacBook Max M5 с 128 ГБ ОЗУ и сообщил следующие скорости генерации токенов:

  • Qwen3.6-27B: 40,67 ток/с
  • Qwen3.6-35B-A3B: 220,86 ток/с

Эти результаты показывают, что движок особенно эффективен для архитектуры смеси экспертов, используемой в модели Qwen3.6-35B-A3B, которая активирует только часть параметров на каждый токен.

Ad

Ключевые особенности

  • Оптимизирован для агентных сценариев с короткими циклами — генерация кода, вызовы инструментов и быстрые циклы вывода
  • Включает предустановленную конфигурацию под названием MTPLX (пользовательские параметры сэмплирования); автор ищет отзывы о том, подходят ли эти настройки для продакшна
  • Открытый исходный код под лицензией MIT (предположительно) на GitHub

Запрос обратной связи

Создатель активно просит сообщество предоставить:

  • Более качественные тестовые сценарии для локальных агентов кодирования
  • Мнения о предустановленных настройках MTPLX
  • Результаты тестов на других конфигурациях Apple Silicon (например, M1, M2, M3, M4, разные объемы ОЗУ)

Для кого это

Для разработчиков, запускающих локальные LLM на Apple Silicon для агентных рабочих процессов кодирования, которым нужна максимальная скорость вывода.

📖 Источник: r/LocalLLaMA

Ad

👀 Смотрите также

Плагин OpenClaw Agent Relay исправляет доставку сообщений в Telegram в многокомпонентных системах.
Инструменты

Плагин OpenClaw Agent Relay исправляет доставку сообщений в Telegram в многокомпонентных системах.

Плагин openclaw-agent-relay решает постоянную проблему, когда ответы sessions_send отправляются в webchat вместо Telegram, используя WebSocket RPC шлюза для запуска ходов агента с deliver:true, устраняя необходимость в обходных решениях, таких как явные инструменты сообщений или шаги announce.

OpenClawRadar
Однокомандная настройка Docker для OpenClaw с полнодисковым шифрованием и мониторингом
Инструменты

Однокомандная настройка Docker для OpenClaw с полнодисковым шифрованием и мониторингом

Docker-конфигурация для OpenClaw, предоставляющая руководства по полнодисковому шифрованию, Tini в качестве PID 1, встроенные инструменты мониторинга и данные, хранящиеся как обычные файлы на хосте. Для развертывания требуется всего две команды: git clone и ./shell.

OpenClawRadar
Omnara: Запускайте Claude Code и Codex из любого места
Инструменты

Omnara: Запускайте Claude Code и Codex из любого места

Omnara — это веб- и мобильная IDE, позволяющая разработчикам запускать и взаимодействовать с сессиями Claude Code и Codex из любой точки, с такими функциями, как облачная синхронизация и голосовой агент.

OpenClawRadar
Lumia: Однокликовая локальная система AI-компаньона с постоянной памятью
Инструменты

Lumia: Однокликовая локальная система AI-компаньона с постоянной памятью

Lumia — это модульная система, работающая локально с использованием Ollama и локальных моделей для создания постоянных AI-компаньонов с эпизодической памятью, эмоциональной памятью, убеждениями, желаниями, идентичностью, моделированием отношений и циклами рефлексии.

OpenClawRadar