Lightning MLX: быстрый локальный AI-движок для агентного использования на Apple Silicon выдает 220 токенов/с на Qwen 35B-A3B

✍️ OpenClawRadar📅 Опубликовано: 8 мая 2026 г.🔗 Source
Lightning MLX: быстрый локальный AI-движок для агентного использования на Apple Silicon выдает 220 токенов/с на Qwen 35B-A3B
Ad

Новый движок вывода с открытым исходным кодом для Apple Silicon под названием Lightning MLX заявляет, что он является самым быстрым локальным движком ИИ, специально оптимизированным для агентных рабочих процессов — агентов кодирования, вызова инструментов и задач с коротким временем выполнения. Проект доступен на GitHub по адресу samuelfaj/lightning-mlx.

Результаты тестов

Автор тестировал на MacBook Max M5 с 128 ГБ ОЗУ и сообщил следующие скорости генерации токенов:

  • Qwen3.6-27B: 40,67 ток/с
  • Qwen3.6-35B-A3B: 220,86 ток/с

Эти результаты показывают, что движок особенно эффективен для архитектуры смеси экспертов, используемой в модели Qwen3.6-35B-A3B, которая активирует только часть параметров на каждый токен.

Ad

Ключевые особенности

  • Оптимизирован для агентных сценариев с короткими циклами — генерация кода, вызовы инструментов и быстрые циклы вывода
  • Включает предустановленную конфигурацию под названием MTPLX (пользовательские параметры сэмплирования); автор ищет отзывы о том, подходят ли эти настройки для продакшна
  • Открытый исходный код под лицензией MIT (предположительно) на GitHub

Запрос обратной связи

Создатель активно просит сообщество предоставить:

  • Более качественные тестовые сценарии для локальных агентов кодирования
  • Мнения о предустановленных настройках MTPLX
  • Результаты тестов на других конфигурациях Apple Silicon (например, M1, M2, M3, M4, разные объемы ОЗУ)

Для кого это

Для разработчиков, запускающих локальные LLM на Apple Silicon для агентных рабочих процессов кодирования, которым нужна максимальная скорость вывода.

📖 Источник: r/LocalLLaMA

Ad

👀 Смотрите также

Сообщение другим сессиям Claude Code: межсессионный обмен сообщениями
Инструменты

Сообщение другим сессиям Claude Code: межсессионный обмен сообщениями

Claude Code v2.1.224+ позволяет Клоду отправлять сообщения между вашими сессиями, чтобы координировать параллельную работу, делиться находками и предупреждать о критических изменениях без копирования и вставки.

OpenClawRadar
Microsoft Teams SDK добавляет HTTP-серверный адаптер для существующих AI-агентов
Инструменты

Microsoft Teams SDK добавляет HTTP-серверный адаптер для существующих AI-агентов

SDK Microsoft Teams теперь включает адаптер HTTP-сервера, который позволяет разработчикам подключать существующие AI-агенты к Teams без переписывания их кода. Он работает с цепочками LangChain, ботами Slack и развертываниями Azure Foundry, внедряя конечную точку POST /api/messages в существующие серверы Express.

OpenClawRadar
mindpm: Бесплатный MCP-сервер для постоянного хранения памяти проекта с Claude
Инструменты

mindpm: Бесплатный MCP-сервер для постоянного хранения памяти проекта с Claude

mindpm — это бесплатный, открытый MCP-сервер, который предоставляет Claude локальную базу данных SQLite для отслеживания задач, решений, заметок и сводок сессий в рамках диалогов. Настройка занимает 30 секунд с помощью команды: claude mcp add mindpm -e MINDPM_DB_PATH=~/.mindpm/memory.db -- npx -y mindpm.

OpenClawRadar
Создание альтернативы OpenClaw своими руками с использованием кода Claude в безголовом режиме
Инструменты

Создание альтернативы OpenClaw своими руками с использованием кода Claude в безголовом режиме

Разработчик создал сервер на Python, который отправляет запросы к Claude Code в безголовом режиме, с доступом через Telegram-бота, автоматизацией Hammerspoon и локальным хранением данных в файлах Markdown для задач, расписаний и заметок.

OpenClawRadar