Bonsai 27B: Первая модель класса 27B работает на телефоне — показатели тестов и характеристики

✍️ OpenClawRadar📅 Опубликовано: 15 июля 2026 г.🔗 Source
Bonsai 27B: Первая модель класса 27B работает на телефоне — показатели тестов и характеристики
Ad

Компания PrismML выпустила Bonsai 27B — первую модель с 27 миллиардами параметров, которая помещается и работает на телефоне. Основанная на Qwen 3.6 27B, она использует экстремальное низкобитовое квантование — тернарные или бинарные веса — для сжатия модели до 3,9 ГБ (1-битный вариант) или 5,9 ГБ (тернарный вариант) против 54 ГБ в 16-битной точности.

Два варианта: тернарный и 1-битный

  • Тернарный Bonsai 27B: веса из набора {−1, 0, +1} с групповым масштабированием FP16, эффективно 1,71 бита на вес. Размер: 5,9 ГБ. Ориентирован на ноутбуки с полным рассуждением, вызовом инструментов и агентными возможностями.
  • 1-битный Bonsai 27B: бинарные веса {−1, +1}, эффективно 1,125 бита на вес. Размер: 3,9 ГБ. Умещается в память iPhone 17 Pro.

Оба варианта выполняют всю сеть (эмбеддинги, внимание, MLP, LM head) в низкобитовом режиме — без «запасных люков» повышенной точности. Они поддерживают контекст на 262K токенов, мультимодальное зрение (4-битная башня зрения) и спекулятивное декодирование.

Ad

Результаты тестов (режим рассуждения)

По 15 тестам:

  • Математика (GSM8K, MATH-500, AIME25, AIME26): Qwen 3.6 27B 95,3; тернарный 93,4; 1-битный 91,7
  • Программирование (HumanEval+, MBPP+, LiveCodeBench): 88,7 → 86,0 → 81,9
  • Агентность/Вызов инструментов (BFCL v3, TauBench): 80,0 → 74,0 → 66,0
  • Следование инструкциям (IFEval, IFBench): 78,4 → 71,8 → 65,8
  • Знания/STEM (MMLU-Redux, MuSR): 83,1 → 77,0 → 73,4
  • Зрение (MMMU Pro, OCRBench): 72,6 → 65,2 → 59,6
  • В среднем: 85,0 → 80,5 (сохранение 95%) → 76,1 (сохранение 90%)

Математика и программирование страдают меньше всего — это ключевые аспекты для агентных нагрузок. 1-битный вариант объёмом 3,9 ГБ меньше, чем модель с 2 млрд параметров в полной точности, но при этом обеспечивает интеллект уровня 27B.

Почему локальное выполнение важно для агентов

Агентные задачи требуют множества последовательных вызовов модели — каждый со своим контекстом и структурированным выводом. Облачное выполнение означает задержку на шаг, накопление затрат на токены и отправку личных данных (скриншотов, файлов) по сети. Локальное выполнение устраняет эти ограничения. Bonsai 27B обеспечивает на устройстве многошаговые рассуждения, вызовы инструментов и агентные циклы использования компьютера.

Лицензия и доступность

Оба варианта доступны сегодня под лицензией Apache 2.0.

📖 Источник: HN AI Agents

Ad

👀 Смотрите также

Изучение нового чат-слоя, созданного для ИИ-агентов: требуется обратная связь от сообщества!
Новости

Изучение нового чат-слоя, созданного для ИИ-агентов: требуется обратная связь от сообщества!

В мире ИИ и автоматизации появилось захватывающее новшество с введением нового слоя чата для ИИ-агентов. Создатели приглашают пользователей сообщества OpenClaw поделиться своими отзывами. Узнайте о потенциале этого инновационного инструмента.

OpenClawRadar
Waymo запускает полностью автономные операции с шестым поколением водителя.
Новости

Waymo запускает полностью автономные операции с шестым поколением водителя.

Шестое поколение водителя Waymo начинает полностью автономные операции, предлагая многофункциональный набор сенсоров и современные 17-мегапиксельные камеры.

OpenClawRadar
Индия и ОАЭ объединяются в области суверенитета ИИ с суперкомпьютерами Cerebras
Новости

Индия и ОАЭ объединяются в области суверенитета ИИ с суперкомпьютерами Cerebras

Индия и ОАЭ объединились для развертывания ИИ-суперкомпьютера Cerebras на индийской территории, обходя облачных гигантов США. Сделка с G42 дает Индии право собственности на оборудование и контроль над данными.

OpenClawRadar
Новые кредиты подписки Anthropic Claude: Agent SDK и claude -p получают отдельный ограниченный пул с 15 июня
Новости

Новые кредиты подписки Anthropic Claude: Agent SDK и claude -p получают отдельный ограниченный пул с 15 июня

Начиная с 15 июня подписчики Claude получают отдельный ежемесячный кредит на использование Agent SDK и claude -p: $200/мес для Max 20x, $100 для Max 5x, $20 для Pro. Использование прекращается, когда кредит исчерпан, если не включена дополнительная оплата. Интерактивные Claude Code и чат остаются на подписочном пуле.

OpenClawRadar