Пользователь Reddit сообщает о 18,8 ток/с при CPU-инференсе модели Qwen 3 30B Q4 на архитектуре Zen 4.

✍️ OpenClawRadar📅 Опубликовано: 15 апреля 2026 г.🔗 Source
Пользователь Reddit сообщает о 18,8 ток/с при CPU-инференсе модели Qwen 3 30B Q4 на архитектуре Zen 4.
Ad

Пользователь Reddit поделился своим опытом тестирования локального вывода LLM на процессоре вместо инвестиций в дорогое графическое оборудование.

Ключевые детали

Пользователь рассматривал возможность покупки графического оборудования для локального вывода LLM, включая:

  • Графические процессоры P40
  • Графические процессоры V100 (почти купил версию SXM2, которая не подключается к обычным материнским платам)
  • Графические процессоры RTX 3090 (стоимостью от $800+ из-за спроса на ИИ)

После совета сначала попробовать вывод на процессоре, он протестировал:

  • Модель: Qwen 3 30B Q4
  • Оборудование: Процессор Zen 4 с памятью DDR5
  • Производительность: 18,8 токенов в секунду на процессоре
  • Ожидание против реальности: Ожидал 3-5 ток/с, получил почти 19 ток/с

Пользователь отметил, что «Zen 4 + DDR5 просто взломан для вывода».

Ad

Результаты практического тестирования

Пользователь провел сравнение реальных задач по программированию:

  • Модель на 8B «уверенно писала совершенно неправильный код»
  • Модель на 30B «справилась с первого раза»
  • Он описал производительность модели на 30B как «практически уровень GPT-4o за $0»

Это говорит о том, что для определенных задач программирования правильно квантованная модель на 30B, работающая на современном процессорном оборудовании, может давать результаты, сравнимые с более крупными облачными моделями, без инвестиций в оборудование, обычно связанных с локальным выводом LLM.

📖 Прочитать полный источник: r/LocalLLaMA

Ad

👀 Смотрите также

Anthropic ограничивает использование подписки на Claude в сторонних инструментах, таких как OpenClaw.
Новости

Anthropic ограничивает использование подписки на Claude в сторонних инструментах, таких как OpenClaw.

Anthropic меняет политику подписки на Claude, блокируя использование в сторонних оболочках, включая OpenClaw, и с 4 апреля требует отдельной оплаты по мере использования для этих инструментов. Компания предлагает единовременный кредит, равный ежемесячной стоимости подписки, и скидки до 30% при предварительной покупке.

OpenClawRadar
Огайо приостанавливает налоговые льготы для дата-центров: рост затрат на ИИ давит на технологические компании
Новости

Огайо приостанавливает налоговые льготы для дата-центров: рост затрат на ИИ давит на технологические компании

Огайо приостанавливает действие налоговой льготы на оборудование для новых центров обработки данных, включая те, что обслуживают ИИ. Этот шаг сигнализирует о растущем внимании штатов к налоговым стимулам на фоне всплеска спроса на инфраструктуру ИИ.

OpenClawRadar
🦀
Новости

Qwen3 27B превосходит Gemma 4 26B в реальном вызове инструментов для локального AI-видеопаплайна

Эксперимент с локальным AI-видеопайплайном показывает, что Qwen3 27B чисто обрабатывает вызовы инструментов, тогда как Gemma 4 26B застревает в циклах. Также рассматриваются Said Image Turbo для локальной генерации изображений и оркестрация OpenCode с контекстом 174K.

OpenClawRadar
Claude Code v2.1.81 добавляет флаг bare для скриптов, исправляет проблемы с аутентификацией и голосовым режимом.
Новости

Claude Code v2.1.81 добавляет флаг bare для скриптов, исправляет проблемы с аутентификацией и голосовым режимом.

Claude Code v2.1.81 представляет флаг --bare для скриптовых вызовов -p, который пропускает хуки, LSP и синхронизацию плагинов, требуя ANTHROPIC_API_KEY или apiKeyHelper через --settings. В релизе также исправлены проблемы аутентификации в нескольких одновременных сессиях, обработка ошибок в голосовом режиме и добавлена передача разрешений --channels.

OpenClawRadar