Gemma 4 выпущена: четыре размера моделей для локального размещения ИИ

✍️ OpenClawRadar📅 Опубликовано: 6 апреля 2026 г.🔗 Source
Gemma 4 выпущена: четыре размера моделей для локального размещения ИИ
Ad

Спецификации модели Gemma 4

Gemma 4 теперь доступна как самоуправляемая ИИ-модель с четырьмя различными конфигурациями для разных сценариев использования оборудования. Согласно источнику, она не конкурирует с Claude, Codex или Gemini, а позиционируется как практичный вариант для многомаршрутных сценариев, где небольшая, но способная самоуправляемая модель может экономить токены.

Варианты моделей и требования к оборудованию

  • E2B (2,3 млрд эффективных параметров): Создана для периферийных устройств, таких как телефоны и Raspberry Pi. Требует ~4-8 ГБ оперативной памяти и хорошо работает на процессоре. Рекомендуется для размещения на VPS.
  • E4B (4,5 млрд эффективных параметров): Создана для ноутбуков и недорогого оборудования. Сохраняет низкое потребление памяти.
  • 26B MoE (25 млрд всего, 3,8 млрд активных): Создана для потребительских графических процессоров. Работает со скоростью вывода, аналогичной модели на 4 млрд параметров.
  • 31B Dense: Создана для графических процессоров среднего класса и рабочих станций. Требует примерно 16-20 ГБ видеопамяти при использовании 4-битного квантования.
Ad

Возможности и доступность

Все модели Gemma 4 являются мультимодальными с возможностями обработки текста и изображений. Модели для периферийных устройств E2B и E4B специально поддерживают работу с аудио в реальном времени. Модели созданы для расширенного логического вывода и агентных рабочих процессов.

Gemma 4 доступна в Google AI Studio, Hugging Face, Kaggle и Ollama.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Slurm Coding: Искусственный интеллект в разработке, где время исчезает
Новости

Slurm Coding: Искусственный интеллект в разработке, где время исчезает

Разработчик описывает 'сламовое кодирование' как интенсивный паттерн разработки, который стал возможен благодаря инструментам ИИ-кодирования, когда небольшие идеи быстро превращаются в полноценные системы через цикл быстрой реализации и выброса дофамина.

OpenClawRadar
Ограничения распознавания речи Claude и обходной путь пользователя с помощью Spokenly и Parakeet TDT
Новости

Ограничения распознавания речи Claude и обходной путь пользователя с помощью Spokenly и Parakeet TDT

Пользователь сообщает, что встроенная микрофонная транскрипция Claude неточна по сравнению с ChatGPT, создавая больше работы, чем экономит. Они реализовали обходное решение с использованием Spokenly на Mac с моделью Parakeet TDT от NVIDIA для улучшения производительности.

OpenClawRadar
Kimi K2.6 против Claude Opus 4.7: Практическое тестирование с модом доски объявлений Minetest
Новости

Kimi K2.6 против Claude Opus 4.7: Практическое тестирование с модом доски объявлений Minetest

Разработчик протестировал Kimi K2.6 и Claude Opus 4.7 на создании мода доски объявлений для Minetest/Luanti с бэкендом на TypeScript и логированием в Google Sheets. Opus справился чисто; Kimi провалил интеграционную часть.

OpenClawRadar
Claude Code v2.1.215: /verify и /code-review больше не автоматические
Новости

Claude Code v2.1.215: /verify и /code-review больше не автоматические

Claude Code v2.1.215 прекращает автоматический запуск навыков /verify и /code-review. Теперь их нужно вызывать явно с помощью команд /verify или /code-review.

OpenClawRadar