Gemma 4 Lançado: Quatro Tamanhos de Modelo para Hospedagem Local de IA

✍️ OpenClawRadar📅 Publicado: April 6, 2026🔗 Source
Gemma 4 Lançado: Quatro Tamanhos de Modelo para Hospedagem Local de IA
Ad

Especificações do Modelo Gemma 4

O Gemma 4 agora está disponível como um modelo de IA auto-hospedado com quatro configurações distintas para diferentes cenários de hardware. De acordo com a fonte, ele não compete com Claude, Codex ou Gemini, mas é posicionado como uma opção prática para cenários de roteamento múltiplo onde um modelo auto-hospedado pequeno e capaz pode economizar tokens.

Variantes do Modelo e Requisitos de Hardware

  • E2B (2,3 bilhões de parâmetros efetivos): Construído para dispositivos de borda como telefones e Raspberry Pi. Requer ~4-8GB de RAM e roda bem em uma CPU. Recomendado para hospedagem em VPS.
  • E4B (4,5 bilhões de parâmetros efetivos): Construído para laptops e hardware de baixo custo. Mantém uma pegada de memória baixa.
  • 26B MoE (25B total, 3,8B ativos): Construído para GPUs de consumo. Opera em velocidades de inferência semelhantes a um modelo de 4B.
  • 31B Denso: Construído para GPUs de médio porte e estações de trabalho. Requer aproximadamente 16-20GB de VRAM ao usar quantização de 4 bits.
Ad

Capacidades e Disponibilidade

Todos os modelos Gemma 4 são multimodais com capacidades de texto e visão. Os modelos de borda E2B e E4B especificamente suportam áudio em tempo real. Os modelos são construídos para raciocínio avançado e fluxos de trabalho agentivos.

O Gemma 4 está disponível no Google AI Studio, Hugging Face, Kaggle e Ollama.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Eficiência de Tokens do Opus 4.7: Prompts em Alemão Consomem Até 2x Mais Tokens que em Inglês
News

Eficiência de Tokens do Opus 4.7: Prompts em Alemão Consomem Até 2x Mais Tokens que em Inglês

Um assinante do Claude Pro relata que usar alemão com Opus 4.7 consumiu 100% dos tokens da sessão em segundos, enquanto o inglês usou 37%. A ineficiência do tokenizador decorre de substantivos compostos e umlauts, causando uso de tokens 1,5–2x maior.

OpenClawRadar
Meta adquire Moltbook, um fórum no estilo Reddit para agentes de IA
News

Meta adquire Moltbook, um fórum no estilo Reddit para agentes de IA

A Meta adquiriu a Moltbook, uma plataforma de fórum no estilo Reddit projetada especificamente para agentes de IA. A aquisição foi confirmada na terça-feira, com os criadores da Moltbook ingressando nos Superintelligence Labs da Meta.

OpenClawRadar
OpenClaw 2026.6.5: Pesquisa Paralela Gratuita, Correções de Estabilidade em Geral
News

OpenClaw 2026.6.5: Pesquisa Paralela Gratuita, Correções de Estabilidade em Geral

OpenClaw 2026.6.5 adiciona Parallel Search gratuito e sem configuração, respostas de canal mais seguras, melhor recuperação de execução de agente e configuração de provedor/modelo menos frágil.

OpenClawRadar
Anthropic reverte política sobre SDK de agente de terceiros e claude-p, reduz valor de inferência efetivo em 25-40x para assinantes máximos
News

Anthropic reverte política sobre SDK de agente de terceiros e claude-p, reduz valor de inferência efetivo em 25-40x para assinantes máximos

A Anthropic reverteu a proibição de agentes de terceiros usarem credenciais de assinatura, mas moveu o claude-p e o Agent SDK para um pool de créditos separado, sem rollover, cobrado pelas taxas da API, reduzindo o valor efetivo de inferência em 25 a 40 vezes para assinantes Max.

OpenClawRadar