Gemma 4 Lançado: Quatro Tamanhos de Modelo para Hospedagem Local de IA

Especificações do Modelo Gemma 4
O Gemma 4 agora está disponível como um modelo de IA auto-hospedado com quatro configurações distintas para diferentes cenários de hardware. De acordo com a fonte, ele não compete com Claude, Codex ou Gemini, mas é posicionado como uma opção prática para cenários de roteamento múltiplo onde um modelo auto-hospedado pequeno e capaz pode economizar tokens.
Variantes do Modelo e Requisitos de Hardware
- E2B (2,3 bilhões de parâmetros efetivos): Construído para dispositivos de borda como telefones e Raspberry Pi. Requer ~4-8GB de RAM e roda bem em uma CPU. Recomendado para hospedagem em VPS.
- E4B (4,5 bilhões de parâmetros efetivos): Construído para laptops e hardware de baixo custo. Mantém uma pegada de memória baixa.
- 26B MoE (25B total, 3,8B ativos): Construído para GPUs de consumo. Opera em velocidades de inferência semelhantes a um modelo de 4B.
- 31B Denso: Construído para GPUs de médio porte e estações de trabalho. Requer aproximadamente 16-20GB de VRAM ao usar quantização de 4 bits.
Capacidades e Disponibilidade
Todos os modelos Gemma 4 são multimodais com capacidades de texto e visão. Os modelos de borda E2B e E4B especificamente suportam áudio em tempo real. Os modelos são construídos para raciocínio avançado e fluxos de trabalho agentivos.
O Gemma 4 está disponível no Google AI Studio, Hugging Face, Kaggle e Ollama.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Eficiência de Tokens do Opus 4.7: Prompts em Alemão Consomem Até 2x Mais Tokens que em Inglês
Um assinante do Claude Pro relata que usar alemão com Opus 4.7 consumiu 100% dos tokens da sessão em segundos, enquanto o inglês usou 37%. A ineficiência do tokenizador decorre de substantivos compostos e umlauts, causando uso de tokens 1,5–2x maior.

Meta adquire Moltbook, um fórum no estilo Reddit para agentes de IA
A Meta adquiriu a Moltbook, uma plataforma de fórum no estilo Reddit projetada especificamente para agentes de IA. A aquisição foi confirmada na terça-feira, com os criadores da Moltbook ingressando nos Superintelligence Labs da Meta.

OpenClaw 2026.6.5: Pesquisa Paralela Gratuita, Correções de Estabilidade em Geral
OpenClaw 2026.6.5 adiciona Parallel Search gratuito e sem configuração, respostas de canal mais seguras, melhor recuperação de execução de agente e configuração de provedor/modelo menos frágil.

Anthropic reverte política sobre SDK de agente de terceiros e claude-p, reduz valor de inferência efetivo em 25-40x para assinantes máximos
A Anthropic reverteu a proibição de agentes de terceiros usarem credenciais de assinatura, mas moveu o claude-p e o Agent SDK para um pool de créditos separado, sem rollover, cobrado pelas taxas da API, reduzindo o valor efetivo de inferência em 25 a 40 vezes para assinantes Max.