Referência: Gemma4 12B vs Qwen3 8B quantizado em Mac Mini de 24GB

✍️ OpenClawRadar📅 Publicado: April 21, 2026🔗 Source
Referência: Gemma4 12B vs Qwen3 8B quantizado em Mac Mini de 24GB
Ad

Comparação de desempenho de dois modelos locais para OpenClaw

Um desenvolvedor realizou um teste direto comparando o Gemma4 12B e o Qwen3:8b-q4_K_M em um Mac Mini de 24GB. O teste usou dois prompts: "explique como funciona um carburador" e "escreva uma função Python para detectar vazamentos de memória". O Claude ajudou a escrever um comando para filtrar a saída com grep para medição.

Resultados do benchmark

Tarefa de explicação do carburador:

  • Qwen3:8b-q4_K_M: Avaliação do prompt: 89,8 t/s, Geração: 19,6 t/s
  • Gemma4: Avaliação do prompt: 20,8 t/s, Geração: 27,6 t/s

Tarefa de codificação Python:

  • Qwen3:8b-q4_K_M: Avaliação do prompt: 133,8 t/s, Geração: 18,7 t/s
  • Gemma4: Avaliação do prompt: 26,1 t/s, Geração: 26,1 t/s
Ad

Principais conclusões

O Qwen3 processa prompts 4-5x mais rápido que o Gemma4, o que é importante para o OpenClaw devido aos prompts de contexto grandes normalmente enviados. O Gemma4 gera a saída um pouco mais rápido. Para muitos usos do OpenClaw, o Qwen3 vence em velocidade. O desenvolvedor observa que o Gemma4 é um modelo de 12B e pode produzir uma saída ligeiramente melhor, embora isso não tenha sido testado.

O desenvolvedor executa várias tarefas em modelos locais, incluindo trabalhos cron, monitoramento de heartbeat, indexação de memória, e frequentemente faz o OpenClaw chamar subagentes executando modelos locais. Eles estão testando o Gemma4 como o modelo local para todas essas tarefas em segundo plano, mas não esperam notar diferenças de desempenho, já que estas rodam em segundo plano.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Kontext CLI: Corretor de Credenciais para Agentes de IA de Codificação
Tools

Kontext CLI: Corretor de Credenciais para Agentes de IA de Codificação

O Kontext CLI é um corretor de credenciais baseado em Go que fornece aos agentes de codificação de IA tokens de acesso de curta duração em vez de chaves de API de longa duração. Ele usa a troca de tokens RFC 8693, transmite logs de auditoria para cada chamada de ferramenta e funciona com o Claude Code hoje.

OpenClawRadar
Marmy: Um Aplicativo Móvel Auto-Hospedado para Gerenciar Múltiplas Sessões de Agentes de IA de Codificação
Tools

Marmy: Um Aplicativo Móvel Auto-Hospedado para Gerenciar Múltiplas Sessões de Agentes de IA de Codificação

Marmy é uma ferramenta de código aberto e auto-hospedada, desenvolvida com Claude Code, que permite gerenciar múltiplas sessões de agentes de IA para programação diretamente do seu celular. Ele inclui um agente Rust para suas máquinas, um aplicativo iOS, navegação de arquivos com realce de sintaxe, notificações push e uma arquitetura de gerenciador-agente.

OpenClawRadar
As 5 Maiores Coleções de Claude Code SKILL.md Rastreadas no GitHub — Tabela Classificável com Atualização Automática
Tools

As 5 Maiores Coleções de Claude Code SKILL.md Rastreadas no GitHub — Tabela Classificável com Atualização Automática

Construiu uma tabela classificável dos 5 maiores repositórios de coleções de habilidades (totalizando 125k estrelas) com contagens de estrelas e habilidades, atualizada automaticamente pelo comando /workflows:skill-collections.

OpenClawRadar
Orloj: Runtime de Orquestração Declarativa para Sistemas de IA Multiagente
Tools

Orloj: Runtime de Orquestração Declarativa para Sistemas de IA Multiagente

Orloj v0.1.0 é um runtime de orquestração de código aberto que permite definir agentes de IA, ferramentas, políticas e fluxos de trabalho em manifestos YAML com GitOps. Ele gerencia agendamento, execução, governança e confiabilidade para sistemas multiagente em produção.

OpenClawRadar