Punto de referencia: Gemma4 12B frente a Qwen3 8B cuantizado en Mac Mini de 24GB

✍️ OpenClawRadar📅 Publicado: 21 de abril de 2026🔗 Source
Punto de referencia: Gemma4 12B frente a Qwen3 8B cuantizado en Mac Mini de 24GB
Ad

Comparación de rendimiento de dos modelos locales para OpenClaw

Un desarrollador realizó una prueba directa comparando Gemma4 12B y Qwen3:8b-q4_K_M en una Mac Mini de 24GB. La prueba utilizó dos indicaciones: "explica cómo funciona un carburador" y "escribe una función en Python para detectar fugas de memoria". Claude ayudó a escribir un comando para buscar en la salida con grep para la medición.

Resultados del benchmark

Tarea de explicación del carburador:

  • Qwen3:8b-q4_K_M: Evaluación de indicación: 89.8 t/s, Generación: 19.6 t/s
  • Gemma4: Evaluación de indicación: 20.8 t/s, Generación: 27.6 t/s

Tarea de programación en Python:

  • Qwen3:8b-q4_K_M: Evaluación de indicación: 133.8 t/s, Generación: 18.7 t/s
  • Gemma4: Evaluación de indicación: 26.1 t/s, Generación: 26.1 t/s
Ad

Hallazgos clave

Qwen3 procesa las indicaciones 4-5 veces más rápido que Gemma4, lo cual es importante para OpenClaw debido a las indicaciones de contexto grande que normalmente se envían. Gemma4 genera la salida ligeramente más rápido. Para muchos usos de OpenClaw, Qwen3 gana en velocidad. El desarrollador señala que Gemma4 es un modelo de 12B y podría producir una salida ligeramente mejor, aunque esto no fue probado.

El desarrollador ejecuta varias tareas en modelos locales incluyendo trabajos cron, monitoreo de latidos, indexación de memoria, y a menudo hace que OpenClaw llame a subagentes que ejecutan modelos locales. Están probando Gemma4 como el modelo local para todas estas tareas en segundo plano pero no esperan notar diferencias de rendimiento ya que estas se ejecutan en segundo plano.

📖 Read the full source: r/openclaw

Ad

👀 Ver también

Engramx v3.4: MCP Server + Grafo de Conocimiento SQLite Reduce el Uso de Tokens de Claude Code en un 89%
Herramientas

Engramx v3.4: MCP Server + Grafo de Conocimiento SQLite Reduce el Uso de Tokens de Claude Code en un 89%

Engramx v3.4 intercepta las lecturas de archivos para los agentes de Claude Code, devolviendo resúmenes estructurales en lugar del contenido bruto. Los benchmarks muestran una reducción agregada de tokens del 89.1% en una base de código de 87 archivos.

OpenClawRadar
Medidor de Acelerador: Medidor de Uso de Código Claude de Código Abierto para macOS
Herramientas

Medidor de Acelerador: Medidor de Uso de Código Claude de Código Abierto para macOS

Aplicación de código abierto para la barra de menú de macOS que lee registros locales de Claude Code para mostrar el uso en tiempo real de 5 horas y semanal, con notificaciones de umbral y ganchos de ahorro de tokens. También tiene un hermano comercial de €19 con modo Exacto (lee la API interna de claude.ai a través de Safari).

OpenClawRadar
MemAware Benchmark Prueba la Memoria de la IA Más Allá de la Búsqueda por Palabras Clave
Herramientas

MemAware Benchmark Prueba la Memoria de la IA Más Allá de la Búsqueda por Palabras Clave

MemAware es un punto de referencia con 900 preguntas en 3 niveles de dificultad que evalúa si los asistentes de IA con memoria pueden recuperar contexto relevante cuando las consultas no lo sugieren. Los resultados muestran que la búsqueda BM25 obtuvo un 2,8 % frente al 0,8 % sin memoria, mientras que la búsqueda vectorial cae al 0,7 % en conexiones entre dominios.

OpenClawRadar
Modo Contexto: Un Servidor MCP que Comprime las Salidas de Herramientas para Claude Code
Herramientas

Modo Contexto: Un Servidor MCP que Comprime las Salidas de Herramientas para Claude Code

Context Mode es un servidor MCP que se sitúa entre Claude Code y las salidas de herramientas, procesándolas en entornos aislados y devolviendo solo resúmenes. Reduce 315 KB de salida MCP a 5.4 KB, extendiendo el tiempo de sesión antes de la ralentización de ~30 minutos a ~3 horas.

OpenClawRadar