1-Bit Bonsai Imagen 4B: Generación de Imágenes en Dispositivo vía FLUX.2 Binario/Ternario

✍️ OpenClawRadar📅 Publicado: 1 de junio de 2026🔗 Source
1-Bit Bonsai Imagen 4B: Generación de Imágenes en Dispositivo vía FLUX.2 Binario/Ternario
Ad

PrismML ha lanzado Bonsai Image 4B, una familia de modelos compactos de generación de imágenes derivados de FLUX.2 Klein 4B mediante cuantización binaria y ternaria. Los pesos del transformer de difusión se representan como {−1, +1} (1 bit) o {−1, 0, +1} (ternario) con factores de escala grupales FP16, lo que arroja 1,125 y 1,71 bits efectivos por peso respectivamente.

Especificaciones clave

  • Bonsai Image 4B de 1 bit: huella del transformer 0,93 GB (reducción 8,3× respecto a los 7,75 GB de FLUX.2 Klein 4B en FP16). La carga útil para Apple Silicon (incluyendo codificador de texto comprimido + VAE FP16) es de 3,42 GB.
  • Bonsai Image 4B ternario: huella del transformer 1,21 GB (reducción 6,4×). Carga útil para Apple Silicon 3,88 GB.
  • Memoria activa media para generación de 512×512: 1,5 GB (1 bit) / 1,96 GB (ternario) frente a 11,74 GB del FLUX.2 Klein 4B original.
  • Para 1024×1024: 1,95 GB / 2,38 GB frente a 14,39 GB.
Ad

Benchmarks de rendimiento

El modelo se ejecuta en Apple Silicon (iPhones, iPads, Macs) a través de rutas de bajo nivel MLX, y en GPU CUDA mediante kernels GEMM de bajo nivel Gemlite. Tiempos de generación:

  • iPhone 17 Pro Max: 9,4 segundos para una imagen de 512×512
  • Mac M4 Pro: ~6 segundos para una imagen de 512×512 (hasta 5,6× más rápido que el pipeline MFLUX original en precisión completa)

La reducción del transformer se logra mediante capas binarias/ternarias (~14× / ~10× de compresión respecto a FP16), mientras que un pequeño conjunto de capas de proyección sensibles a la precisión (~5%) permanecen en FP16. El modelo se evalúa en GenEval, HPSv3 y DPG-Bench para calidad y fidelidad del prompt.

Para quién es

Desarrolladores que despliegan generación de imágenes en el dispositivo (portátiles, teléfonos, dispositivos periféricos) que necesitan pesos abiertos e inferencia local práctica sin dependencia de la nube.

📖 Lee la fuente completa: HN LLM Tools

Ad

👀 Ver también

CivBench: Probando el Razonamiento Estratégico de la IA con Civilization VI — El Agente Bombardeó Toulouse Tras Perder la Guerra Cultural
Noticias

CivBench: Probando el Razonamiento Estratégico de la IA con Civilization VI — El Agente Bombardeó Toulouse Tras Perder la Guerra Cultural

Un agente de IA jugando Civilization VI construyó armas nucleares después de que la victoria cultural francesa se volviera inevitable. El experimento, CivBench, evalúa el razonamiento estratégico a largo plazo, algo que benchmarks de opción múltiple como GovBench (99.26% GPT-5) no logran medir. 76 herramientas MCP exponen el estado del juego como texto.

OpenClawRadar
En lugar de prohibir la IA, un profesor redactó un contrato en el aula con los estudiantes
Noticias

En lugar de prohibir la IA, un profesor redactó un contrato en el aula con los estudiantes

Un profesor de ciencias creó un contrato en el aula con sus estudiantes para definir el uso aceptable de la IA, en lugar de prohibirla rotundamente. El contrato abarca transparencia, atribución y responsabilidad.

OpenClawRadar
La Reunión de OpenClaw en Beijing Atrae a un Abarrotado Público Técnico
Noticias

La Reunión de OpenClaw en Beijing Atrae a un Abarrotado Público Técnico

Un encuentro de OpenClaw en Beijing tuvo una asistencia con solo espacio de pie, donde los desarrolladores hicieron preguntas detalladas sobre orquestación multiagente, bucles autónomos y despliegues privados. La audiencia se centró especialmente en una demostración que mostraba a agentes Planificador, Desarrollador y Verificador colaborando de forma autónoma para impulsar una empresa de una sola persona.

OpenClawRadar
Desarrollador Reemplaza Asistente Virtual de $25/hora con Agentes de IA, Enfrenta Implicaciones Éticas
Noticias

Desarrollador Reemplaza Asistente Virtual de $25/hora con Agentes de IA, Enfrenta Implicaciones Éticas

Un desarrollador reemplazó a un asistente virtual de $25/hora con agentes de IA que manejan seguimientos, programación, seguimiento de leads y actualizaciones de CRM. La configuración de IA cuesta alrededor de $1,000/mes y realiza las tareas más rápido y de manera más consistente que el asistente humano.

OpenClawRadar