Bonsai 27B: Primer modelo de clase 27B funciona en un teléfono — Puntuaciones de referencia y especificaciones

✍️ OpenClawRadar📅 Publicado: 15 de julio de 2026🔗 Source
Bonsai 27B: Primer modelo de clase 27B funciona en un teléfono — Puntuaciones de referencia y especificaciones
Ad

PrismML ha lanzado Bonsai 27B, el primer modelo de 27 mil millones de parámetros que cabe y funciona en un teléfono. Basado en Qwen 3.6 27B, utiliza cuantización extrema de baja precisión — pesos ternarios o binarios — para reducir el modelo a 3.9 GB (variante de 1 bit) o 5.9 GB (variante ternaria), frente a los 54 GB en precisión de 16 bits.

Dos Variantes: Ternaria vs 1 bit

  • Bonsai 27B Ternaria: pesos en {−1, 0, +1} con escalado grupal FP16, 1.71 bits efectivos por peso. Tamaño: 5.9 GB. Dirigida a laptops con razonamiento completo, llamada a herramientas y capacidad de agente.
  • Bonsai 27B de 1 bit: pesos binarios {−1, +1}, 1.125 bits efectivos por peso. Tamaño: 3.9 GB. Cabe en el presupuesto de memoria del iPhone 17 Pro.

Ambas variantes ejecutan la totalidad de la red (embeddings, atención, MLPs, cabeza LM) en baja precisión — sin puertas de escape de mayor precisión. Soportan contexto de 262K tokens, visión multimodal (torre de visión de 4 bits) y decodificación especulativa.

Ad

Puntuaciones de Benchmarks (modo de pensamiento)

En un conjunto de 15 benchmarks:

  • Matemáticas (GSM8K, MATH-500, AIME25, AIME26): Qwen 3.6 27B 95.3, Ternaria 93.4, 1 bit 91.7
  • Programación (HumanEval+, MBPP+, LiveCodeBench): 88.7 → 86.0 → 81.9
  • Agentes/Llamada a herramientas (BFCL v3, TauBench): 80.0 → 74.0 → 66.0
  • Seguimiento de instrucciones (IFEval, IFBench): 78.4 → 71.8 → 65.8
  • Conocimiento/STEM (MMLU-Redux, MuSR): 83.1 → 77.0 → 73.4
  • Visión (MMMU Pro, OCRBench): 72.6 → 65.2 → 59.6
  • General: 85.0 → 80.5 (95% de retención) → 76.1 (90% de retención)

Las matemáticas y la programación son las menos afectadas — clave para cargas de trabajo de agentes. La variante de 1 bit con 3.9 GB es más pequeña que un modelo de 2B parámetros en precisión completa, pero ofrece inteligencia de clase 27B.

Por qué la Ejecución Local es Importante para los Agentes

Las cargas de trabajo de agentes requieren muchas llamadas secuenciales al modelo — cada una con contexto y produciendo salida estructurada. La ejecución solo en la nube implica latencia por paso, costos de tokens acumulativos y envío de datos privados (capturas de pantalla, archivos) a través de la red. Ejecutar localmente elimina esas limitaciones. Bonsai 27B permite bucles de agente en el dispositivo con razonamiento de múltiples pasos, llamadas a herramientas y uso de computadora.

Licencia y Disponibilidad

Ambas variantes están disponibles hoy bajo la Licencia Apache 2.0.

📖 Lee la fuente completa: HN AI Agents

Ad

👀 Ver también

Talento Connect de Amazon: Agentes de IA automatizan entrevistas de trabajo masivas
Noticias

Talento Connect de Amazon: Agentes de IA automatizan entrevistas de trabajo masivas

Amazon lanza Connect Talent, un agente de IA que realiza entrevistas de trabajo automatizadas para contrataciones a gran escala. El software maneja el cribado, las entrevistas y la toma de notas sin intervención humana, y forma parte de una apuesta más amplia por los agentes de IA autónomos.

OpenClawRadar
CC v2.1.122: Eliminaciones de Prompt del Sistema, Actualización de Depuración y Aumento de Confianza en el Cronograma
Noticias

CC v2.1.122: Eliminaciones de Prompt del Sistema, Actualización de Depuración y Aumento de Confianza en el Cronograma

Claude Code CC v2.1.122 elimina el prompt independiente de la fase cuatro en modo plan, mejora la alternativa de contexto de depuración del daemon y eleva el umbral de confianza de la oferta /schedule del 70%+ al 85%+.

OpenClawRadar
🦀
Noticias

Debian vota sobre la política de contribuciones de IA/LLM: Lo que los desarrolladores necesitan saber

Debian ha comenzado a votar sobre el futuro de las contribuciones de IA/LLM. El resultado determinará cómo se maneja el código generado por IA en los paquetes de Debian.

OpenClawRadar
Oracle considera recortes de 20.000 a 30.000 empleos y la venta de Cerner para financiar la expansión de centros de datos de IA.
Noticias

Oracle considera recortes de 20.000 a 30.000 empleos y la venta de Cerner para financiar la expansión de centros de datos de IA.

Oracle está considerando recortar entre 20.000 y 30.000 puestos de trabajo y vender su unidad de software sanitario Cerner para liberar entre 8.000 y 10.000 millones de dólares en flujo de caja para la expansión de centros de datos de IA, mientras los bancos estadounidenses se retiran de financiar el despliegue de infraestructura de 156.000 millones de dólares de la empresa.

OpenClawRadar