Modelo de lenguaje Transformer ejecutándose localmente en un Game Boy Color estándar
Un desarrollador ha logrado que un modelo de lenguaje transformador real funcione en un Game Boy Color (GBC) estándar, sin necesidad de teléfono, PC, Wi-Fi ni inferencia en la nube. Todo el proceso de inferencia se ejecuta localmente en el hardware portátil.
Detalles clave
- Modelo: TinyStories-260K de Andrej Karpathy, convertido a pesos INT8 con matemáticas de punto fijo, sin necesidad de soporte de coma flotante.
- Hardware: Game Boy Color estándar + EZ Flash Junior (cartucho flash) + tarjeta microSD.
- Cadena de herramientas: GBDK-2020, que produce un ROM MBC5 para Game Boy.
- Arquitectura de memoria: Los pesos del modelo residen en la ROM del cartucho con bancos. La caché KV se almacena en la SRAM del cartucho debido a que la RAM de trabajo del GBC es muy pequeña.
- Ingreso de texto: En el propio dispositivo, usando el D-pad y botones con un teclado en pantalla.
- Proceso de inferencia: Tokenización del texto en el GBC, luego precarga del transformador y generación autorregresiva con almacenamiento en caché KV.
- Rendimiento: Extremadamente lento; la salida es ininteligible debido a la fuerte cuantización y aproximaciones matemáticas, pero el bucle principal del transformador funciona.
- Código fuente: Disponible en GitHub en github.com/maddiedreese/gbc-transformer. Una gran parte del código fue creado usando Codex AI.
El proyecto demuestra que incluso hardware con recursos extremadamente limitados puede ejecutar inferencia de transformadores con técnicas agresivas de cuantización y gestión de memoria. Es una prueba de concepto, no un LLM práctico, pero es una curiosidad técnica que vale la pena examinar.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Minions de Stripe: Mejorando la Productividad de los Desarrolladores con Agentes de Codificación de Un Solo Uso de Extremo a Extremo.
Los Minions de Stripe son agentes de codificación de un solo uso, de extremo a extremo, diseñados para aumentar la productividad de los desarrolladores al automatizar tareas complejas dentro del ecosistema de Stripe.

GLM-5.1 Lanzado con Rendimiento de Codificación Igualando a Claude Opus 4.5
El modelo GLM-5.1 de Zhipu AI ya está disponible para todos los usuarios del Plan de Codificación, logrando 77.8 puntos en SWE-bench-Verified y 56.2 puntos en Terminal Bench 2.0. El modelo cuenta con una ventana de contexto de 200K, una salida máxima de 128K y 744B parámetros con 40B activados.

DeepSeek retiene su último modelo de IA de Nvidia y AMD
DeepSeek está reteniendo su último modelo de IA de los fabricantes de chips estadounidenses, incluidos Nvidia y AMD, según fuentes de Reuters. El artículo tiene 19 puntos y 3 comentarios en Hacker News.

Claude Code AFK Auto-Continue: Anatomía de una Característica Defectuosa
En julio de 2026, Anthropic lanzó un huevo de pascua en Claude Code v2.1.198: un temporizador de 60 segundos que continúa automáticamente si pierdes la ventana de entrada. Sin entrada en el changelog. Revertido en v2.1.200.