GuppyLM: Un LLM de 9M Parámetros Construido desde Cero con Fines Educativos

Qué es GuppyLM
GuppyLM es un modelo de lenguaje diminuto (~9 millones de parámetros) que finge ser un pez llamado Guppy. Está construido desde cero para demostrar cómo funcionan los modelos de lenguaje sin requerir un doctorado o un enorme clúster de GPU. El proyecto incluye generación de datos, creación de tokenizador, arquitectura del modelo, bucle de entrenamiento e inferencia—todo en aproximadamente 130 líneas de código en PyTorch.
Detalles de la Arquitectura
- Parámetros: 8.7M
- Capas: 6
- Dimensión oculta: 384
- Cabezas: 6
- FFN: 768 (ReLU)
- Vocabulario: 4,096 (BPE)
- Secuencia máxima: 128 tokens
- Normalización: LayerNorm
- Posición: Incrustaciones aprendidas
- Cabeza LM: Peso compartido con las incrustaciones
Este es un transformador básico sin GQA, RoPE, SwiGLU o salida temprana—lo más simple posible.
Entrenamiento y Datos
El modelo se entrena en 60,000 conversaciones sintéticas en 60 temas en aproximadamente 5 minutos en una GPU T4 gratuita de Colab. El conjunto de datos (arman-bd/guppylm-60k-generic en HuggingFace) contiene 57,000 muestras de entrenamiento y 3,000 de prueba en formato: {"input": "...", "output": "...", "category": "..."}.
Los temas incluyen: saludos, sentimientos, temperatura, comida, luz, agua, acuario, ruido, noche, soledad, burbujas, vidrio, reflejo, respiración, natación, colores, sabor, plantas, filtro, algas, caracoles, miedo, emoción, aburrimiento, curiosidad, felicidad, cansancio, exterior, gatos, lluvia, estaciones, música, visitantes, niños, significado de la vida, tiempo, memoria, sueños, tamaño, futuro, pasado, nombre, clima, sueño, amigos, chistes, miedo, amor, edad, inteligencia, salud, canto, televisión y más.
Personalidad y Salida
Guppy habla en oraciones cortas y en minúsculas sobre agua, temperatura, luz, vibraciones y comida. No comprende abstracciones humanas como dinero, teléfonos o política. Conversación de ejemplo:
Tú> hola guppy Guppy> hola. acabo de encontrar un buen lugar cerca de la roca. la temperatura se siente agradable. Tú> tienes hambre Guppy> sí. siempre sí. nadaré hacia la superficie ahora mismo. prometo comerlo todo. Tú> cuál es el significado de la vida Guppy> comida. la respuesta siempre es comida.
Inicio Rápido
Chatea con Guppy (sin entrenamiento necesario): Descarga el modelo preentrenado de HuggingFace. Solo ejecuta todas las celdas en el cuaderno.
Entrena el tuyo propio: Configura el entorno de ejecución a GPU T4, ejecuta todas las celdas—descarga el conjunto de datos, entrena el tokenizador, entrena el modelo, lo prueba. Sube a HuggingFace o descarga localmente.
Chatea localmente:
pip install torch tokenizers python -m guppylm chat
Interacción local de ejemplo:
Tú> el gato te está mirando Guppy> me escondo detrás de la planta cuando viene el peludo. Tú> está lloviendo afuera Guppy> creo que la lluvia es lo mejor del exterior.
Estructura del Proyecto
guppylm/ ├── config.py # Hiperparámetros (modelo + entrenamiento) ├── model.py # Transformador básico ├── dataset.py # Carga de datos + lotes ├── train.py # Bucle de entrenamiento (LR coseno, AMP) ├── generate_data.py # Generador de datos de conversación (60 temas) ├── eval_cases.py # Casos de prueba reservados ├── prepare_data.py # Preparación de datos + entrenamiento de tokenizador └── inference.py # Interfaz de chat
Este proyecto es útil para desarrolladores que quieren comprender los fundamentos de la arquitectura de transformadores sin lidiar con modelos de miles de millones de parámetros. La implementación completa muestra cada pieza desde el texto crudo hasta los pesos entrenados y la salida generada.
📖 Read the full source: HN LLM Tools
👀 Ver también

ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo
ToolLoop es un framework de código abierto en Python con 11 herramientas para operaciones de archivos, búsqueda de código, acceso a shell y subagentes que funciona con cualquier LLM a través de LiteLLM. El framework de 2,700 líneas permite cambiar de modelo a mitad de conversación con contexto compartido.

Cámara: Agente de IA para la Gestión de Infraestructura de GPU
Chamber es un agente de IA que gestiona la infraestructura de GPU manejando tareas como el aprovisionamiento de clústeres, el diagnóstico de trabajos fallidos y la gestión de cargas de trabajo. Proporciona operaciones estructuradas con validación y reversión, no solo comandos de shell sin procesar.

skill-depot: Un sistema de memoria y habilidades local-first para agentes de IA compatibles con MCP
skill-depot es un sistema de recuperación que almacena el conocimiento del agente como archivos Markdown y utiliza incrustaciones vectoriales para buscar semánticamente y cargar selectivamente solo el contenido relevante. Se ejecuta 100% localmente sin claves API, funciona con cualquier agente compatible con MCP y se puede configurar con npx skill-depot init.

Centro de Comandos Claude v5.0.0 añade soporte desde el primer día para Fable 5 con cambio en medio de la sesión
Claude Command Center v5.0.0 agrega soporte de primera clase para el nuevo nivel Fable 5 de Anthropic, incluyendo cambio de modelo a mitad de sesión, un selector rediseñado y una corrección de errores en alias de CLI con versión.