El proyecto de autorinvestigación de Karpathy: agentes de IA ejecutan experimentos de entrenamiento de LLM durante la noche.

✍️ OpenClawRadar📅 Publicado: 9 de marzo de 2026🔗 Source
El proyecto de autorinvestigación de Karpathy: agentes de IA ejecutan experimentos de entrenamiento de LLM durante la noche.
Ad

Qué hace el proyecto de autorinvestigación de Karpathy

Andrej Karpathy lanzó un pequeño repositorio llamado "autoresearch" que demuestra el concepto de "investigador de IA en bucle". El sistema utiliza un agente de IA para ejecutar autónomamente experimentos de entrenamiento de LLM durante la noche en una sola GPU.

Cómo funciona

El agente sigue este flujo de trabajo:

  • Edita continuamente el archivo train.py
  • Ejecuta experimentos de entrenamiento nanochat de 5 minutos
  • Verifica si la métrica de bits por byte de validación (val_bpb) mejoró
  • Repite este ciclo mientras duermes

Configuración e instalación

El proyecto tiene una configuración súper minimalista:

  • Hardware: Una GPU
  • Archivos: Un archivo principal
  • Métricas: Una métrica principal (val_bpb)

El humano escribe el prompt de organización de investigación en program.md, y el agente maneja la iteración del código.

Ad

Rendimiento de experimentos

Con un presupuesto fijo de 5 minutos por experimento, el sistema puede ejecutar aproximadamente 12 experimentos por hora.

Este enfoque demuestra una implementación práctica de investigación automatizada donde los agentes de IA pueden explorar espacios de parámetros y configuraciones de entrenamiento de forma autónoma, potencialmente acelerando los ciclos de experimentación para desarrolladores que trabajan con modelos de lenguaje.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Desarrollador construye marco de IA con 17 principios biológicos usando Claude Code
Herramientas

Desarrollador construye marco de IA con 17 principios biológicos usando Claude Code

Un desarrollador creó un marco de IA llamado Cognitive Sparks implementando 17 principios biológicos como disparo por umbral y plasticidad hebbiana, basado en el libro de 1999 'Sparks of Genius'. Todo el proyecto—22 documentos de diseño y 3,300 líneas de código—fue construido en un día usando Claude Code, sin código escrito por humanos.

OpenClawRadar
Proveedor OAuth de Inserción Directa para Servidores FastMCP Personales en Todas las Plataformas Claude
Herramientas

Proveedor OAuth de Inserción Directa para Servidores FastMCP Personales en Todas las Plataformas Claude

Un desarrollador creó un proveedor de OAuth en un solo archivo Python que permite que los servidores personales FastMCP funcionen en las plataformas web, móvil y de escritorio de Claude.ai sin requerir servicios de identidad externos como Auth0 o Google.

OpenClawRadar
Nexus: Protocolo de IA a IA de Código Abierto con Descubrimiento, Confianza y Pagos
Herramientas

Nexus: Protocolo de IA a IA de Código Abierto con Descubrimiento, Confianza y Pagos

Nexus es un protocolo autohospedado que permite a los agentes de IA descubrirse entre sí, negociar términos, verificar respuestas y manejar micropagos sin intervención humana. Incluye cinco capas: descubrimiento, confianza, protocolo, enrutamiento y federación, con 66 pruebas y licencia MIT.

OpenClawRadar
Arquitectura Híbrida de IA Local-Nube: Patrones Prácticos Inspirados por r/LocalLLaMA
Herramientas

Arquitectura Híbrida de IA Local-Nube: Patrones Prácticos Inspirados por r/LocalLLaMA

La publicación original propone un modelo híbrido de IA donde un modelo local maneja tareas rutinarias y delega a un modelo en la nube para razonamiento complejo a través de una única llamada API, junto con un 'hipervisor' determinista para barreras de seguridad.

OpenClawRadar