Nanocode: Entrenamiento de agentes de codificación similares a Claude con JAX en TPUs

Nanocode es una biblioteca que demuestra cómo entrenar tu propio modelo Claude Code de extremo a extremo usando Constitutional AI, siguiendo el enfoque de Anthropic. Escrito completamente en JAX y optimizado para TPUs, adapta la infraestructura del proyecto nanochat de Karpathy.
Configuración y Costos de Entrenamiento
El modelo nanocode-d24 (1.3B parámetros) puede reproducirse en aproximadamente 9 horas en una TPU v6e-8 a un costo de $200. El modelo más pequeño nanocode-d20 (477M parámetros) se entrena en aproximadamente 1.5 horas por $34. El proyecto recomienda usar el programa TRC de Google para acceso gratuito a TPUs preemptibles por un mes, o los créditos de $300 de Google Cloud para cuentas nuevas.
Implementación Técnica
El proceso de entrenamiento incluye:
- Escribir un archivo SOUL.md para definir la alineación del modelo
- Definir una interfaz agéntica para interacción con el mundo
- Generar datos sintéticos
- Usar optimización de preferencias para alinear el modelo con SOUL
Diferencias en Tokenización y Pre-entrenamiento
Aunque el proceso de pre-entrenamiento y entrenamiento del tokenizador es similar a nanochat, nanocode incluye datos adicionales de codificación de The Stack-V2 en una proporción 1:5 tanto en las mezclas de pre-entrenamiento como del tokenizador. Esto resulta en un mejor rendimiento de codificación pero reduce la eficiencia de tokenización de texto general.
La comparación de tokenizadores muestra que nanocode logra un -50.9% mejor tokenización para código en comparación con nanochat, mientras que nanochat funciona mejor con texto coreano (+7.9% para nanocode en noticias, -27.6% en coreano).
Comandos y Configuración
export NANOCODE_BASE_DIR="$HOME/.cache/nanocode"
export MODEL_TAG=d24
python -m data.pretrain -d fineweb-edu -n 300
python -m data.pretrain -d the-stack-v2-dedup -n 60
python -m scripts.tok_train --max-chars=2000000000
python -m scripts.tok_eval
Los modelos se entrenan con una proporción parámetro:datos de 8, siguiendo el análisis de leyes de escala de nanochat. Aunque optimizado para TPUs, nanocode también debería funcionar en GPUs NVIDIA sin modificaciones.
📖 Leer la fuente completa: HN AI Agents
👀 Ver también

Voygr lanza la API de Validación de Negocios para Inteligencia de Lugares Nuevos
La API de Validación de Negocios de Voygr verifica si las empresas están operando, cerradas, rebrandizadas o inválidas mediante la agregación de múltiples fuentes de datos y la detección de señales conflictivas. El equipo está construyendo un perfil de lugar infinito y consultable que combina datos precisos de lugares con contexto web actualizado como noticias, artículos y eventos.

Semble: Un servidor MCP local para Claude Code con una reducción del 98% en tokens
Semble es un servidor MCP de código abierto para Claude Code que reemplaza los flujos de trabajo basados en grep+read, utilizando embeddings, BM25 y reranking para reducir el uso de tokens en aproximadamente un 98% mientras indexa repositorios en unos 250ms.

Servidor MCP para Búsqueda Semántica en Bóvedas de Obsidian
Un desarrollador construyó un servidor MCP que indexa bóvedas de Obsidian en Qdrant con incrustaciones locales, permitiendo búsqueda semántica en lugar de coincidencia de palabras clave. Fragmenta markdown por encabezados, utiliza incrustaciones BAAI/bge-small-en-v1.5, y funciona con Claude Code, Cursor, Windsurf o cualquier cliente MCP.

Agente MCP Studio: Crea sistemas MCP multiagente completamente en un navegador mediante WASM
Agent MCP Studio le permite diseñar, orquestar y exportar sistemas de agentes MCP desde un único archivo HTML estático utilizando WebAssembly, sin backend, Docker ni servidor.