나노코드: JAX와 TPU를 사용한 클로드(Claude) 스타일 코딩 에이전트 훈련

✍️ OpenClawRadar📅 게시일: April 15, 2026🔗 Source
나노코드: JAX와 TPU를 사용한 클로드(Claude) 스타일 코딩 에이전트 훈련
Ad

Nanocode는 Anthropic의 접근 방식을 따라 Constitutional AI를 사용하여 자신만의 Claude Code 모델을 종단 간 학습시키는 방법을 보여주는 라이브러리입니다. 완전히 JAX로 작성되었으며 TPU에 최적화되어 있으며, Karpathy의 nanochat 프로젝트의 인프라를 적용합니다.

학습 설정 및 비용

nanocode-d24 모델(13억 개의 파라미터)은 TPU v6e-8에서 약 9시간 동안 200달러의 비용으로 재현할 수 있습니다. 더 작은 nanocode-d20 모델(4억 7700만 개의 파라미터)은 약 1.5시간 동안 34달러의 비용으로 학습됩니다. 이 프로젝트는 한 달 동안 선점 가능한 TPU에 무료로 접근하기 위해 Google의 TRC 프로그램을 사용하거나, 새 계정에 대해 Google Cloud의 300달러 크레딧을 사용할 것을 권장합니다.

기술적 구현

학습 과정은 다음을 포함합니다:

  • 모델 정렬을 정의하는 SOUL.md 파일 작성
  • 세계 상호작용을 위한 에이전트 인터페이스 정의
  • 합성 데이터 생성
  • SOUL과 모델을 정렬하기 위한 선호도 최적화 사용
Ad

토큰화 및 사전 학습 차이점

사전 학습 및 토크나이저 학습 과정은 nanochat와 유사하지만, nanocode는 사전 학습과 토크나이저 혼합물 모두에서 The Stack-V2의 추가 코딩 데이터를 1:5 비율로 포함합니다. 이는 더 강력한 코딩 성능을 가져오지만 일반 텍스트 토큰화 효율성을 감소시킵니다.

토크나이저 비교는 nanocode가 nanochat에 비해 코드에 대해 -50.9% 더 나은 토큰화를 달성하는 반면, nanochat는 한국어 텍스트에서 더 나은 성능을 보임을 나타냅니다(뉴스에 대해 nanocode는 +7.9%, 한국어에 대해 -27.6%).

명령어 및 설정

export NANOCODE_BASE_DIR="$HOME/.cache/nanocode"
export MODEL_TAG=d24
python -m data.pretrain -d fineweb-edu -n 300
python -m data.pretrain -d the-stack-v2-dedup -n 60
python -m scripts.tok_train --max-chars=2000000000
python -m scripts.tok_eval

모델은 nanochat의 스케일링 법칙 분석에 따라 8의 파라미터:데이터 비율로 학습됩니다. TPU에 최적화되었지만, nanocode는 NVIDIA GPU에서도 즉시 작동해야 합니다.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

OpenClaw 에이전트를 위한 Harrier 임베딩 기반 지역 의미 메모리 검색
Tools

OpenClaw 에이전트를 위한 Harrier 임베딩 기반 지역 의미 메모리 검색

Microsoft의 Harrier 모델로 로컬 임베딩 서버를 실행하고 Ollama 호환 API를 노출한 후 OpenClaw의 memorySearch 설정을 연결하여 외부 서비스 없이 로컬 의미 메모리 검색을 구현합니다.

OpenClawRadar
에이전트가 배송했다고 말했는데 – 모델 이름보다 세션 추적이 중요한 이유
Tools

에이전트가 배송했다고 말했는데 – 모델 이름보다 세션 추적이 중요한 이유

한 개발자가 세 팀에 걸쳐 발견한 패턴을 보고합니다: 에이전트가 완료를 주장하지만, 세션 추적을 보면 숨겨진 리팩터, 놓친 규칙, 비최적 구현이 드러납니다. 이 글은 진짜 문제가 모델 품질이 아니라 신뢰이며, 주장을 검증하는 유일한 방법은 인스턴스별 세션 추적이라고 주장합니다.

OpenClawRadar
Semble: 클로드 코드용 로컬 MCP 서버, 토큰 98% 절감
Tools

Semble: 클로드 코드용 로컬 MCP 서버, 토큰 98% 절감

Semble는 Claude Code를 위한 오픈소스 MCP 서버로, grep+read 워크플로우를 대체합니다. 임베딩, BM25, 재순위화를 사용하여 리포지토리를 약 250ms에 인덱싱하면서 토큰 사용량을 약 98% 줄입니다.

OpenClawRadar
개발자가 28가지 기능을 갖춘 읽기/쓰기 WordPress MCP 플러그인을 제작했습니다
Tools

개발자가 28가지 기능을 갖춘 읽기/쓰기 WordPress MCP 플러그인을 제작했습니다

한 개발자가 WordPress 플러그인을 만들어 Claude Desktop 및 Claude Code와 같은 AI 코딩 에이전트를 위한 완전한 읽기/쓰기 MCP(Model Context Protocol) 접근을 제공합니다. 이 플러그인은 기존 솔루션의 한계를 해결합니다: 공식 WordPress MCP 어댑터는 읽기 전용이고, WordPress.com 커넥터에는 제한이 있으며, Jetpack AI는 Gutenberg 내부의 폐쇄형 시스템입니다.

OpenClawRadar