Talkie: 1931년 이전 텍스트만으로 훈련된 13B LLM, RL 훈련에서 심사자로 클로드 활용

Alec Radford(GPT, CLIP, Whisper), Nick Levine, David Duvenaud를 포함한 연구팀이 Talkie를 공개했습니다. Talkie는 1931년 이전에 출판된 텍스트만으로 훈련된 130억 파라미터 언어 모델입니다. 모델의 지식 범위는 1930년 12월 31일까지로, 인터넷, 위키백과, 제2차 세계대전 관련 콘텐츠가 전혀 포함되지 않았습니다.
중요한 이유
현재의 LLM(GPT, Claude, Gemini, Llama)은 모두 현대 웹의 훈련 데이터를 공유하기 때문에 암기와 진정한 추론을 분리하기 어렵습니다. Talkie는 이러한 계보를 깨뜨립니다. 훈련 분포가 근본적으로 달라, 연구자들은 능력이 암기에서 비롯되는지 일반화에서 비롯되는지 테스트할 수 있습니다. 연구팀은 "LM 능력이 암기에서 비롯되는지 일반화에서 비롯되는지는 중요한 질문입니다. 빈티지 LM은 독특한 일반화 테스트를 가능하게 합니다."라고 말합니다.
Claude의 훈련 역할
Claude Sonnet 4.6은 Talkie의 강화 학습 파이프라인(온라인 DPO)에서 심사자 역할을 했습니다. 또한 Claude Opus 4.4는 최종 미세 조정 단계에서 사용된 합성 다중 턴 대화를 생성했습니다. 연구팀은 아이러니와 오염 위험을 인정하며, 향후 버전에서 이를 제거하기 위해 노력 중이라고 밝혔습니다.
주요 기능
- Talkie는 훈련 데이터에 현대 코드가 전혀 없음에도 불구하고 몇 가지 맥락 예제만으로 Python 코드를 작성하는 방법을 학습할 수 있습니다. 19세기 수학 텍스트에서 추론하는 것이지 검색에서 비롯된 것이 아닙니다.
- 장기 예측용으로 설계: 모델이 고정된 1930년 관점에서 미래를 얼마나 잘 "예측"할 수 있는지?
- "발명" 연구에 사용 가능: 지식 범위 이후의 아이디어를 개발할 수 있는지.
- 어떤 능력이 아키텍처에 기반하고 어떤 능력이 웹 데이터에서 흡수되었는지 분리하는 데 도움.
접근 및 라이선스
Talkie와 그 변형은 모두 Apache 2.0 라이선스이며 Hugging Face에서 오픈 웨이트로 제공됩니다. 제공된 링크에서 실시간으로 채팅할 수 있습니다. 연구팀은 올해 말 GPT-3 규모의 빈티지 모델을 계획하고 있습니다.
연구에 사용되는 용도
- 장기 예측: 역사적 관점에서 미래 발전을 예측.
- 발명: 훈련 범위 이후의 아이디어 생성.
- LLM 정체성: 모델을 구성하는 요소 — 아키텍처와 데이터 분포 효과 분리.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

마이크로소프트, AI 투자 1900억 달러 유지 — 첫 하이퍼스케일러가 선을 지키다
마이크로소프트가 AI 자본 지출 전망을 1900억 달러로 유지하면서 경쟁사들이 지출을 늘리는 추세를 거스르자 주가가 8% 급등했습니다. 한편, 메모리 칩 가격 상승이 업계 전체 자본 지출 증가의 약 45%를 차지할 수 있습니다.

Qwen3.5-122B on Blackwell SM120: fp8 KV 캐시 손상 문제 및 성능 분석 결과
8x RTX PRO 6000 Blackwell 하드웨어에서 Qwen3.5-122B를 테스트한 결과, fp8_e4m3 KV 캐시가 오류 없이 조용히 손상된 출력을 생성하는 문제가 발견되어 bf16 KV 캐시를 사용해야 합니다. MTP 최적화는 단일 요청 속도를 2.75배 향상시켰지만, DeltaNet 제약으로 인해 다른 최적화는 차단되었습니다.

미니맥스 M2.7 및 10만 개 이상의 오픈클로 인스턴스 확장에 관한 생태계 세션 논의
Jim과 AndyML이 Minimax 팀을 초대하여 Minimax M2.7과 10만 개 이상의 OpenClaw 인스턴스를 지원하기 위해 호스팅 환경을 확장한 방법에 대해 논의했습니다. 이 세션은 Discord에서 100-110명의 사용자와 중국어 동시 중계에서 35만 명 이상의 시청자를 끌어모았습니다.

Mac Studio에서 DeepSeek v4 Flash: 로컬 LLM이 컴파일러 코드의 실제 버그를 발견하다
한 개발자가 128GB Mac Studio에서 실행되는 DeepSeek v4 Flash가 컴파일러 코드베이스에서 유효한 버그를 성공적으로 식별했다고 공유했습니다. 이는 5개월 전만 해도 로컬 LLM으로는 불가능했던 작업입니다.