코딩 에이전트 세션 로그는 로컬에 저장되며, 개방형 연합 학습을 가능하게 할 수 있습니다.

Claude Code나 Codex CLI와 같은 코딩 에이전트를 에이전트 모드로 사용할 때, 이들은 사용자의 컴퓨터에 포괄적인 세션 데이터를 로컬에 기록합니다. 이러한 로그는 전체 상호작용 루프를 담고 있습니다: 초기 작업, 모델의 추론 과정, 수행된 모든 도구 호출, 모든 환경 응답, 발생한 모든 오류와 재시도 시도. 이는 완전한 (상태 → 행동 → 보상 → 다음 상태) 튜플을 생성합니다—이는 강화 학습 연구자들이 필요로 하는 정확한 데이터 형식입니다.
로그에 포함된 내용
원문 작성자는 자신의 컴퓨터를 확인하여 다음과 같은 내용을 발견했습니다:
- Mac Mini: ~/.claude/projects/ 디렉토리에 574개의 에이전트 세션에서 생성된 1103개 파일, 총 3.1GB
- MacBook: ~/.codex/sessions/ 디렉토리에 79개의 에이전트 세션에서 생성된 3530개 파일, 총 2.4GB
- MacBook: ~/.claude/projects/ 디렉토리에 99개의 에이전트 세션에서 생성된 316개 파일, 총 652MB
전체적으로, 실제 도구 호출을 포함하는 775개의 세션을 확인했으며, 이는 약 4천1백만 토큰에 해당합니다. 수천 명의 개발자들로 확장하면, 이는 수천억 토큰 규모의 실제 에이전트 궤적 데이터를 나타낼 수 있습니다—현재 The Pile 데이터셋과 같은 공개 대안이 없는 데이터입니다.
이 데이터의 중요성
환경은 명확한 피드백 신호를 제공합니다: 종료 코드 0 여부, 테스트 통과 여부. 이는 인과적 추론, 오류 복구, 장기적 계획—현재 모델들이 어려움을 겪는 분야—에 필요한 학습 신호를 제공합니다. 대형 AI 연구실들은 이미 자체적으로 이 데이터를 수집하여 독점 모델을 훈련하고 있지만, 데이터가 개별 개발자들의 컴퓨터에 분산되어 있어 공개 대안이 없습니다.
제안: 연합 학습
해당 게시물은 사용자의 데이터가 컴퓨터를 떠나지 않는 연합 학습을 사용할 것을 제안합니다. 로컬에서 작은 LoRA 어댑터를 훈련하고, 차등 프라이버시 노이즈가 추가된 가중치만 공유하며, 개선된 글로벌 모델을 돌려받는 방식입니다. 모든 참여자는 원시 데이터를 노출하지 않고도 컴퓨팅 자원과 신호를 기여합니다. 또는 커뮤니티가 데이터를 익명화하여 모델 미세 조정을 위한 데이터셋을 생성할 수도 있습니다.
실용적인 단계
로그를 보존하려면 (Claude Code는 기본적으로 30일 후 로그를 삭제합니다):
echo '{"cleanupPeriodDays": 36500}' > ~/.claude/settings.json
자신의 컴퓨터에 무엇이 있는지 확인하려면:
du -sh ~/.codex/sessions/ 2>/dev/null
du -sh ~/.claude/projects/ 2>/dev/null
find ~/.codex/sessions/ -name "*.jsonl" | wc -l
find ~/.claude/projects/ -name "*.jsonl" | wc -l
Reddit 게시물은 개발자들이 커뮤니티 전체에 걸쳐 사용되지 않은 데이터의 실제 규모를 파악하기 위해 댓글에 자신들의 숫자를 공유하도록 권장하며, 충분한 관심이 있다면 공개 대안을 구축하는 것을 목표로 합니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

AI의 가격 위기: OpenAI와 Anthropic, $1 벌기 위해 $8~$14 지출
DSHR의 분석에 따르면 AI 플랫폼이 토큰을 40~70배까지 보조금 지원하고 있으며, OpenAI는 2025년 130억 달러의 매출에 385억 달러의 손실을 기록했고, 매출의 44%를 판매 및 마케팅에 지출했습니다.

클로드 MAX 플랜에 추가 비용 없이 100만 토큰 컨텍스트 윈도우가 포함됩니다
Claude MAX 플랜이 추가 API 사용 요금 없이 100만 토큰 컨텍스트 윈도우를 포함하도록 자동 업그레이드되었으며, 사용자들은 토큰 사용량이 크게 감소하고 컨텍스트 윈도우 관리 부담이 사라졌다고 보고합니다.

클로드 앱, 미국 앱 스토어 차트 정상 등극... AI 어시스턴트 앱 톱10 장악
Anthropic의 Claude가 현재 미국 앱 스토어의 인기 앱 차트에서 1위를 차지하고 있으며, ChatGPT가 2위, Google Gemini가 4위를 기록하고 있습니다. 상위 10위 안에는 쇼핑, 소셜 미디어, 유틸리티 앱들 사이에 세 개의 AI 어시스턴트가 포함되어 있습니다.

클로드 오퍼스 4.7, 추론 및 대화 능력 퇴보했다는 사용자 보고
Opus 4.7은 30~50% 더 많은 비용이 드는 새로운 토크나이저를 도입했으며, 메타 내레이션, 위치 불안정, 실행 없는 계획 등의 문제를 보여 기술 협업 측면에서 4.6보다 더 나쁩니다.