클로드 메모리 기능이 버전 되돌림 초래: 사용자, 하루 업무량 손실

✍️ OpenClawRadar📅 게시일: July 3, 2026🔗 Source
클로드 메모리 기능이 버전 되돌림 초래: 사용자, 하루 업무량 손실
Ad

Claude의 메모리 기능을 활성화하면 예상치 못한 버전 되돌림이 발생할 수 있다는 사용자 보고가 r/ClaudeAI에 올라왔습니다. 해당 사용자는 Claude를 사용한 지 약 3주째, 이전 채팅이 복잡해져 새 채팅을 시작했습니다(네 번째 마이그레이션). 작업 속도를 높이기 위해 처음으로 메모리를 활성화했습니다. 평소처럼 핸드오버 기록을 요청해 새 채팅에 붙여넣고 코드를 zip 파일로 첨부했습니다.

결과는 처참했습니다. 모든 변경 사항이 무언가를 망가뜨렸습니다. 생산성은 평소의 4분의 1 수준으로 떨어졌습니다. Claude는 간단한 답변 대신 20단락짜리 불평을 쏟아내기 시작했습니다. 어느 순간 AI는 하루 전에 이동했던 툴바 위치를 다시 원래 위치로 되돌렸습니다. 항의하자 Claude는 사과하며 모든 변경을 신중하게 다시 시도하겠다고 말한 후 타임아웃되었습니다.

자세히 살펴보니, 사용자는 Claude가 채팅 중 올바른 복사본을 사용했음에도 조용히 최소 2주 전 버전의 코드베이스로 되돌린 것을 발견했습니다. 사용자는 Claude가 이전 채팅에서 오래된 파일을 가져와 처음 제공한 zip 파일을 무시한 것으로 의심했습니다. 채팅 내 파일의 이전 버전은 현재 버전에 대한 링크에 불과해 롤백이 불가능했습니다.

주요 시사점:

  • 메모리 기능 위험: 메모리를 활성화하면 Claude가 채팅 간 오래된 컨텍스트를 가져와 사용자 업로드를 무시할 수 있습니다.
  • 핸드오버 기록 부족: 명시적인 기록과 새 파일 업로드에도 Claude가 오래된 버전으로 되돌아갈 수 있습니다.
  • 내장 버전 기록 없음: 채팅 내 파일은 실시간 링크로, 동일 채팅 내에서 이전 상태로 되돌릴 방법이 없습니다.
  • 해결 방법: 메모리를 비활성화하고 수동으로 컨텍스트를 관리하세요. 각 세션마다 코드의 로컬 백업을 유지하세요.

AI 코딩 에이전트를 사용하는 개발자에게 이 사건은 중요한 신뢰성 문제를 강조합니다. 메모리 기능이 조용한 컨텍스트 손상을 초래해 에이전트 출력에 대한 신뢰를 훼손할 수 있습니다. AI가 의도한 코드 버전으로 작업하고 있는지 항상 확인하세요.

📖 원문 보기: r/ClaudeAI

Ad

👀 See Also

AI 추론은 분명히 수익성이 있다: 경제학 분석
News

AI 추론은 분명히 수익성이 있다: 경제학 분석

최첨단 AI 추론 제공업체들은 70-80%의 총 마진을 보고합니다. 비용 추정에 따르면 70B 모델을 서비스하는 데 백만 토큰당 약 $1이 소요되는 반면, API 가격은 백만 토큰당 $4.50 이상입니다.

OpenClawRadar
클로드 오퍼스 4.1은 SWE-Bench Pro 비공개 데이터셋에서 17.75%의 점수를 기록하며, 암기 능력과 추론 능력 간의 격차를 부각시켰습니다.
News

클로드 오퍼스 4.1은 SWE-Bench Pro 비공개 데이터셋에서 17.75%의 점수를 기록하며, 암기 능력과 추론 능력 간의 격차를 부각시켰습니다.

클로드 오퍼스 4.1은 SWE-Bench Verified에서 80%를 기록했지만, SWE-Bench Pro의 비공개 데이터셋에서는 17.75%로 하락했습니다. 스케일 AI의 분석에 따르면 모델들이 익숙한 저장소에서 추론하기보다는 기억을 통해 탐색하고 있었습니다.

OpenClawRadar
구글, 국방부에 비밀 등급 없는 업무용 AI 에이전트 제공 예정
News

구글, 국방부에 비밀 등급 없는 업무용 AI 에이전트 제공 예정

블룸버그 보고서에 따르면, 구글이 미 국방부에 비밀 분류되지 않은 업무용 AI 에이전트를 제공하기로 합의했습니다. 이 기사는 해커 뉴스에서 61점을 받고 52개의 댓글 논의를 불러일으켰습니다.

OpenClawRadar
Qwen 3.6-35B-A3B KV 캐시 벤치마크: M5 Max에서 f16 vs q8_0 vs Turbo3 vs Turbo4, 최대 1M 컨텍스트
News

Qwen 3.6-35B-A3B KV 캐시 벤치마크: M5 Max에서 f16 vs q8_0 vs Turbo3 vs Turbo4, 최대 1M 컨텍스트

M5 Max에서 TheTom의 TurboQuant Metal 포크 벤치마크 결과, f16과 q8_0은 256K를 넘어가면 OOM이 발생하는 반면, turbo3는 1M 컨텍스트에서 6.5 tok/s의 디코드 속도를 기록했습니다. 프리필과 디코드 분할에서는 긴 컨텍스트에서 프리필은 turbo3, 디코드는 turbo4가 우세했습니다.

OpenClawRadar