로컬 파인튜닝된 Llama 3.2-1B, 비밀 탐지에서 Wiz의 모델을 능가하다

한 개발자가 코드 내 비밀 탐지를 위해 Llama 3.2-1B를 로컬에서 미세 조정하는 데 성공한 과정을 문서화했으며, Wiz의 유사 모델 성능을 뛰어넘었습니다. 이 프로젝트는 전적으로 로컬 AI 도구를 사용하여 진행되었으며, 독점 API를 사용하지 않았습니다.
주요 결과 및 접근 방식
개발자는 Wiz의 86% 정밀도와 82% 재현율 결과를 복제하거나 능가하는 것을 목표로 했습니다. 몇 주말 동안 작업한 끝에, 미세 조정된 Llama 3.2-1B 모델로 88% 정밀도와 84.4% 재현율을 동시에 달성했습니다. 또한 Qwen 3.5-2B 및 4B 모델을 벤치마킹했는데, 이들은 더 높은 VRAM 사용량과 긴 추론 시간을 희생하면서 1B 모델보다 더 나은 성능을 보였습니다.
데이터셋 및 학습 과정
이 작업은 공개적으로 이용 가능한 데이터에만 의존했는데, 이는 부족했기 때문에 절차적 생성을 사용하여 데이터셋을 증강하고 개선했습니다. 모든 라벨링은 Qwen3-Coder-Next 모델을 사용하여 로컬에서 수행되었습니다. 주요 학습 목표는 모델이 구조화된 JSON을 출력하도록 하는 것이었습니다. 처음에는 학습되지 않은 모델(Llama & Qwen)이 스키마 준수성에서 0% 점수를 받았지만, 학습 후에는 98-100%로 향상되었습니다.
도전 과제 및 교훈
개발자는 이 과정에서 몇 가지 문제를 발견했습니다:
- 학습에 해로운 고 엔트로피 클래스를 포함했는데, 이를 식별하고 제거했습니다.
- 데이터셋의 '부정적' 샘플 4,500개에 실제 비밀번호가 포함되어 있다는 사실을 발견했으며, 이는 모델이 비밀을 무시하도록 학습되고 있음을 의미했습니다. 이를 수정하여 비밀번호에 대한 재현율이 향상되었습니다.
개발자는 학습 통계, 예시 및 과정의 단계별 분석이 포함된 완전한 기술 보고서를 발표했습니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

클로드의 무료 버전을 사용하여 노션 연구 데이터베이스 자동 업데이트하기
한 개발자가 Claude의 무료 티어를 사용하여 연구 내용을 자동으로 구조화하고 Notion 데이터베이스에 저장하는 시스템을 구축했습니다. 이 워크플로우는 원시 연구 노트를 가져와 일관된 필드, 카테고리, 요약을 갖춘 구조화된 데이터베이스 항목으로 포맷합니다.

솔로 개발자, 클로드 코드로 키즈 앱 출시… 첫날 23달러 수익
한 솔로 인디 개발자가 Claude Code를 사용하여 어린이 그림 및 학습 앱 'Little Artist'를 구축하고 반복적으로 개선했으며, 지난 24시간 동안 23달러를 벌었습니다. AI 코딩 도구를 통해 배포 속도가 10배 빨라졌다고 보고했습니다.

SeatBee.app은 웨딩 좌석 배치에 Claude AI를 활용합니다
SeatBee.app는 Claude Code와 Claude AI(OpenRouter 경유)를 사용하여 결혼식 좌석 배치 문제를 해결하기 위해 개발되었습니다. 이 AI는 150명의 손님과 20개의 규칙에 대한 제약 조건 만족을 처리하며, 최적의 좌석 배치를 몇 초 만에 생성하고, 지저분한 이별을 겪은 사람들 사이에 완충 지대를 만드는 등 사회적 역학을 이해합니다.

클로드 코드로 개인 AI 에이전트 구축하기: 위즈(Wiz) 6개월간의 교훈
한 개발자가 Claude Code를 사용하여 아침 보고서, 저녁 요약, 이메일 분류를 처리하는 개인 AI 에이전트인 Wiz를 구축한 경험을 공유했습니다. 이 글은 개발 과정에서 저지른 9가지 실수, 즉 지나치게 야심찬 목표로 시작하고 Claude가 핵심 지침을 검토 없이 생성하도록 내버려 둔 점 등을 상세히 설명합니다.