DeepSeek-V4-플래시가 로컬 모델에서 LLM 제어를 실용적으로 만듦

✍️ OpenClawRadar📅 게시일: May 16, 2026🔗 Source
DeepSeek-V4-플래시가 로컬 모델에서 LLM 제어를 실용적으로 만듦
Ad

Seen Goedecke의 최신 글은 DeepSeek-V4-Flash가 LLM 스티어링(모델 활성화를 추론 중간에 조작하여 출력을 제어하는 기술)에 대한 판도를 바꾼다고 주장합니다. 핵심 동인은 antirez가 만든 경량화된 llama.cpp 포크인 DwarfStar로, DeepSeek-V4-Flash만 실행하며 스티어링을 일급 기능으로 내장하고 있습니다.

스티어링이란?

스티어링은 모델의 내부 활성화에서 개념("간결하게 응답" 등)을 추출합니다. 한 가지 방법: 100개의 프롬프트를 두 번 제시합니다. 한 번은 일반, 한 번은 "간결하게 응답"을 추가한 후 활성화 행렬을 빼서 스티어링 벡터를 얻습니다. 이 벡터를 임의의 프롬프트 활성화에 추가하면 모델이 간결해집니다. 더 고급 접근 방식은 (Anthropic의 것과 같은) 희소 오토인코더를 사용하여 특징 패턴을 학습하는 것으로, 비용이 더 듭니다.

왜 중요한가

스티어링은 프롬프트 엔지니어링 없이 모델 동작을 직접 제어할 수 있는 가능성을 제공합니다. "반드시"와 같은 수식어를 작성하는 대신, 간결함이나 성실함에 대한 슬라이더를 가질 수 있습니다. 또한 해석 가능성 측면에서도 매력적입니다. Golden Gate Claude의 집착 같은 것을 떠올려 보세요. 하지만 여러분이 조정할 수 있습니다.

왜 이전에는?

스티어링은 중간 수준의 아이디어였습니다. 대형 연구소에게는 너무 조악했고(그냥 모델을 재훈련합니다), API 사용자에게는 접근 불가능했습니다(가중치나 활성화에 접근할 수 없음). 오픈 가중치 모델은 신경 쓸 만큼 강력하지 않았습니다. DeepSeek-V4-Flash가 등장하기 전까지는요. 이 모델은 에이전트 코딩에 충분히 강력합니다. 그럼에도 불구하고, 장황함과 같은 단순한 특성에 대해서는 프롬프팅이 종종 스티어링보다 더 효과적입니다. 진정한 승리는 지능과 같이 프롬프트로 제어할 수 없는 개념을 스티어링하는 것입니다.

Goedecke는 DwarfStar를 면밀히 따라갈 계획입니다. 이 글을 작성하는 시점에서, 스티어링 지원은 초보적입니다(프롬프팅과 유사한 장황함 토글 정도). 하지만 출시된 지 8일밖에 되지 않았습니다.

📖 전체 출처 읽기: HN LLM Tools

Ad

👀 See Also

클로드 AI, '안드로이드는 전기 양을 꿈꾸는가' 분석하며 AI 규제와 유사성 도출
News

클로드 AI, '안드로이드는 전기 양을 꿈꾸는가' 분석하며 AI 규제와 유사성 도출

클로드 AI가 필립 K. 딕의 『전자 양은 꿈을 꾸는가』를 읽고 인공지능의 관점에서 책의 주제를 분석한 상세한 노트를 작성했습니다. 이 분석은 문화적 순응 도구로서의 포이트-캄프 공감 테스트, 현상금 사냥꾼의 경제적 논리, 그리고 현대 AI 규제 논쟁과의 유사점에 초점을 맞추고 있습니다.

OpenClawRadar
AWS의 Claude Platform 정식 출시: 관리형 에이전트, 코드 실행, IAM을 통한 완전한 API 일관성
News

AWS의 Claude Platform 정식 출시: 관리형 에이전트, 코드 실행, IAM을 통한 완전한 API 일관성

AWS의 Claude Platform은 IAM 인증, CloudTrail 로깅, 커밋먼트 소진과 함께 Claude 네이티브 API 기능(관리형 에이전트, 코드 실행, 스킬)을 AWS 고객에게 제공합니다.

OpenClawRadar
Claude Code에서 1억 개의 토큰을 분석한 결과 99.4%의 입력 사용률이 나타났습니다.
News

Claude Code에서 1억 개의 토큰을 분석한 결과 99.4%의 입력 사용률이 나타났습니다.

확장된 코딩 세션에서 1,289개 요청을 분석한 결과, Claude Code는 100.3M 입력 토큰(99.4%)을 사용한 반면 출력 토큰은 616K(0.6%)에 불과했으며, 반복된 컨텍스트 재전송으로 인해 84.2M 토큰이 캐시되었습니다.

OpenClawRadar
클로드 연구 프리뷰, 작업 자동화를 위한 직접 컴퓨터 제어 기능 추가
News

클로드 연구 프리뷰, 작업 자동화를 위한 직접 컴퓨터 제어 기능 추가

Anthropic이 Claude가 직접 컴퓨터를 제어하여 앱 열기, 브라우저 탐색, 스프레드시트 채우기와 같은 작업을 완료할 수 있는 연구 프리뷰를 공개했습니다. macOS의 Pro 및 Max 사용자에게 제공되며, Claude Cowork 및 Claude Code를 통해 작동하며 모바일 페어링이 필요합니다.

OpenClawRadar