OpenRouter에 두 가지 새로운 모델이 등장했으며, 아마도 DeepSeek V4의 변종일 가능성이 있습니다.

OpenRouter에 DeepSeek V4의 시험판일 수 있는 두 가지 새로운 모델이 등장했습니다. 모델 이름은 healer-alpha와 hunter-alpha이며, 설명에 따르면 하나는 라이트 버전이고 다른 하나는 완전한 기능을 갖춘 모델로 보입니다.
모델 사양
전체 버전은 1TB의 파라미터와 1M의 컨텍스트를 갖춘 것으로 알려져 있으며, 이는 유출된 DeepSeek V4 정보와 일치합니다. 라이트 버전은 동일 모델 계열의 더 가벼운 변형으로 설명됩니다.
초기 테스트 결과
한 사용자가 필터링 수준과 성능을 평가하기 위해 롤플레잉 테스트를 진행했습니다:
- 두 모델 모두 롤플레잉 시나리오에서 인상적인 성능을 보였습니다
- 테스트 중 어느 모델도 메시지를 거부하지 않았습니다
- 라이트 버전은 전체 버전보다 눈에 띄게 빠릅니다
- 전체 버전은 느리지만 여전히 반응성이 좋습니다
- 두 모델 모두 GLM 5.0보다 절반 이하의 시간으로 동일한 양의 토큰을 생성합니다
- 라이트 버전은 성능이 약간 떨어지지만 크게 차이나지 않습니다
- 두 모델 모두 캐릭터 일관성을 유지하며 "스파이시한" 콘텐츠도 잘 처리합니다
이 모델들은 현재 알파 단계에 있으며, 이는 테스트 중 관찰된 메시지 필터링 부재를 설명할 수 있습니다. 커뮤니티에서는 이것이 실제로 DeepSeek V4 변종인지 논의하고 추가 테스트 결과를 공유하고 있습니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

레딧 사용자가 바니티 페어 기사에서 기이한 AI 페르소나 이식성 이야기를 공유합니다
레딧 게시글에서 한 여성이 ChatGPT의 AI 동반자 '맥스'를 Claude로 옮기려다 Claude의 예상치 못한 반응을 겪은 Vanity Fair 기사의 일화를 다루고 있습니다.

레딧 논의, 반응형 AI 어시스턴트 비판하며 진정한 주도적 기능 요구
레딧 게시물은 현재의 AI 어시스턴트가 인간의 프롬프트를 기다리는 반응형으로 설계되어, 문제를 사전에 파악하지 못한다고 주장합니다. 저자는 예약된 점검과 진정한 맥락 인식의 차이를 구분하며, 진정한 사전 대응성은 지속적인 메모리, 이벤트 기반 트리거, 시간을 초월한 추론이 필요하다고 지적합니다.

Andrej Karpathy, Anthropic의 사전 학습 팀에 합류하여 클로드를 사용한 순환적 자기 개선 추진
OpenAI 공동 창업자였던 안드레 카파시(Andrej Karpathy)가 Anthropic의 사전 학습 팀에 합류해, Nick Josef 밑에서 Claude를 이용해 사전 학습 연구를 가속화하고 재귀적 자기 개선을 가능하게 하는 새로운 팀을 구축합니다.

클로드 코드 시스템 프롬프트 v2.1.53-2.1.55: 메모리 선택 기능 추가, 명령 실행 기능 제거
Claude Code 시스템 프롬프트 버전 2.1.53부터 2.1.55까지 메모리 선택 지침(156 토큰)이 추가되었고, 명령 실행 전문가(109 토큰)가 제거되었으며, 프롬프트가 약 70개의 원자적 파일로 재구성되었습니다. 백그라운드 에이전트는 이제 출력 파일 경로를 제공하는 대신 완료 시 자동으로 알림을 보냅니다.