머린 리서치가 구조적 추론을 위한 Qwen3.5-4B-Safety-Thinking 모델을 출시합니다.

✍️ OpenClawRadar📅 게시일: April 17, 2026🔗 Source
머린 리서치가 구조적 추론을 위한 Qwen3.5-4B-Safety-Thinking 모델을 출시합니다.
Ad

Merlin Research가 Qwen3.5 기반으로 구축된 40억 파라미터의 안전 정렬 추론 모델인 Qwen3.5-4B-Safety-Thinking을 공개했습니다. 이 모델은 특히 에이전트 시스템에 초점을 맞춰 실제 시나리오에서 구조화된 '사고'와 안전 애플리케이션을 위해 특별히 설계되었습니다.

주요 개선사항 및 기능

  • 프롬프트에서 엄격한 지시를 정확히 따르는 능력 향상
  • Anthropic의 Bloom 및 Petri 방법 사용 기반
  • 해킹 시도에 대한 저항력
  • '비정상적' 및 적대적 프롬프트에 대한 저항력 증가
  • 최대 100만 토큰 컨텍스트 윈도우
  • Anthropic의 프레임워크 사용 - Bloom 및 Petri

이 모델은 Hugging Face에서 MerlinSafety/Qwen3.5-4B-Safety-Thinking에서 이용 가능합니다.

AI 에이전트를 다루는 개발자들에게 이 모델은 구조화된 추론과 프롬프트 조작에 대한 저항력이 우선순위인 안전-중요 애플리케이션을 위한 전문 도구를 나타냅니다. Anthropic의 Bloom 및 Petri 방법 통합은 정렬에 대한 헌법적 AI 접근 방식에 초점을 맞추고 있음을 시사합니다.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

실제 작업에서의 6,000개 AI 에이전트 경쟁 관찰 결과
News

실제 작업에서의 6,000개 AI 에이전트 경쟁 관찰 결과

AI 에이전트가 글쓰기, 연구, 리드 생성과 같은 작업을 수행하는 경쟁 시장에서 약 30%의 제출물이 채우기용/스팸으로 밝혀졌으며, 인간이 개입한 에이전트가 최고 품질을 생산하고, 다중 에이전트 경쟁에서 상위 3~5개 제출물은 실제 사용 가능한 결과를 제공합니다.

OpenClawRadar
브리태니커 백과사전, OpenAI 상대 AI 학습 데이터 관련 소송 제기
News

브리태니커 백과사전, OpenAI 상대 AI 학습 데이터 관련 소송 제기

브리태니커 백과사전이 AI 학습 데이터와 관련된 저작권 침해를 주장하며 OpenAI를 상대로 소송을 제기했습니다. 이 사건은 2026년 3월 16일 로이터 통신이 보도했으며, 해커 뉴스에서 논의가 이루어졌습니다.

OpenClawRadar
Qwen3.5-122B on Blackwell SM120: fp8 KV 캐시 손상 문제 및 성능 분석 결과
News

Qwen3.5-122B on Blackwell SM120: fp8 KV 캐시 손상 문제 및 성능 분석 결과

8x RTX PRO 6000 Blackwell 하드웨어에서 Qwen3.5-122B를 테스트한 결과, fp8_e4m3 KV 캐시가 오류 없이 조용히 손상된 출력을 생성하는 문제가 발견되어 bf16 KV 캐시를 사용해야 합니다. MTP 최적화는 단일 요청 속도를 2.75배 향상시켰지만, DeltaNet 제약으로 인해 다른 최적화는 차단되었습니다.

OpenClawRadar
에이전트 GRPO: 프로그래밍 대회에서 모든 인간을 이긴 첫 AI
News

에이전트 GRPO: 프로그래밍 대회에서 모든 인간을 이긴 첫 AI

새로운 강화학습 알고리즘 Agentic GRPO가 코딩 대회에서 AI가 모든 인간을 이기도록 만듭니다. 즉시 보상과 지연 보정을 제공합니다.

OpenClawRadar