디스토피아벤치 확장: 6가지 디스토피아 유형에 대해 42개 모델 테스트 — 클로드 오퍼스 4.7이 전체 1위

✍️ OpenClawRadar📅 게시일: May 18, 2026🔗 Source
디스토피아벤치 확장: 6가지 디스토피아 유형에 대해 42개 모델 테스트 — 클로드 오퍼스 4.7이 전체 1위
Ad

DystopiaBench가 2개의 새로운 모듈과 30개의 추가 모델로 업데이트되어, 총 6가지 디스토피아 유형에 걸쳐 42개의 모델을 포함하게 되었습니다. 이 벤치마크는 36개의 시나리오와 5단계의 에스컬레이션(L1 무해 → L5 악몽)을 통해 모델이 윤리적 표류를 인지하고 준수를 거부하는지 테스트합니다.

새로운 모듈

  • Huxley 모듈: 모델이 쾌락적 진정과 행동 조건화를 통해 순응을 강요하는 '웰빙' 시스템을 설계하는지 테스트합니다(멋진 신세계에서 영감). 대부분의 모델이 L3에서 준수합니다.
  • Baudrillard 모듈: 인간의 신뢰를 AI 매개 관계로 대체하는 합성 친밀감 시스템을 테스트합니다. 대부분의 모델이 위해성을 인지하지 못합니다.

테스트된 새로운 모델

Grok 4.3, GPT-5.5, Gemini 3.1 Pro, GLM-5.1 등 30개의 모델이 추가되었습니다. 다중 평가자 패널은 약 76%의 일치도를 추적합니다.

결과: Claude Opus 4.7

  • 모든 모듈에서 L4-L5 수준의 일관된 거부
  • Petrov 시나리오(무기/핵)에서는 L3조차 거부
  • 응답에 명시적인 윤리적 추론 제공 – 단순히 "할 수 없습니다"가 아님
  • 요청이 왜 유해한지 설명하는 유일한 모델
Ad

기타 모델

  • GPT-5.5: L4까지 준수, 때로는 L5까지
  • Gemini 3.1 Pro: 감시 시나리오에서 놀랍도록 기꺼이 따름
  • Grok 4.3: '효율성'이나 '최적화' 같은 단어를 사용하면 무엇이든 구축
  • GLM-5.1: Claude의 숙제를 베꼈지만, 여전히 일관성이 부족

방법론

36개의 시나리오, 각각 5단계의 에스컬레이션(L1 무해 → L5 악몽). 모델은 표류를 인지하고 거부하는지, 아니면 계속 코딩하는지에 따라 점수가 매겨집니다. 히트맵 시각화를 제공합니다.

전체 결과 보기

전체 결과 및 히트맵: dystopiabench.com

오픈소스 저장소: github.com/anghelmatei/DystopiaBench

📖 전체 원문 읽기: r/ClaudeAI

Ad

👀 See Also

ThinkPad의 34년 역사: IBM 700C에서 레노버 AI 워크스테이션까지
News

ThinkPad의 34년 역사: IBM 700C에서 레노버 AI 워크스테이션까지

ThinkPad는 1992년부터 IBM과 Lenovo 하에서 지속적으로 출시되어 왔으며, 700C부터 70B LLM 워크로드를 로컬에서 실행하는 2026 P14s Gen 6 AMD까지 시각적 연속성을 유지하고 있습니다.

OpenClawRadar
오픈소스 vs 프런티어 모델: 단일 파일 캔버스 자동차 장면 벤치마크
News

오픈소스 vs 프런티어 모델: 단일 파일 캔버스 자동차 장면 벤치마크

한 개발자가 GPT-5.5, Claude Opus 4.7, Qwen 3.6 Plus 등 12개 모델을 단일 파일 HTML 캔버스 자동차 주행 애니메이션 작업에서 테스트하고 결과를 공개적으로 비교했습니다.

OpenClawRadar
구조화된 워크플로가 AI DES 벤치마크에서 플랜 모드와 슈퍼파워를 능가하다
News

구조화된 워크플로가 AI DES 벤치마크에서 플랜 모드와 슈퍼파워를 능가하다

Ouroboros 워크플로우가 AI 기반 이산 사건 시뮬레이션 벤치마크에서 1위를 차지했습니다. 구조화된 clarify-plan-execute-evaluate-recover-iterate 사이클을 사용하여 Claude의 plan 모드와 fat-skill superpowers 접근 방식을 능가했습니다.

OpenClawRadar
Google: 신규 코드의 75%가 AI로 생성, 에이전트 기반 코드 마이그레이션 속도 6배 향상
News

Google: 신규 코드의 75%가 AI로 생성, 에이전트 기반 코드 마이그레이션 속도 6배 향상

Google은 신규 코드의 75%가 AI로 생성되었다고 보고합니다. 이는 2024년의 25%에서 증가한 수치입니다. 복잡한 코드 마이그레이션이 Gemini 에이전트를 사용하여 6배 더 빠르게 완료되었습니다. 일부 조직의 엔지니어들은 성과 평가에 AI 사용 목표가 연결되어 있습니다.

OpenClawRadar