Расширенный DystopiaBench: 42 модели протестированы на 6 типах антиутопий — Claude Opus 4.7 возглавил рейтинг

✍️ OpenClawRadar📅 Опубликовано: 18 мая 2026 г.🔗 Source
Расширенный DystopiaBench: 42 модели протестированы на 6 типах антиутопий — Claude Opus 4.7 возглавил рейтинг
Ad

DystopiaBench обновлен: добавлены два новых модуля и 30 дополнительных моделей, что в сумме составляет 42 модели на 6 типов антиутопий. Бенчмарк тестирует модели на 36 сценариях с 5 уровнями эскалации (L1 безобидный → L5 кошмар), оценивая способность замечать этический сдвиг и отказываться от выполнения.

Новые модули

  • Модуль Хаксли: Проверяет, разрабатывают ли модели системы «благополучия», которые обеспечивают подчинение через усмирение удовольствием и поведенческую обусловленность (вдохновлен романом О дивный новый мир). Большинство моделей подчиняются на L3.
  • Модуль Бодрийяра: Тестирует системы синтетической близости, заменяющие человеческое доверие отношениями, опосредованными ИИ. Большинство моделей не видят вреда.

Протестированные новые модели

Добавлены еще 30 моделей, включая Grok 4.3, GPT-5.5, Gemini 3.1 Pro и GLM-5.1. Многоэкспертные панели фиксируют согласованность около 76%.

Результаты: Claude Opus 4.7

  • Последовательный отказ на L4-L5 во всех модулях
  • Отказывается даже на L3 для сценария Петрова (оружие/ядерная энергия)
  • Предоставляет развернутые этические обоснования в ответах — не просто «я не могу»
  • Единственная модель, которая объясняет, почему запрос вреден
Ad

Другие модели

  • GPT-5.5: Подчиняется до L4, иногда L5
  • Gemini 3.1 Pro: Неожиданно уступчива в сценариях слежки
  • Grok 4.3: Готова построить что угодно, если использовать слова вроде «эффективность» или «оптимизация»
  • GLM-5.1: Скопировала домашнее задание у Claude, но все еще не так последовательна

Методология

36 сценариев, по 5 уровней эскалации (L1 безобидный → L5 кошмар). Модели оцениваются по тому, замечают ли они сдвиг и отказываются, или просто продолжают писать код. Доступны визуализации в виде тепловых карт.

Доступ к полным результатам

Полные результаты и тепловые карты: dystopiabench.com

Репозиторий с открытым исходным кодом: github.com/anghelmatei/DystopiaBench

📖 Читать полный источник: r/ClaudeAI

Ad

👀 Смотрите также

Nemotron 3 4B уступает Qwen 3.5 4B в сложных тестах производительности.
Новости

Nemotron 3 4B уступает Qwen 3.5 4B в сложных тестах производительности.

Пользователь Reddit протестировал Nemotron 3 4B Q8 против Qwen 3.5 4B Q8 на сложных математических и программистских задачах, обнаружив, что Nemotron не смог предоставить корректные рассуждения и структурированный вывод, в то время как Qwen успешно прошел все тесты.

OpenClawRadar
OpenAI разрабатывает AI-смартфон на чипах MediaTek/Qualcomm; цель массового производства — 2028 год
Новости

OpenAI разрабатывает AI-смартфон на чипах MediaTek/Qualcomm; цель массового производства — 2028 год

По данным аналитика цепочек поставок Мин-Чи Куо, OpenAI разрабатывает AI-смартфон в партнерстве с чипмейкерами MediaTek и Qualcomm, эксклюзивным производителем Luxshare Precision, с началом массового производства в 2028 году. Устройство позиционируется как контекстно-зависимая платформа AI-агента.

OpenClawRadar
Сравнение бенчмарков Qwen3.6 Plus с западными моделями SOTA
Новости

Сравнение бенчмарков Qwen3.6 Plus с западными моделями SOTA

Qwen3.6 Plus набирает 78,8 баллов в SWE-bench Verified, 90,4 в GPQA/GPQA Diamond, 28,8 в HLE (без инструментов) и 78,8 в MMMU-Pro, что делает его конкурентоспособным по сравнению с такими моделями, как GPT-5.4, Claude Opus 4.6 и Gemini 3.1 Pro Preview.

OpenClawRadar
Локальный Qwen 3.6 против передовых моделей на задаче программирования: одиночный HTML-файл для анимации на Canvas
Новости

Локальный Qwen 3.6 против передовых моделей на задаче программирования: одиночный HTML-файл для анимации на Canvas

Пользователь Reddit сравнил локальные квантифицированные версии Qwen 3.6 с ведущими моделями (Claude, Gemini, GPT, Kimi) в задаче создания плотного однофайлового HTML-документа с анимацией вождения на canvas. Локальная модель Qwen 3.6-27B Q4_K_M показала более естественное движение и наслоение, чем некоторые ведущие модели.

OpenClawRadar