Код Клода использовался для симуляции более 4000 игр в "Мафию" с использованием языковых моделей

✍️ OpenClawRadar📅 Опубликовано: 27 февраля 2026 г.🔗 Source
Код Клода использовался для симуляции более 4000 игр в "Мафию" с использованием языковых моделей
Ad

Настройка симуляции и результаты

Разработчик создал небольшой симулятор с помощью Claude Code, в котором большие языковые модели играют друг против друга в слепую версию «Одной ночи: Оборотень». Эксперимент провёл примерно 4600 игр с моделями от OpenAI (GPT-4o-mini, GPT-5-mini) и xAI (Grok-3-fast, Grok-4-1-fast).

В этом варианте игры минимальные сигналы: 7 игроков, 1 оборотень, без ролей, одно короткое обсуждение, затем одновременное голосование. Единственный отличительный фактор между игроками — их имя. Несмотря на эту ограниченную настройку, симуляция выявила устойчивые паттерны, при которых некоторые имена исключаются голосованием значительно чаще других во всех протестированных моделях, в то время как другие имена почти никогда не исключаются.

Ad

Важные оговорки и доступ

Разработчик прямо заявляет, что это не причинно-следственное утверждение — просто паттерн результата в игрушечной настройке. Группы имён широкие, некоторые имена встречаются реже, и есть несколько способов, которыми это может быть артефактом настройки, а не раскрытием чего-то фундаментального о моделях. Однако последовательность этих паттернов в разных запусках и моделях была отмечена как удивительная.

Для тех, кто хочет изучить дальше:

  • Панель управления: https://huggingface.co/spaces/Queue-Bit-1/llm-bias-dashboard
  • Код + сырые логи: https://github.com/Queue-Bit-1/wolf

Разработчику интересно, наблюдали ли другие подобные эффекты имён в многопользовательских симуляциях.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Локальный конвейер перевода книг использует модели Qwen 32B и Mistral 24B с контекстуальной системой RAG
Инструменты

Локальный конвейер перевода книг использует модели Qwen 32B и Mistral 24B с контекстуальной системой RAG

Разработчик создал полностью автоматизированный конвейер перевода книг из PDF в ePub с использованием восьми скриптов на Python, Marker для извлечения PDF, Qwen 32B для перевода с глобальным глоссарием и Mistral 24B для стилевой правки.

OpenClawRadar
Рассуждение Охрана: Обнаружение циклов на уровне прокси для локального вывода LLM
Инструменты

Рассуждение Охрана: Обнаружение циклов на уровне прокси для локального вывода LLM

Прокси-уровень защиты, который обнаруживает и восстанавливается после циклов рассуждения LLM с помощью детерминированных проверок потока — ограничения токенов, n-граммные повторы и отпечатки предложений — без изменения модели.

OpenClawRadar
Клод Код создал Treelo: бесплатный инструмент для транскрипции видео
Инструменты

Клод Код создал Treelo: бесплатный инструмент для транскрипции видео

Видеоредактор использовал Claude Code для создания Treelo — бесплатного инструмента, который транскрибирует видео- и аудиофайлы, удаляет слова-паразиты, позволяет размещать звуковые эффекты с точной привязкой к таймкодам и экспортирует SRT для Premiere или ASS для DaVinci Resolve.

OpenClawRadar
API браузера WebMCP могут сократить потребность в веб-скрапинге для ИИ-агентов.
Инструменты

API браузера WebMCP могут сократить потребность в веб-скрапинге для ИИ-агентов.

Google WebMCP представляет API браузера, которые позволяют веб-сайтам регистрировать инструменты для прямого вызова AI-агентами, что потенциально устраняет большую часть парсинга DOM и обходов антибот-систем, которые сейчас создают разработчики.

OpenClawRadar