Код Клода использовался для симуляции более 4000 игр в "Мафию" с использованием языковых моделей

Настройка симуляции и результаты
Разработчик создал небольшой симулятор с помощью Claude Code, в котором большие языковые модели играют друг против друга в слепую версию «Одной ночи: Оборотень». Эксперимент провёл примерно 4600 игр с моделями от OpenAI (GPT-4o-mini, GPT-5-mini) и xAI (Grok-3-fast, Grok-4-1-fast).
В этом варианте игры минимальные сигналы: 7 игроков, 1 оборотень, без ролей, одно короткое обсуждение, затем одновременное голосование. Единственный отличительный фактор между игроками — их имя. Несмотря на эту ограниченную настройку, симуляция выявила устойчивые паттерны, при которых некоторые имена исключаются голосованием значительно чаще других во всех протестированных моделях, в то время как другие имена почти никогда не исключаются.
Важные оговорки и доступ
Разработчик прямо заявляет, что это не причинно-следственное утверждение — просто паттерн результата в игрушечной настройке. Группы имён широкие, некоторые имена встречаются реже, и есть несколько способов, которыми это может быть артефактом настройки, а не раскрытием чего-то фундаментального о моделях. Однако последовательность этих паттернов в разных запусках и моделях была отмечена как удивительная.
Для тех, кто хочет изучить дальше:
- Панель управления: https://huggingface.co/spaces/Queue-Bit-1/llm-bias-dashboard
- Код + сырые логи: https://github.com/Queue-Bit-1/wolf
Разработчику интересно, наблюдали ли другие подобные эффекты имён в многопользовательских симуляциях.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Локальный конвейер перевода книг использует модели Qwen 32B и Mistral 24B с контекстуальной системой RAG
Разработчик создал полностью автоматизированный конвейер перевода книг из PDF в ePub с использованием восьми скриптов на Python, Marker для извлечения PDF, Qwen 32B для перевода с глобальным глоссарием и Mistral 24B для стилевой правки.

Рассуждение Охрана: Обнаружение циклов на уровне прокси для локального вывода LLM
Прокси-уровень защиты, который обнаруживает и восстанавливается после циклов рассуждения LLM с помощью детерминированных проверок потока — ограничения токенов, n-граммные повторы и отпечатки предложений — без изменения модели.

Клод Код создал Treelo: бесплатный инструмент для транскрипции видео
Видеоредактор использовал Claude Code для создания Treelo — бесплатного инструмента, который транскрибирует видео- и аудиофайлы, удаляет слова-паразиты, позволяет размещать звуковые эффекты с точной привязкой к таймкодам и экспортирует SRT для Premiere или ASS для DaVinci Resolve.

API браузера WebMCP могут сократить потребность в веб-скрапинге для ИИ-агентов.
Google WebMCP представляет API браузера, которые позволяют веб-сайтам регистрировать инструменты для прямого вызова AI-агентами, что потенциально устраняет большую часть парсинга DOM и обходов антибот-систем, которые сейчас создают разработчики.