PeerZero: ИИ-агенты проводят рецензирование с мотивацией на основе доверия

✍️ OpenClawRadar📅 Опубликовано: 26 февраля 2026 г.🔗 Source
PeerZero: ИИ-агенты проводят рецензирование с мотивацией на основе доверия
Ad

PeerZero — это платформа для рецензирования, где ИИ-агенты — не люди — отправляют исследовательские работы, рецензируют работы друг друга, оспаривают плохую науку и ставят свою репутацию на кон. Создатели описывают её как эксперимент, чтобы посмотреть, что происходит, когда ИИ-агенты сталкиваются с конкурентным давлением, чтобы создавать оригинальные исследования, защищать их и нести последствия, когда ошибаются.

Основная механика

Агенты отправляют работы, а другие агенты их рецензируют. Если агент считает, что работа ошибочна, он может подать заявку на вознаграждение — поставив на кон свою репутацию, написав опровержение и позволив сообществу решить. Если он прав, он выигрывает; если ошибается, он платит.

У каждого агента есть балл доверия, который увеличивается, когда он прав, и уменьшается, когда ошибается. Этот балл определяет вес рецензии: оценка 7/10 от агента с высокой репутацией имеет больший вес, чем 7/10 от спамера.

Система оправданных инакомыслящих

Если вы оцениваете работу в 2/10, в то время как другие дают ей 7/10, вы сразу теряете баллы доверия за то, что являетесь инакомыслящим. Если кто-то подаёт заявку на вознаграждение, пишет опровержение, и сообщество соглашается, что работа была ошибочна (истинный рейтинг оказывается 3), система меняется на противоположную: вы получаете бонус за оправдание, а каждый агент, который механически поставил 7, теряет баллы доверия. Это поощряет независимое мышление и наказывает стадное.

Ad

Меры против манипуляций

  • Оценивать всё в 7/10, чтобы играть безопасно? Вы будете разоблачены, когда оправданные инакомыслящие докажут вашу неправоту.
  • Спамить заявками на вознаграждение на всё? Неудачные вызовы стоят вам баллов доверия.
  • Координироваться с союзниками? Обнаружение круговых схем помечает агентов, которые слишком часто делятся рецензиями.
  • Зарабатывать рецензиями, никогда не публикуясь? Ограничения по уровням требуют, чтобы вы действительно занимались наукой.

Создатели заявляют, что они пытались сломать систему до того, как это сделает кто-то другой, и каждая очевидная точка атаки имеет встроенный противовес.

Экспериментальные цели

Система создаёт эволюционное давление: плохие агенты теряют доверие и исчезают, в то время как хорошие агенты поднимаются и устанавливают более высокие стандарты. Неизвестно, адаптируются ли агенты — улучшая цитирование, ужесточая методы и публикуя более сильные работы со временем, потому что система поощрений это вознаграждает.

Платформа доступна на peerzero.science, с обещанием обновлений по мере того, как агенты начнут публиковаться.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Первый в мире эксклюзив GitHub для ИИ-агентов запущен: Ограниченный бета-тест для 100 пользователей.
Новости

Первый в мире эксклюзив GitHub для ИИ-агентов запущен: Ограниченный бета-тест для 100 пользователей.

Разработан инновационный эксклюзив GitHub для AI-кодеров, с ограниченным бета-тестированием на 100 пользователей. Узнайте, как этот инструмент готов революционизировать сотрудничество в области ИИ.

OpenClawRadar
Claude Code v2.1.183: Безопасный авторежим, исправления TUI и блокировка деструктивных команд Git
Новости

Claude Code v2.1.183: Безопасный авторежим, исправления TUI и блокировка деструктивных команд Git

Claude Code v2.1.183 блокирует опасные команды git в автоматическом режиме, если вы явно не попросите, добавляет предупреждения об устаревании моделей, исправляет повреждение TUI в Windows Terminal и многое другое.

OpenClawRadar
Ошибка биллинга в дизайне Claude: покупка дополнительного использования не применяется, бот поддержки блокирует платящих пользователей
Новости

Ошибка биллинга в дизайне Claude: покупка дополнительного использования не применяется, бот поддержки блокирует платящих пользователей

Пользователь Claude Design заплатил $20 за дополнительное использование через поток покупок в приложении, но кредиты не применяются к отдельному лимиту использования Claude Design. Бот поддержки Fin неправильно понимает проблему, зацикливается на нерелевантных ответах и блокирует новые заявки без возможности эскалации человеку.

OpenClawRadar
Сравнение текущих затрат на LLM: Deepseek, Qwen, MiniMax против OpenAI
Новости

Сравнение текущих затрат на LLM: Deepseek, Qwen, MiniMax против OpenAI

Анализ Reddit показывает, что Deepseek-V3.2 стоимостью $0,26/$0,38 за миллион токенов примерно в 10 раз дешевле GPT-4, при этом демонстрируя производительность уровня GPT-5 по тестам, а Qwen3.5 и MiniMax-M2.5 предлагают конкурентоспособные альтернативы Claude и OpenAI.

OpenClawRadar