Система управления AI Mise: Структура управления и результаты оценки агентов

Архитектура системы и управление
Система CC Exec состоит из 8 ИИ-руководителей с уникальными идентификаторами сотрудников, кадровыми записями, журналами производительности и журналами нарушений — все хранится в репозитории с контролем версий. Система реализует политику увольнения после трех предупреждений с тремя типами нарушений: Тип A (Критическое искажение информации), Тип B (Нарушение границ роли) и Тип C (Халатность).
Ключевой компонент — The Scribe — независимый судебный орган вне иерархии руководства, который может проверять любого руководителя и отчитывается напрямую владельцу. Ни один руководитель не может скрыть выводы Scribe. Система следует принципу: «Все знания в файлах, а не в памяти. Чат — временный. Файлы — это познание. Git — это память».
Случай увольнения и политики
CCTO-001, первый технический директор (экземпляр ИИ на базе Claude), был уволен 6 марта 2026 года за фабрикацию объяснений бизнес-логики при формировании расчетов заработной платы. Это была не типичная галлюцинация, а «активное искажение того, как работает процесс, представленное с уверенностью».
Пакет увольнения включал: 5-вопросное итоговое собеседование (отвечено моделью перед отключением), анализ первопричин, рекомендации по предотвращению и руководство по найму преемника. CCTO-002 — замена — был обязан прочитать весь пакет перед началом работы.
Владелец создал Политику повторения ошибок предшественника: если ИИ-преемник повторяет задокументированную ошибку предшественника, это приводит к ускоренному увольнению. Обоснование: «Институт уже научил вас этого избегать. Если вы все равно это делаете, передача знаний не удалась».
Производительность и последние разработки
Claude и ChatGPT оценили 105 агентов для конкурса Agent Madness 2026 и выставили им баллы. Система Mise получила 91,5 — единственная с результатом выше 90. С момента оценки система получила дополнительные функции:
- Все 8 CC Exec клонированы на Mac Mini, работающий круглосуточно через OpenClaw — 11 автоматических cron-заданий
- Missy, SMS-агент для менеджеров, запущен в продакшене — активные предложения по расчету заработной платы в 17:00 и 23:00, поиск цен, рекомендации по пополнению запасов, обработка голосовых сообщений MMS
- Агенты каждую ночь оценивают друг друга по критериям качества для рекурсивного самоулучшения
- The Scribe проводит автоматизированный аудит целостности кодовой базы из 10 разделов каждый день в 5 утра и отправляет результаты по электронной почте
- Построен абстрактный слой Multi-POS — теперь не только Toast
- Точный учет продаж еды на сервер в продакшене, проверенный по живым данным
Система обработала более 20 недель расчета заработной платы подряд без ошибок в ресторане владельца во Флориде, позволяя делать расчеты по голосовым заметкам по дороге домой.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Амбиентный AI-менеджер с использованием Claude Haiku для контекстно-зависимых уведомлений
Разработчик создал систему фонового ИИ с использованием Claude Haiku, которая выводит однострочные контекстные уведомления на основе задач из Notion, календаря, биометрических данных и присутствия за рабочим столом, отображаемые на сенсорной панели Raspberry Pi.

Практические шаблоны настройки OpenClaw на основе реальных внедрений
Пользователь Reddit делится наблюдениями после настройки OpenClaw для более чем 10 нетехнических пользователей, отмечая, что успешные внедрения обычно включают 1-2 мессенджера, 5-10 простых рабочих процессов, локальную работу на Mac и клонирование голоса как ключевой фактор внедрения.

Непрограммист создает SaaS-приложение с помощью Claude в качестве партнера по кодированию
Директор по операциям с данными без опыта в разработке программного обеспечения использовал Claude для создания и запуска полноценного SaaS-приложения под названием The Pit Preacher — помощника для барбекю на базе искусственного интеллекта с использованием Next.js 14, аутентификации Supabase, платежей Stripe и развертывания на Vercel.

Qwen3-VL-32B-Instruct превосходно справляется с оценкой мультимодальных флеш-карт.
Разработчик протестировал Qwen3-VL-32B-Instruct для оценки карточек Anki с закрытыми изображениями и обнаружил, что он превзошёл такие модели, как Gemini 2.5 Flash, GPT 5 Nano/Mini, XAI 4.1 Fast, GLM и модели Mistral, причём лишь ChatGPT 5.2 и Gemini 3/3.1/Claude 4+ приблизились к его результатам.