Многомодельный совет по рабочим процессам для ИИ-агентов программирования

Разработчик создал веб-инструмент для рабочего процесса, который использует несколько моделей ИИ для проверки задач программирования перед передачей их агентам кодирования. Вместо прямого запроса к агенту инструмент реализует подход «совета», где различные модели сначала анализируют задачу.
Как работает совет
Рабочий процесс запускает три конкретные модели с различными ролями:
- Архитектор (GPT-4o): Составляет план с использованием вашей реальной кодовой базы
- Скептик (Claude): Пытается разобрать план и найти крайние случаи
- Синтезатор (Gemini): Перестраивает план в готовый для агента запрос
Детали инструмента
Пользователи вставляют свою идею и при желании загружают файлы проекта. Синтезатор создаёт файл PLAN.md с явными ограничениями «НЕ ДЕЛАЙ», извлечёнными из ваших шаблонов программирования. Разработчик отмечает, что прикрепление этого PLAN.md как @PLAN.md в интерфейсе Composer Claude заметно меняет поведение агента кодирования.
Инструмент доступен по адресу https://council-gray.vercel.app и требует от пользователей предоставления собственных API-ключей. Ничего не хранится на стороне сервера.
Разработчик создал этот инструмент после наблюдения, что некоторые люди уже вручную проводили подобные проверки с несколькими моделями в разных вкладках браузера. Они ищут отзывы о том, действительно ли этот подход улучшает результат или это излишнее усложнение рабочего процесса.
📖 Прочитать полный источник: r/ClaudeAI
👀 Смотрите также

SWE-CI: Новые эталонные тесты оценивают ИИ-агентов в долгосрочном сопровождении кода через CI
SWE-CI — это бенчмарк на уровне репозитория, который оценивает агентов на основе LLM в поддержании кодовых баз через циклы непрерывной интеграции, смещая фокус со статического исправления ошибок на долгосрочную поддерживаемость в рамках 100 реальных задач.

Протокол памяти агентов (AMP): открытая спецификация для совместимой памяти ИИ-агентов на основе MCP
AMP определяет стандартный интерфейс для постоянной памяти в AI-агентах, совместимых с MCP, с шестью базовыми глаголами: encode, recall, forget, consolidate, pin и stats. Включает набор тестов на соответствие и эталонную реализацию.

Плагин OpenClaw Memos решает проблемы передачи памяти в AI-агентах для программирования.
Пользователь Reddit рассказывает, как утечка кода Claude выявила проблемы с передачей памяти в AI-агентах для программирования, где раздутые транскрипты вызывают сложности при смене моделей. Они внедрили плагин memos в OpenClaw со стратегией выборочного восстановления, чтобы сжимать недавнюю работу и отбрасывать устаревшие вызовы инструментов.

Крышка моста: Постоянная двусторонняя передача сообщений между CLI и JavaScript в браузере через CDP
Hubcap Bridge — это новая функция в инструменте командной строки Hubcap CLI, которая создаёт постоянный двусторонний канал обмена сообщениями между локальными процессами и JavaScript, выполняющимся на страницах браузера, через Chrome DevTools Protocol. Это позволяет навыкам Claude Code взаимодействовать с веб-приложениями через их внутренние JavaScript API без необходимости доступа к публичным API.