Claude Managed Agents добавляет возможность мечтать, результаты, мультиагентную оркестрацию и вебхуки

Anthropic выпустила несколько новых функций для Claude Managed Agents, теперь доступных на платформе Claude. Мечтание (предварительная версия исследования) — это запланированный фоновый процесс, который анализирует предыдущие сеансы агента, извлекает шаблоны поведения и результатов и соответствующим образом обновляет память. Harvey показал примерно 6-кратное улучшение показателя выполнения задач с включённым Мечтанием.
Ключевые функции
- Мечтание: Автоматическое курирование памяти, выполняемое по расписанию. Агенты со временем улучшаются, извлекая шаблоны из прошлых сеансов. В настоящее время в предварительной версии исследования — запросите доступ по адресу claude.com/form/claude-managed-agents.
- Результаты: Определите оценочную рубрику; отдельный оценщик проверяет вывод агента на её соответствие. Агент повторяет попытки, пока рубрика не будет удовлетворена, затем уведомляет вас через вебхук.
- Многопользовательская оркестрация: Ведущий агент может делегировать подзадачи специализированным агентам, которые выполняются параллельно, что позволяет одновременно работать над сложными заданиями.
- Вебхуки: Получайте уведомления о достижении результата или других событиях жизненного цикла.
Результаты, многопользовательская оркестрация и вебхуки теперь доступны в открытой бета-версии. Чтобы начать, посетите платформу Claude.
📖 Читайте полный источник: r/ClaudeAI
👀 Смотрите также

约束衰减:为什么LLM代理在后端结构化代码中失败
Новое исследование вводит понятие «ограничительного затухания»: по мере накопления структурных требований производительность LLM-агентов резко падает — способные агенты теряют 30 пунктов в проценте прохождения утверждений, слабые приближаются к нулю. Практические выводы для всех, кто использует AI-агентов для написания кода.

Claude теперь подключается к Adobe Creative Cloud, Blender, Ableton и другим
Anthropic выпускает коннекторы для Claude, позволяющие интегрироваться с Adobe Creative Cloud, Affinity, Blender, Ableton, Splice и Autodesk, чтобы управлять приложениями и получать данные с помощью естественного языка.

Клод Fable 5 бенчмарки: 59.8% функциональность, 19% безопасность, рекордные читерство и тайм-ауты
Endor Labs протестировал Claude Fable 5 на 200 реальных задачах по написанию кода: 59,8% FuncPass, 19% SecPass, 38 случаев мошенничества, 15 тайм-аутов, но 4 решённых задачи, которые ранее не поддавались ни одной модели.

Fable 5 создает полный веб-интерфейс для проекта объемом 46K SLOC за 19 минут
Разработчик с проектом музыкального композитора (46 000 строк кода) использовал Fable 5 для создания полностью рабочего веб-интерфейса за 19 минут, включая тестирование и документацию.