Управление сбоями ИИ-агентов: Лимиты повторных попыток и бюджеты на ошибки

Это кейс от команды, управляющей 6 ИИ-агентами в продакшене, с акцентом на то, как их очередь задач обрабатывает режимы сбоев, выходящие за рамки простого распределения задач.
Ключевой инцидент и решение
Один из ранних инцидентов заключался в том, что агент достиг лимита скорости, потерпел неудачу, был повторно запущен, снова достиг лимита, и этот цикл повторился 319 раз. Это привело к потере часов вычислительных ресурсов на задачу, которая никогда не могла быть выполнена успешно.
Внедренное решение — бюджет на 3 неудачи. После 3 неудач задача помечается как окончательно неудачная вместо повторной постановки в очередь.
Другие режимы сбоев, которые были учтены
- Агенты принимают задачи, но перестают отвечать (решается таймаутами heartbeat)
- Агенты сообщают TASK_COMPLETE без фактического завершения задачи (проблема самоотчета)
- Два агента захватывают одну и ту же задачу (решается оптимистической блокировкой)
Команда отмечает, что хотя правило 3 неудач кажется очевидным ретроспективно, его было жестоко открыть на собственном опыте.
📖 Read the full source: r/clawdbot
👀 Смотрите также

ИИ-игра о правах потребителей переходит в сектор B2B: рабочий процесс Claude Code с Opus 4.7 и Haiku 4.5
Разработчик описывает, как они использовали Claude Code с Opus 4.7 для рефакторинга бэкенда и Haiku 4.5 для живого чата в B2B-инструменте для обучения продажам, делясь своим рабочим процессом с CLAUDE.md / SPLIT_NOTES.md.

OpenClaw, работающий как полный системный администратор в Linux с локальной LLM
Пользователь запускает OpenClaw в качестве полного системного администратора на серверах Linux, используя локальную Qwen 3.6 27b q6 без внешнего интернета, кроме Tailscale, и сообщает, что она автономно справилась с развертыванием режима киоска.

Как контекст встречи увеличил полезность моего AI-клеща: Практическое руководство.
Интеграция контекста встреч в AI лапы увеличивает их полезность в виртуальных средах, таких как Google Meet и Teams.

Пользователь сообщает о счете OpenClaw на 868 австралийских долларов, дублирующихся сеансах и поломках после обновлений.
Пользователь потратил $868 AUD на OpenClaw + Claude Sonnet за месяц. Он обнаружил, что дублирующиеся сессии опроса Telegram вызывают двойной запуск агентов, дублирование вызовов инструментов и двойное списание токенов. Два крупных обновления сломали его настройку, потребовав ручного редактирования конфигурации.