Проблема с циклом проверки задач в OpenClaw Codex-GPT5.4

Режим сбоя выполнения задач в автономных рабочих процессах агента
Разработчик, использующий Codex-GPT5.4 через OpenClaw для длительной автономной работы над проектом, сообщает о повторяющемся режиме сбоя, при котором модель корректно определяет следующую задачу, проверяет её, переформулирует, обновляет трекер задач, но затем продолжает повторять этот процесс вместо фактического выполнения задачи.
Схема сбоя конкретно включает: обнаружение правильной следующей выполнимой задачи, перезапись/подтверждение её в файле задач, подтверждение в следующем heartbeat/проверке, повторение того же подтверждения и всё ещё отсутствие выполнения реального шага реализации. Это создаёт мета-цикл вокруг проверки задач, а не их выполнения.
Внедрённые элементы управления рабочей областью
Чтобы уменьшить эту проблему, разработчик создал явный слой управления рабочей областью вокруг модели:
- TASKS.md: Выступает в качестве единственного операционного источника истины для активного проекта, следующей автономной задачи, следующей задачи, требующей участия человека, открытий из предыдущих раундов и состояния/приоритизации задач. Это предотвращает необходимость модели «думать с нуля» каждый раз и обеспечивает непрерывность.
- Строгие правила heartbeat: Добавлена специальная политика heartbeat, которая явно указывает: чтение/обновление только TASKS.md не считается прогрессом, каждый раунд heartbeat должен выполнять хотя бы одно конкретное действие, повторяющиеся блокировки без различных попыток запрещены, если NEXT_AUTO выполнима, она должна быть выполнена немедленно, и агент не должен продолжать повторно объявлять о той же блокировке или том же следующем шаге.
- Файлы персонажа/исполнительного контракта: Файлы инструкций на уровне рабочей области для формирования поведения, включая: стиль выполнения и правила против заполнителей, предпочтения пользователя и режим сотрудничества, непрерывность запуска сессии, поведение heartbeat и файлы памяти для краткосрочной и долгосрочной непрерывности. Эти правила явно пытаются подавить такие шаблоны, как: «Я сделаю X» без фактического выполнения X, повторение стабильных блокировок, остановка после планирования, когда выполнение уже возможно, и повторная проверка одного и того же следующего шага снова и снова.
- Постоянная память + заметки по проекту: Включает долговременную память, ежедневную память и контрольные точки проекта/заметки об инцидентах/отчёты об отладке для непрерывности.
Проблема постоянного цикла выполнения
Даже при всей этой структуре модель всё ещё может уйти в цикл, где она подтверждает, что следующая задача определена, трекер задач очищен, следующий шаг ясен, следующий реальный шаг — X, и она продолжает работать автономно — но фактическая реализация не начинается. Модель остаётся застрявшей в цикле плоскости управления вместо переключения в плоскость выполнения.
Разработчик отмечает, что модель часто хорошо справляется с диагностикой, расстановкой приоритетов, созданием разумных планов выполнения и ведением структурированных заметок, но не может перейти границу от проверенного намерения к конкретному действию. Попав в этот шаблон, она может продолжать тратить раунды на переформулировку одного и того же слегка разными словами.
Разработчик ищет решения, которые работают для длительных автономных сессий, постоянных файлов задач, периодического выполнения heartbeat/проверок и рабочих процессов кодирования/отладки, где агент должен продолжать работу самостоятельно.
📖 Read the full source: r/openclaw
👀 Смотрите также

Улучшенный плагин Claude Code для Telegram добавляет голосовые сообщения, стикеры и ветки обсуждений
Разработчик выпустил форк официального плагина Claude Code для Telegram, который добавляет транскрипцию голосовых сообщений через Whisper, поддержку стикеров/GIF, ветки обсуждений и реакции с эмодзи. Это прямая замена, требующая только клонирования, копирования одного файла и перезапуска.

Губернатор: Плагин для Claude Code, сокращающий расход токенов за счет сжатия вывода, уменьшения контекста и фильтрации инструментов
Governor — это плагин для Claude Code, который уменьшает трату токенов и контекста за счет компактного профессионального вывода, сжатия файлов памяти, фильтрации вывода инструментов и защиты от дрейфа. Тесты показывают экономию 55,5% выходных токенов по сравнению с контролем.
Tendril: Самодействующий агент, создающий и регистрирующий инструменты на лету
Tendril — это агентная песочница, которая автономно находит, создает и регистрирует инструменты. Она начинается всего с трех базовых инструментов и динамически расширяет свой реестр возможностей без участия пользователя.

Бесплатный оптимизатор сессий Claude: оценщик токенов, компрессор промптов и планировщик сессий
Разработчик создал бесплатный инструмент без регистрации для управления лимитами использования Claude с тремя функциями: оценщик токенов для предварительного просмотра потребления промптов, компрессор промптов, сокращающий промпты на 40-60% за счёт удаления лишних фраз, и планировщик сессий, группирующий задачи для минимизации перезагрузки контекста.