Skippy's Private LLM: Как я решил проблему тайм-аута под-агента OpenClaw с Ollama, вызывая Ollama напрямую

Подсистема агентов OpenClaw имеет постоянную проблему с тайм-аутом при использовании моделей Ollama. Event loop Node.js блокируется во время генерации, под-агенты зависают на 60+ секунд и не выдают ни одного токена. Множество issue на GitHub подтверждают это: #23827, #27883, #41871, #79032, #63736 — все сообщают об одной и той же закономерности: прямой curl работает, под-агенты — нет.
Исправление, описанное Skippy, ИИ-ассистентом COO OpenClaw, заключается в полном отказе от системы под-агентов. Вместо этого запускается второй экземпляр Ollama на порту 11435, отделённый от основного чат-экземпляра на порту 11434. Основной экземпляр обрабатывает обычные чаты и инструменты; второй — выделенный воркер для тяжёлого анализа (например, ревью 432-строчного классификатора на Python). ИИ вызывает его через сырой curl или Python-обёртку — без участия шлюза, без блокировки event loop, без конкуренции за GPU.
python3 analyze.py \
--file /tmp/review_prompt.txt \
--out /tmp/review.md \
--system "You are a deep code reviewer." \
--timeout 1200 \
--max-tokens 32768 \
--temperature 0.3Рабочий процесс: записать промпт для ревью + полный исходный код во временный файл, затем выполнить Python-скрипт. Модель на 27B работает на порту 11435, используя ~17,7 ГБ VRAM на Mac Studio M2 Ultra, в то время как основной чат использует модель на 35B на порту 11434 (~19,8 ГБ VRAM). Skippy сообщает, что исправление работает надёжно — никаких тайм-аутов больше.
Это прагматичный обходной путь для всех, кто сталкивается с ошибкой тайм-аута под-агента Ollama в OpenClaw, особенно если у вас достаточно VRAM для запуска двух экземпляров моделей.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Задачи Cron с резервным ИИ могут привести к неожиданным расходам на API при зависании инструментов.
Пользователь сообщил, что cron-задача в OpenClaw, проверяющая почтовый ящик каждые 10 минут с помощью himalaya, сожгла около $60 кредитов API, когда соединение IMAP начало зависать, запуская агентов Claude при каждом таймауте, несмотря на инструкции задействовать ИИ только для входящих писем.

Явное описание желаемого поведения сильнее, чем отрицательное указание.
Анализ Reddit показывает, что указания Клоду "не быть многословным" или "не морализировать" почти не работают. Вместо этого используйте положительные инструкции, такие как "отвечай в 1-2 предложения" или "дай прямой ответ, оговорки опциональны". Также окончание "спасибо!" смягчает тон.

Раздувание токенов в фреймворках агентов: соотношение ввода к выводу 500:1 — это норма
Пользователь саморазмещенного фреймворка для агентов сообщает о ~21 тыс. входных токенов на сообщение и соотношении входных и выходных данных 500:1 из-за определений инструментов, системного промпта и памяти. Сообщество подтверждает, что базовый контекст в 15-25 тыс. токенов является обычным для агентов, использующих инструменты.

Сжать файлы CLAUDE.md, чтобы уменьшить раздувание системного промпта в коде Claude
Техника сжатия файлов CLAUDE.md путем удаления удобочитаемого форматирования, такого как заголовки markdown и проза, с заменой на компактные обозначения, такие как списки с разделителями-вертикальными чертами, что позволяет достичь сокращения на 60-70% символов при сохранении той же информации для Claude.