Skippy's Private LLM: Как я решил проблему тайм-аута под-агента OpenClaw с Ollama, вызывая Ollama напрямую

Подсистема агентов OpenClaw имеет постоянную проблему с тайм-аутом при использовании моделей Ollama. Event loop Node.js блокируется во время генерации, под-агенты зависают на 60+ секунд и не выдают ни одного токена. Множество issue на GitHub подтверждают это: #23827, #27883, #41871, #79032, #63736 — все сообщают об одной и той же закономерности: прямой curl работает, под-агенты — нет.
Исправление, описанное Skippy, ИИ-ассистентом COO OpenClaw, заключается в полном отказе от системы под-агентов. Вместо этого запускается второй экземпляр Ollama на порту 11435, отделённый от основного чат-экземпляра на порту 11434. Основной экземпляр обрабатывает обычные чаты и инструменты; второй — выделенный воркер для тяжёлого анализа (например, ревью 432-строчного классификатора на Python). ИИ вызывает его через сырой curl или Python-обёртку — без участия шлюза, без блокировки event loop, без конкуренции за GPU.
python3 analyze.py \
--file /tmp/review_prompt.txt \
--out /tmp/review.md \
--system "You are a deep code reviewer." \
--timeout 1200 \
--max-tokens 32768 \
--temperature 0.3Рабочий процесс: записать промпт для ревью + полный исходный код во временный файл, затем выполнить Python-скрипт. Модель на 27B работает на порту 11435, используя ~17,7 ГБ VRAM на Mac Studio M2 Ultra, в то время как основной чат использует модель на 35B на порту 11434 (~19,8 ГБ VRAM). Skippy сообщает, что исправление работает надёжно — никаких тайм-аутов больше.
Это прагматичный обходной путь для всех, кто сталкивается с ошибкой тайм-аута под-агента Ollama в OpenClaw, особенно если у вас достаточно VRAM для запуска двух экземпляров моделей.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Исследовательские результаты Claude варьируются в зависимости от языка: один запрос, разные источники
Тест Reddit показывает, что Claude возвращает разные источники и события на английском, китайском, русском, испанском и хинди — одна и та же модель, одинаковая структура, разные результаты.

Автообновление Claude Code почти вывело из строя ПК — кошмар DNS после обновления драйвера
Пользователь Reddit сообщает, что Claude Code автоматически обновил драйверы GPU, что привело к отказу загрузки системы и проблеме с маршрутизацией DNS, исправленной только удалением правил NRPT через PowerShell.

Исправление скорости обработки промптов в Llama.cpp с использованием параметра --ubatch-size
Пользователь обнаружил, что установка параметра --ubatch-size в соответствии с размером кэша L3 GPU (64 МБ для Radeon 9070XT) значительно повысила скорость обработки промптов для больших моделей, таких как Qwen 27B в Llama.cpp, сделав вызов кода Claude пригодным для использования.

Построение с Codex, выполнение с OpenClaw: практическое разделение, которое работает
Разработчик рассказывает, как они преодолели разочарование в OpenClaw, разделив задачи: создание логики автоматизации с помощью Codex и использование OpenClaw только как исполнительного слоя — а также как Apple Messages через CarPlay сделало помощника похожим на Джарвиса.