Оптимизация затрат OpenClaw: Как разработчик исправил ошибку на $750 с помощью маршрутизации моделей

Что пошло не так с исправлением затрат
После сжигания $750 за 3 дня на OpenRouter разработчик изначально "исправил" затраты, переведя всё на Hunter Alpha (бесплатно в OpenRouter). Это привело к тому, что подсистемы возвращали нулевой вывод — тихие завершения, где задания показывали "успех", но результаты были пустыми.
Конкретный случай сбоя: агент по производству видео написал код, который синтаксически проверялся корректно, запускался без ошибок, но создавал 9-секундное беззвучное черное видео без голосового сопровождения, без кадров и без манифеста. QA в итоге это обнаружил. Урок: бесплатные модели не всегда громко проваливаются — иногда они тихо поставляют заглушку и идут дальше.
Новая стратегия маршрутизации моделей
Разработчик перестал думать "дешево против дорого" и начал думать "что на самом деле нужно этой задаче":
- Основная сессия (оркестрация): Sonnet 4.6 — "Менеджер. Стоит своих денег."
- Код/сложные задачи: Gemini 2.5 Flash за $0.15/M — "Идеальное соотношение для реального вывода."
- Конфиденциальные данные (учетные данные, финансы): Claude 3.5 Haiku — "Anthropic не логирует промпты. Без обсуждений."
- Простые предсказуемые задачи: Hunter Alpha — "Подходит, когда сбой очевиден и ставки низкие."
Каждая cron-задача и запуск подсистемы теперь имеют явный параметр модели — никаких значений по умолчанию.
Обнаружение проблем безопасности во время аудита
Расследуя проблемы с моделями, разработчик обнаружил учетные данные, закоммиченные в репозитории рабочего пространства — API-ключи и OAuth-токены. Хотя они не были выложены публично, это было неприемлемо. Они добавили .gitignore для папки credentials/ и выполнили git rm --cached. Предупреждение: если вы когда-либо коммитили папку с учетными данными, эти ключи остаются в вашей истории git — замените их.
Главный урок
Оптимизация затрат — это не разовое изменение конфигурации. Модель за $0.15/M, которая пишет ваш производственный пайплайн, — это деньги, потраченные с умом. Бесплатная модель, которая тихо передает вам сломанное видео, обходится дорого, независимо от стоимости за токен. Подбирайте модель под задачу и проверяйте вывод, а не только коды завершения.
📖 Read the full source: r/openclaw
👀 Смотрите также

Локализация больших кодовых баз с помощью LLM: Рабочий процесс разработчика для 4500 UI-ключей
Разработчик делится своим рабочим процессом локализации игры с 4500 ключами интерфейса с использованием LLM. Он обнаружил, что добавление контекста к промптам перевода и использование локальных моделей, таких как Qwen 3 8B, даёт приемлемое качество, в то время как облачные модели, такие как Claude и Gemini Pro, испытывали трудности с размером файлов и точностью.

Агент тестирования OpenClaw для мобильных приложений: настройка и результаты
Разработчик создал мобильного тестового агента на OpenClaw, который выполняет тестовые шаги на простом английском языке в облачных эмуляторах, выявляя ошибки, пропущенные при ручном тестировании. Стоимость услуги составляет 350-600 долларов в месяц на клиента, а конверсия пробных лидов достигает 70-75%.

Спаситель дикой природы использует искусственный интеллект Claude для создания книги по уходу за детенышами белок и интерактивного чат-бота
Специалист по спасению дикой природы с 38-летним опытом использует Claude AI для доработки 300-страничной книги по уходу за детёнышами белок и создал интерактивного чат-бота по имени Hazel, чтобы помогать другим спасателям. Сейчас специалист проверяет возможности Claude, поручив ему отслеживать и вести дневник прогресса детёныша белки по имени Нова.

Разработчик использует Claude AI для разработки игры на C++ в Unreal Engine.
Разработчик сообщает об использовании Claude Opus для планирования и Sonnet для реализации при создании киберпанк-ситибилдера на C++ с Unreal Engine, заменяя ассеты с маркетплейса на код, сгенерированный ИИ, для таких функций, как управление трафиком ИИ с тиками на основе расстояния и отсечение по пирамиде видимости.