Разбивка затрат на ИИ-агента: $12 в месяц с локальными моделями и облачными API.

Разбивка затрат на запуск ИИ-агента
Разработчик поделился опытом запуска ИИ-агента в течение месяца с общей стоимостью $12. В настройке использовался Mac Mini с Ollama для локального выполнения моделей и облачные API для определенных задач.
Конкретные детали из источника
- Общая стоимость: $12 за один месяц работы
- Использование локальных моделей: 80% через Ollama при стоимости $0
- Использование облачных API: 20% при стоимости примерно $12
- Объем задач: Около 800 задач выполнено за месяц
- Инфраструктура: Аппаратное обеспечение Mac Mini, запускающее Ollama для локального вывода
Критический инцидент и меры по устранению
Один инцидент с циклом повторных попыток почти потребил весь бюджет, стоив $4.80 всего за 11 минут. Этот опыт привел к внедрению механизмов автоматического отключения для всех операций, чтобы предотвратить подобные неконтролируемые затраты в будущем.
Разработчик спросил сообщество об их собственном отслеживании затрат между локальным и облачным использованием ИИ, конкретно интересуясь, как другие распределяют использование между этими подходами.
Ollama — это инструмент для запуска больших языковых моделей локально на персональном оборудовании, что исключает затраты на API, но требует достаточных вычислительных ресурсов. Упомянутый Mac Mini обеспечивает баланс производительности и энергоэффективности для локальных рабочих нагрузок ИИ. Механизмы автоматического отключения в этом контексте относятся к шаблонам программирования, которые предотвращают накопление чрезмерных затрат из-за повторных неудачных попыток, аналогично электрическим автоматическим выключателям, предотвращающим перегрузки.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

Как одна команда заменила агентство HubSpot с шестизначным счетом на Claude Code
Средняя e-commerce компания выполнила миграцию на HubSpot Enterprise с помощью Claude Code, заменив расценки агентств в 20–80 тыс. евро за частичные решения. За 4 месяца они создали 6 пользовательских объектов, 5 интеграций n8n и миграцию KlickTipp, при этом Claude Code отвечал и за код, и за документацию.

Использование Claude для аудита почтовых систем на предмет отсутствующих пользовательских сценариев
Разработчик использовал Claude для анализа схемы своей базы данных и email-триггеров, выявив четыре критические пробела: отсутствие последующих действий для неподтверждённых регистраций, отсутствие подтверждения для понижения тарифов, отсутствие уведомлений о принятых приглашениях в команду и отсутствие предупреждений о приближении к лимитам тарифного плана.

Создание агента для Slay the Spire 2 с использованием локальных LLM: уроки и нерешённые задачи
Разработчик создал агента, который играет в Slay the Spire 2, используя Qwen3.5-27B через KoboldCPP/Ollama, достигая ~10 секунд на действие и ~88% успешности действий с такими техниками, как маршрутизация инструментов на основе состояния и режим одного инструмента, одновременно выявляя открытые проблемы, такие как согласованность промптов и надежность вызова инструментов.

Локальный многозадачный исследовательский помощник экономит 15–25 минут на задачу
ИТ-администратор создал локальный многокомпонентный исследовательский конвейер на моделях Ollama, который генерирует структурированные отчёты примерно за 2 минуты вместо 20-30 минут ручного исследования. Система работает на RTX 5090 с 64 ГБ ОЗУ и интегрирована с OpenClaw для управления агентами.