Сэкономьте на счетах за Claude Code, направив токены планирования на более дешевые модели

Пользователь Reddit сообщает, что в прошлом месяце сэкономил около $40 на дополнительных сборах в Claude Code, распределив использование токенов между моделями. Ключевая идея: этапы планирования (особенно при рефакторинге нескольких файлов) могут потреблять до 80% бюджета токенов, но для большинства задач планирования не нужна самая дорогая модель.
Как это работает
Они написали обёртку из 30 строк, которая направляет начальную работу по определению изменений на Haiku 3.5 — более дешёвую модель. Только сами правки и принятие решений остаются на Opus или Sonnet. Настройка заняла около 2 часов, включая выяснение того, какие шаги стоит передать.
Результаты
В последнем цикле впервые за 4 месяца остался остаток бюджета. Пользователь избежал обычного 2-дневного ожидания окна сброса. Экономия: примерно $40 на дополнительных сборах.
# Псевдокод логики обёртки:
# 1. Отправить запрос на планирование в haiku-3.5
# 2. Получить список файлов и изменений
# 3. Передать план и инструкцию в opus/sonnet для фактических правок
Оговорки
Качество планирования Haiku заметно хуже в архитектурных решениях. Для рабочих процессов рефакторинга и тестирования, где Opus всё равно принимает реальные решения, это нормально. Для проектирования с нуля ("чем должно быть это приложение") пользователь по-прежнему позволяет Opus планировать с нуля.
Пользователь отмечает, что этот шаблон "вероятно, очевиден для тех, кто смотрел таблицы цен моделей OpenRouter", но документация по под-агентам Claude Code скудна по данному подходу.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

После 3 месяцев A/B-тестирования 160 промпт-кодов для Claude: скучные выводы
Самарт создал контролируемый тестовый стенд, прогнал через него 160 промпт-кодов и обнаружил, что большинство из них — плацебо, 7 последовательно меняют рассуждения, а наложение 3+ кодов сбивает модель с толку. Файлы навыков превосходят промпт-коды для Claude Code.

Шаблоны кода превосходят руководства по ИИ: перенос расширения Firefox в Chrome
Разработчик дважды безуспешно пытался перенести расширение Firefox на Chrome с помощью подсказок ИИ, но в итоге преуспел, выделив браузерно-независимую основную логику с интерфейсом BrowserShell, сократив специфичный для Chrome код до 5 значимых строк.

Исправление дрейфа OpenClaw: четыре навыка оператора для укрепления агентских рабочих процессов
Разработчик делится четырьмя операторскими навыками — Outcome Guard, Direction Clarifier, Routing Enforcer, Completion Verifier, — чтобы остановить дрейф агентов и преждевременное завершение задач.

Wtf.md и Dreaming: две концепции рабочего процесса Claude, которые стоит изучить
Разработчик делится двумя концепциями для Claude: Wtf.md для хранения ошибок, которые допускает Claude, и Dreaming — идея Карпати о ночной консолидации сессий.