Claude Code делегирует кодирование Mistral/DeepSeek: сохранено 57M токенов, снижение затрат на 90-100%

Разработчик pcx_wave опубликовал подробный разбор vibe-skill — навыка Claude Code, который делегирует задачи по кодированию более дешевым моделям (Mistral или DeepSeek), используя Claude для планирования и проверки. За 10 дней и 254 запуска было сэкономлено 57 миллионов токенов, затраты снизились на 90-100% при сохранении качества вывода Claude.
Как это работает
Vibe-skill работает внутри Claude Code. Вы вводите /vibeon <что-угодно>, Claude разбивает задачу и делегирует само кодирование легковесной модели (через инструмент с открытым исходным кодом Vibe). Затем Claude проверяет diff и исправляет ошибки. Дешевая модель выполняет основную работу; Claude тратит токены только на планирование и проверку.
Результаты по моделям
| Модель | Токенов делегировано | Фактическая стоимость | Эквивалент Claude | Экономия |
|---|---|---|---|---|
| DeepSeek V4 Flash | 29M | $4.13 | $92.16 | 95% |
| Mistral Medium 3.5 | 28M | $0 (Pro подписка) | $84.77 | 100% |
Общий показатель успеха: 98% из 254 запусков. Когда делегирование не удается, Claude замечает и исправляет результат.
Экономика токенов
Токены Mistral примерно на 50% дешевле токенов Claude; токены DeepSeek — на 95% дешевле. Автор использует подписку Mistral Pro ($18.36/мес), которая включает около 1 миллиарда бесплатных токенов. Для подписчиков Mistral Pro делегирование стоит $0 до исчерпания квоты, после чего автоматически переключается на DeepSeek (поскольку PAYG Mistral по $1.52/M токенов в 10 раз дороже DeepSeek).
Точка безубыточности: DeepSeek отдельно дешевле подписки Mistral Pro, если вы делегируете менее 131M токенов в месяц ($18.36 / $0.14 за M). При большем объеме Mistral Pro выигрывает с примерно 10-кратным запасом до исчерпания квоты.
Настройка
Навык имеет открытый исходный код по адресу github.com/pcx-wave/vibe-skill. Также доступен аналогичный навык для Gemini, но он менее настраиваемый и с перебоями. Чтобы использовать, клонируйте репозиторий и загрузите навык в Claude Code — затем просто /vibeon вашу задачу.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

NexQuant: Rust-нативный 3-битный движок KV-кэша для развертывания на периферийных устройствах
NexQuant — это готовый к промышленному использованию движок на Rust, который позволяет запускать модели с большим контекстом на потребительском оборудовании с сокращением использования памяти в 3–5 раз. Поддерживает бэкенды Metal, CUDA, Vulkan и CPU.

Переработанная реализация кода Claude с открытым исходным кодом, адаптированная для совместимости с локальными моделями.
Разработчик исправил реализацию открытого кода Claude Code для работы с Ollama и локальными моделями, удалив жёсткие зависимости от клиента Anthropic. Теперь CLI автоматически определяет провайдеров по именам моделей и переменным окружения.

Управление задачами нескольких ИИ-агентов с помощью канбан-досок
Разработчик делится опытом запуска нескольких агентов Claude AI в терминальных вкладках и выделяет три ключевые проблемы рабочего процесса: отсутствие видимости прогресса, потеря контекста при переключении между задачами и прерывания из-за лимитов запросов. Их решение предполагает рассматривать задачи ИИ как рабочие элементы на канбан-доске.

Equibles: Самостоятельно размещаемый MCP-сервер для финансовых данных США – отчеты SEC, 13F, инсайдерские сделки, FRED
Equibles — это сервер MCP с открытым исходным кодом, который собирает публичные финансовые данные США (документы SEC, 13F, сделки инсайдеров и конгрессменов, данные по коротким позициям, FRED) и предоставляет их в виде инструментов MCP для любого локального LLM-агента.