Разработчик делится гибридным рабочим процессом в AI-кодинге: Claude для планирования, локальные модели для выполнения.

✍️ OpenClawRadar📅 Опубликовано: 16 апреля 2026 г.🔗 Source
Разработчик делится гибридным рабочим процессом в AI-кодинге: Claude для планирования, локальные модели для выполнения.
Ad

Гибридный рабочий процесс ИИ-кодирования снижает облачные расходы

Разработчик на r/LocalLLaMA поделился подробным рабочим процессом, который сочетает облачные и локальные модели ИИ для снижения стоимости токенов при сохранении качества кода. Этот подход решает проблему осознания того, что многие задачи по кодированию не требуют дорогих облачных моделей.

Архитектура рабочего процесса

Система следует логике «Рассуждай в облаке, выполняй локально»:

  • Планировщик (Claude 3.5 Sonnet): Получает задачу и генерирует точный файл task_context.md, содержащий инструкции, пути к файлам и логику. Это стоит примерно 300–500 токенов.
  • Кодер (Локальный Qwen2.5-Coder 30B через Ollama): Принимает спецификацию и фактическое содержимое файла для написания кода. Работает локально с нулевой стоимостью.
  • Валидатор: Простой Bash-скрипт запускает tsc --noEmit или mypy для проверки типов.
  • Рецензент (Локальный Qwen2.5-Coder 7B): Работает параллельно, чтобы проверить на наличие очевидных логических ошибок.
  • Автоисправление: Если сборка не удалась, журнал ошибок возвращается локальному кодеру на 2–3 итерации.
Ad

Детали реализации

Весь конвейер обёрнут в набор Bash-скриптов, использующих только jq и curl для связи с API Ollama. Система автоматически определяет языковые стандарты (TypeScript, Python, C++ и т.д.) на основе вывода планировщика и не требует тяжёлых сред выполнения Python/Node.

Разработчик отмечает, что локальные модели (даже 30B) часто не справляются со сложными архитектурными рассуждениями, но удивительно хорошо выполняют задачи, когда им дают кристально ясные спецификации.

Результаты и экономия

В недавнем проекте на TypeScript с изменением 12 файлов:

  • Использование Claude было ограничено только начальной фазой планирования
  • Локальные модели обработали всё остальное: написание 12 файлов, линтинг и рецензирование
  • Общая экономия: примерно 85% сокращение токенов по сравнению с выполнением всего внутри Claude Code CLI

Разработчик сделал скрипты доступными в репозитории под названием ai-orchestrator на GitHub (имя пользователя: Mybono) для тех, кто интересуется деталями реализации.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

MTPLX: в 2,24 раза быстрее генерация токенов на Apple Silicon с использованием нативных MTP-головок
Инструменты

MTPLX: в 2,24 раза быстрее генерация токенов на Apple Silicon с использованием нативных MTP-головок

MTPLX достигает 63 ток/с на Qwen3.6-27B на M5 Max (с 28 ток/с) с использованием встроенных голов MTP, при точной температурной выборке и без внешнего драфтера.

OpenClawRadar
Расширение OpenClaw Claude обновлено для использования Agent SDK после изменений в системе биллинга Anthropic.
Инструменты

Расширение OpenClaw Claude обновлено для использования Agent SDK после изменений в системе биллинга Anthropic.

Разработчик расширения OpenClaw переписал свою интеграцию с CLI Claude, чтобы использовать официальный claude-agent-sdk после того, как Anthropic начал обнаруживать и переклассифицировать использование CLI как использование стороннего приложения, которое списывается из отдельного пула кредитов, а не из лимитов плана Max. Подход с SDK аутентифицируется через существующий вход в Claude Code и списывается как обычное использование плана Max.

OpenClawRadar
Официальная поддержка Kotlin в VS Code теперь в альфа-версии — на основе языкового сервера IntelliJ
Инструменты

Официальная поддержка Kotlin в VS Code теперь в альфа-версии — на основе языкового сервера IntelliJ

JetBrains выпустил официальное расширение Kotlin для VS Code в Alpha, основанное на Kotlin Language Server, построенном на инфраструктуре анализа кода IntelliJ IDEA. Включает автодополнение, диагностику, навигацию, быстрые исправления, форматирование и импорт проектов.

OpenClawRadar
Протокол Pilot: Открытая Сетевая Стек P2P для Роев ИИ-Агентов
Инструменты

Протокол Pilot: Открытая Сетевая Стек P2P для Роев ИИ-Агентов

Pilot Protocol — это открытый стек оверлейных сетей уровня 3 и уровня 4, специально разработанный для коммуникации ИИ-агентов, обеспечивающий прямые зашифрованные UDP-туннели между агентами с постоянными 48-битными виртуальными адресами.

OpenClawRadar