Desenvolvedor compartilha fluxo de trabalho híbrido de codificação com IA: Claude para planejamento, modelos locais para execução

Fluxo de trabalho híbrido de IA para codificação reduz custos na nuvem
Um desenvolvedor no r/LocalLLaMA compartilhou um fluxo de trabalho detalhado que combina modelos de IA na nuvem e locais para reduzir custos de tokens mantendo a qualidade da codificação. A abordagem aborda a percepção de que muitas tarefas de codificação não exigem modelos caros na nuvem.
A arquitetura do fluxo de trabalho
O sistema segue a lógica "Raciocine na nuvem, Execute localmente":
- Planejador (Claude 3.5 Sonnet): Recebe a tarefa e gera um arquivo
task_context.mdpreciso contendo instruções, caminhos de arquivos e lógica. Isso custa aproximadamente 300-500 tokens. - Codificador (Qwen2.5-Coder 30B local via Ollama): Recebe a especificação e o conteúdo real do arquivo para escrever o código. Isso é executado localmente sem custo.
- Validador: Um script Bash simples executa
tsc --noEmitoumypypara verificação de tipos. - Revisor (Qwen2.5-Coder 7B local): Executa em paralelo para verificar falhas lógicas óbvias.
- Correção automática: Se a compilação falhar, o log de erro retorna ao codificador local para 2-3 iterações.
Detalhes de implementação
Todo o pipeline é encapsulado em um conjunto de scripts Bash usando apenas jq e curl para comunicação com a API do Ollama. O sistema detecta automaticamente padrões de linguagem (TypeScript, Python, C++, etc.) com base na saída do planejador e não requer ambientes pesados de Python/Node.
O desenvolvedor observa que modelos locais (mesmo os de 30B) frequentemente falham em raciocínio arquitetural complexo, mas são surpreendentemente bons em execução quando recebem especificações extremamente claras.
Resultados e economia
Em um projeto TypeScript recente envolvendo 12 arquivos alterados:
- O uso do Claude foi limitado apenas à fase inicial de planejamento
- Os modelos locais lidaram com todo o resto: escrita de 12 arquivos, linting e revisão
- Economia total: aproximadamente 85% de redução de tokens em comparação com fazer tudo dentro do Claude Code CLI
O desenvolvedor disponibilizou os scripts em um repositório chamado ai-orchestrator no GitHub (nome de usuário: Mybono) para quem se interessar pelos detalhes de implementação.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Alerta de Modelo Grátis: Tencent Hy3 Disponível no OpenRouter por 2 Semanas — Experimente Agora
O Tencent Hy3 está gratuito no OpenRouter por 2 semanas. Use-o no OpenClaw via openrouter/tencent/hy3:free. Detalhes completos do r/openclaw.

Plugin Aprimorado do Claude Code para Telegram Adiciona Voz, Figurinhas e Tópicos
Um desenvolvedor lançou um fork do plugin oficial do Claude Code para Telegram que adiciona transcrição de mensagens de voz via Whisper, suporte a adesivos/GIFs, encadeamento de conversas e reações com emojis. É uma substituição direta que requer apenas clonar, copiar um arquivo e reiniciar.

Máquina Virtual Lógica: Um Sistema Baseado em Prompt para Interromper Colapsos de Raciocínio em LLMs
Um pesquisador desenvolveu um prompt de Máquina Virtual Lógica (LVM) que força os LLMs a parar e relatar modos de colapso específicos quando encontram paradoxos ou desvios de raciocínio, baseado em uma única lei de estabilidade: K(σ) ⇒ K(β(σ)). O prompt é independente de substrato e funciona em modelos como Grok e Claude.

Aplicativo Claude Desktop Adiciona Recurso de Projetos à Interface de Colaboração
O aplicativo de desktop do Claude agora inclui um recurso de Projetos no Cowork, permitindo que os usuários organizem tarefas e contexto em espaços de trabalho dedicados. Os arquivos e instruções permanecem no computador local do usuário, com opções para importar projetos existentes ou iniciar novos.