Roteie o Claude Code pelo Ollama e Corte Sua Conta em ~90%

Este repositório, criado por Coherence Daddy, fornece uma configuração completa para rotear sessões do terminal do Claude Code através de uma instância local do Ollama, mantendo o Claude Desktop no plano Pro pago da Anthropic. O resultado: uma redução alegada de ~90% nos custos da API do Claude Code.
Como Funciona
Você executa dois mecanismos lado a lado:
- Claude Desktop (Anthropic) – usado para estratégia, arquitetura, revisão de código e bugs complexos.
- Claude Code → Ollama – usado para lints, refatorações, edições repetitivas, operações em lote de arquivos e tarefas de grep-and-replace. Roda em um modelo gratuito de código aberto (Gemma, Qwen, DeepSeek, à sua escolha).
Processo de Configuração
O repositório inclui uma apresentação HTML autossuficiente (21 slides) com um prompt copiável que faz ~98% da configuração automaticamente. Ele detecta automaticamente seu sistema operacional (macOS, Windows + WSL2, Linux), instala tudo, configura o roteador e verifica ambos os mecanismos ao final.
Para executar localmente:
git clone https://github.com/Coherence-Daddy/use-ollama-to-enhance-claude.git
cd use-ollama-to-enhance-claude/presentation
open index.html # macOS, ou arraste para o navegadorOu use diretamente o prompt copiável de prompts/copy-paste-prompt.md.
Estrutura do Repositório
prompts/copy-paste-prompt.md– o prompt de configuração.presentation/index.html– apresentação visual completa (sem necessidade de build).- Também hospedado em coherencedaddy.com/tutorials/use-ollama-to-enhance-claude.
Por Que Isso Existe
O Claude Pro no desktop é ótimo para pensar e arquitetar, mas o Claude Code no terminal consome rapidamente a cota em tarefas com muito contexto. Roteando essas tarefas através do Ollama (modelos gratuitos locais ou hospedados na nuvem) mantém a mesma experiência do usuário, mas por uma fração do custo.
Licença
MIT – livre para usar, bifurcar ou remixar.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Guia prático de configuração e instalação para o agente de IA auto-hospedado OpenClaw
OpenClaw é um agente de IA auto-hospedado que se integra a aplicativos de mensagens e mantém memória persistente através de um sistema baseado em arquivos. Recomendações importantes de configuração incluem começar com a interface de terminal, conectar apenas um canal de mensagens inicialmente e configurar adequadamente o arquivo SOUL.md para personalidade e regras de segurança.

Como a Memória do OpenCLAW Realmente Funciona: Corrigindo o 'Esquecimento' do Agente
Os agentes OpenCLAW não possuem memória persistente entre conversas - eles reconstroem o contexto a partir de arquivos como SOUL.md, USER.md e MEMORY.md a cada vez. Problemas comuns de 'esquecimento' surgem de sessões antigas, arquivos de memória desestruturados e armazenamento de informações importantes no histórico de chat em vez de arquivos permanentes.

Princípios de escrita de habilidades para Claude Code a partir de 159 habilidades de código aberto
Um desenvolvedor compartilha 10 princípios para escrever habilidades eficazes para o Claude Code, baseados na construção e manutenção de um registro de código aberto com 159 habilidades. Os princípios incluem abordagens práticas como usar pastas em vez de arquivos únicos, adicionar seções de armadilhas e implementar ganchos sob demanda.

Executando OmniCoder-9B localmente com detalhes de configuração do llama.cpp
Um desenvolvedor alcançou uma pontuação média de 96,7% no HumanEval com o OmniCoder-9B em hardware de médio porte usando flags específicas do llama.cpp, incluindo --reasoning-budget 0 para desativar a saída de chain-of-thought. A configuração utilizou um modelo quantizado Q6_K rodando em uma RTX 3080 com 10GB de VRAM.