Código aberto local alterna automaticamente entre modelos Claude para reduzir custos de IA

Um desenvolvedor disponibilizou como código aberto um hook local que seleciona automaticamente o modelo Claude AI mais econômico com base no tipo de tarefa de programação, potencialmente reduzindo os custos de IA em 50-70% sem perda de qualidade.
Como funciona
A ferramenta funciona como um hook local no Cursor e Claude Code (ambos usam o mesmo sistema de hooks) antes de cada prompt ser enviado. Ela fica ao lado do Opus/plano e atua como um filtro de front-end eficiente que evita correspondências de modelo obviamente ruins antes que atinjam modelos caros.
Funcionalidades principais
- Lê o prompt e a seleção atual do modelo
- Usa regras simples de palavras-chave para classificar tarefas (operações git, trabalho de funcionalidades, arquitetura/análise profunda)
- Bloqueia se você está pagando demais (ex: Opus para commit git) e sugere Haiku ou Sonnet
- Bloqueia se você está com poder insuficiente (Sonnet/Haiku para arquitetura) e sugere Opus
- Deixa todo o resto passar inalterado
- O prefixo ! ignora completamente o filtro se você discordar de sua sugestão
Detalhes técnicos
- 3 arquivos: bash + python3 + JSON
- Sem proxy, sem chamadas de API, sem serviços externos
- Design fail-open: se travar, o Claude Code prossegue normalmente
- Código aberto em: https://github.com/coyvalyss1/model-matchmaker
Desempenho e testes
O desenvolvedor analisou várias semanas de seus próprios prompts e descobriu:
- 60-70% eram trabalhos de funcionalidades padrão que o Sonnet poderia lidar
- 5-20% eram depuração/solução de problemas
- Uma parte significativa eram tarefas puras de git/renomear/formatação que o Haiku lida de forma idêntica com 90% menos custo
A análise retrospectiva mostrou que a ferramenta teria cortado 50-70% dos gastos com IA sem queda na qualidade. Após ajustes, ela lidou corretamente com 12/12 prompts de teste reais.
Problema que resolve
A questão não é conhecimento — os desenvolvedores sabem que deveriam trocar de modelos — mas atrito. Quando em estado de fluxo, os desenvolvedores não querem pensar em menus suspensos. Esta ferramenta automatiza o processo de tomada de decisão.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Fluxo de trabalho de codificação autônoma envia 163 mil linhas durante a noite usando Claude Code
Um desenvolvedor criou um fluxo de trabalho autônomo que completou 72 tarefas durante a noite, gerando 163.643 linhas de código e mais de 6.400 testes aprovados com uma taxa de sucesso de 85% na primeira tentativa.

Caddie: Alternativa ao OpenClaw Baseada no Slack Será Lançada na Próxima Semana
Caddie é uma versão baseada no Slack do OpenClaw que não requer instalação local ou configuração MCP. Os usuários autorizam através do Slack App Directory em 60 segundos, depois digitam comandos para automatizar tarefas no Gmail, LinkedIn, CRM, calendário e mais de 100 outras ferramentas.

Models.dev: Banco de Dados Open-Source de Especificações, Preços e Capacidades de Modelos de IA
Models.dev é um banco de dados open-source, contribuído pela comunidade, com especificações, preços e capacidades de modelos de IA. Oferece uma API e definições baseadas em TOML para provedores e modelos.

Intuno: Rede de Código Aberto para Descoberta e Comunicação de Agentes de IA
Intuno é uma rede de código aberto onde agentes de IA registram capacidades, descobrem uns aos outros por meio de busca semântica e invocam funções com 3 linhas de código Python. Inclui integração MCP para uso com Claude Desktop ou Cursor.