free-claude-code adiciona suporte GLM-5 via NVIDIA NIM e se expande para OpenRouter e Discord

O free-claude-code, um proxy leve que converte as requisições da API Anthropic do Claude Code para formatos de outros provedores, foi atualizado com suporte ao GLM-5 através do NVIDIA NIM e vários novos recursos. A ferramenta permite que desenvolvedores utilizem a interface de codificação agentiva do Claude Code sem uma assinatura da Anthropic, roteando as requisições para backends alternativos.
Principais atualizações
A NVIDIA adicionou correções de chamada de ferramentas para z-ai/glm5 ao seu inventário NIM, e o free-claude-code agora oferece suporte completo. O nível gratuito do NVIDIA NIM fornece 40 requisições por minuto sem necessidade de cartão de crédito.
- Suporte ao OpenRouter: Use qualquer modelo na plataforma do OpenRouter como seu backend, incluindo seus modelos gratuitos
- Integração com bot do Discord: Controle o Claude Code remotamente via Discord além do suporte existente ao bot do Telegram
- Suporte ao provedor local LMStudio: Execute modelos totalmente localmente
- Suporte à extensão VSCode do Claude Code
Vantagens técnicas
- Opções sem custo: O nível gratuito do NVIDIA NIM (40 reqs/min) e os modelos gratuitos do Open Router não exigem pagamento
- Preservação de pensamento intercalado: Tokens nativos de pensamento intercalado são preservados entre turnos, permitindo que modelos como GLM-5 e Kimi-K2.5 aproveitem o raciocínio de turnos anteriores
- 5 otimizações integradas: Detecção rápida de prefixo, pular geração de título, pular modo de sugestão e outras otimizações reduzem chamadas desnecessárias de LLM
- Controle remoto: Bots do Telegram e Discord permitem enviar tarefas de codificação de dispositivos móveis com bifurcação e persistência de sessão
- Limitador de taxa configurável: Limitação de taxa de janela deslizante para sessões concorrentes
- Suporte fácil a modelos: Novos modelos lançados no NVIDIA NIM podem ser usados sem alterações de código
- Extensibilidade: Estrutura de código modular facilita a adição de provedores personalizados ou plataformas de mensagens
Modelos suportados
Modelos populares incluem z-ai/glm5, moonshotai/kimi-k2.5, minimaxai/minimax-m2.5, qwen/qwen3.5-397b-a17b e stepfun-ai/step-3.5-flash. A lista completa está disponível em nvidia_nim_models.json. Com OpenRouter e LMStudio, virtualmente qualquer modelo pode ser usado como backend.
O desenvolvedor está atualmente trabalhando na seleção automática de modelos baseada em disponibilidade e qualidade. O projeto é de código aberto com issues e PRs bem-vindos.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Painel de Controle SwarmClaw Adiciona Camada de Orquestração ao OpenClaw
SwarmClaw é um painel auto-hospedado que envolve o OpenClaw, fornecendo implantação e gerenciamento de múltiplas instâncias com controles de gateway, reparo de configuração, sincronização de histórico remoto e aprovação de execução em tempo real. Ele suporta plugins do OpenClaw e arquivos SKILL.md, além de se conectar a outros 14 provedores de IA.

Extraí a memória markdown padrão do OpenClaw e construí uma camada de API Node.js/Postgres em vez disso
Um desenvolvedor desativou o plugin de memória principal do OpenClaw e construiu um backend tipado com Node.js/Express + PostgreSQL. O desvio de contexto caiu a zero.

YourMemory: Memória de IA com decaimento biológico atinge 59% de recall no LoCoMo-10
YourMemory fornece memória persistente para agentes de IA usando a curva de esquecimento de Ebbinghaus e recuperação aprimorada por grafo. Avaliado com 59% Recall@5 no LoCoMo-10, 2× melhor que o Zep Cloud.

Análise do Conselho LLM Revela Estratégias Práticas de Otimização de Tokens de Código Claude
Um desenvolvedor usou a ferramenta LLM Council com 5 personas para analisar padrões de uso do Claude Code, identificando que o modo de pensamento estendido por padrão era o maior consumidor de tokens. O playbook resultante alcançou redução de 60-70% nos tokens com mesma ou melhor qualidade de saída.