Claude Code agora suporta mais de 240 modelos via gateway NVIDIA NIM — incluindo Nemotron-3 120B para codificação agêntica

Usuários do Claude Code descobriram que o comando /model integrado lista não apenas os modelos Claude padrão (Opus, Sonnet, Haiku), mas uma seção completa de gateway NVIDIA NIM com 239+ modelos adicionais que podem ser trocados no meio da sessão.
Principais modelos disponíveis
nvidia/nemotron-3-super-120b-a12b(com e sem modo de raciocínio)01-ai/yi-largeabacusai/dracarys-llama-3.1-70b-instruct- Centenas mais na lista NIM
Nemotron-3 120B para codificação de agente
A variante de raciocínio Nemotron foi testada para refatoração de múltiplos arquivos e, segundo relatos, raciocina sobre as alterações antes de tocar no código — ideal para tarefas de agente. A latência é maior que a do Claude, mas pode economizar créditos do Claude em sessões longas.
Como usar
- Abra qualquer sessão do Claude Code
- Execute
/model - Role além das primeiras quatro opções do Claude — os modelos NIM aparecem abaixo
- Pressione
dpara definir um como padrão da sessão, ou passe--model nvidia/nemotron-3-super-120b-a12bna inicialização
Se você está gastando muitos créditos Opus em sessões prolongadas, vale a pena experimentar — especialmente para geração de código Python ou Rust.
📖 Leia a fonte original: r/ClaudeAI
👀 See Also

Resultados Práticos de 11 Construções de Software Multiagente sem Scaffolding Programático
Análise de 11 construções autônomas de multiagentes mostra que a aplicação de escopo funciona mecanicamente (20/20 sucessos) não por meio de prompts (0/20), os custos de orquestração são dominados pela reingestão de memória (~95% do gasto de entrada), e a capacidade do modelo do trabalhador cria lacunas de produtividade de 9,8x.

Aplicativo Hyper iOS: Gravador de Voz com Transcrição em Tempo Real e Extração de Ações
Hyper é um aplicativo de gravação de voz para iOS que transcreve conversas em tempo real, fornece resumos e itens de ação, e permite consultas durante a conversa por meio de detecção de palavra de ativação. Foi projetado para reuniões não estruturadas como conversas individuais, bate-papos de café e reuniões rápidas.

Recuperação de código para agentes de IA: Por que embeddings vetoriais falham e gráficos LLM por arquivo vencem
Após um ano construindo um sistema de indexação de código, a equipe por trás do Bytebell descobriu que embeddings vetoriais em chunks de código e ASTs do Tree-sitter ambos ficaram aquém, enquanto resumos LLM por arquivo armazenados em um grafo Neo4j com busca semântica de texto completo melhoraram significativamente a precisão da recuperação.

Biblioteca de Registro de Código Aberto Artigo 12 para Conformidade com a Lei de IA da UE
Uma biblioteca TypeScript gratuita e de código aberto para aplicativos Node.js que utilizam o Vercel AI SDK, implementando os requisitos de registro do Artigo 12 com logs JSONL somente de acréscimo, encadeamento de hashes SHA-256 para detecção de adulteração e aplicação de retenção de 180 dias.