Claude Code теперь поддерживает 240+ моделей через шлюз NVIDIA NIM, включая Nemotron-3 120B для агентного кодирования

Пользователи Claude Code обнаружили, что встроенная команда /model выводит не только стандартные модели Claude (Opus, Sonnet, Haiku), но и полный раздел NVIDIA NIM gateway с более чем 239 дополнительными моделями, которые можно переключать во время сеанса.
Доступные ключевые модели
nvidia/nemotron-3-super-120b-a12b(с режимом мышления и без)01-ai/yi-largeabacusai/dracarys-llama-3.1-70b-instruct- Сотни других в списке NIM
Nemotron-3 120B для агентного программирования
Вариант Nemotron с мышлением был протестирован для рефакторинга нескольких файлов и, как сообщается, сначала обдумывает изменения, прежде чем касаться кода — идеально для агентных задач. Задержка выше, чем у Claude, но это может сэкономить кредиты Claude на длительных сеансах.
Как использовать
- Откройте любой сеанс Claude Code
- Выполните
/model - Прокрутите мимо первых четырех вариантов Claude — модели NIM появятся ниже
- Нажмите
d, чтобы установить одну из них как модель по умолчанию для сеанса, или передайте--model nvidia/nemotron-3-super-120b-a12bпри запуске
Если вы тратите много кредитов Opus на длительных сеансах, стоит попробовать это — особенно для генерации кода на Python или Rust.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Galadriel: Открытый инструмент для поддержания "теплого" кэша для постоянных агентов Claude
Galadriel — это 3-уровневая система кэширования для Claude, которая снижает затраты на 87% и задержку до менее 3 секунд для подсказок из 100K токенов. Включает MemPalace для постоянной векторной памяти.

Замена Kafka, Redis и RabbitMQ на NATS: опыт разработчика
Разработчик заменил Kafka, Redis и RabbitMQ на NATS в своей архитектуре, поделившись конкретными деталями реализации и извлечёнными уроками от консолидации нескольких систем обмена сообщениями в один инструмент.

Deblank: Инструмент для Удаления Форматирования Кода с Целью Сокращения Токенов для LLM
Deblank — это инструмент с открытым исходным кодом, который удаляет форматирование кода (отступы, пробелы, переносы строк) перед отправкой в LLM, сокращая количество токенов примерно на 30% для Java/C++ и на 9% для Python с задержкой около 76 мс. Поддерживает Python, Java, C/C++, C#, JS/TS и Go.

Пользовательская строка состояния для Claude Code отображает использование контекста, стоимость и ветку Git
Пользователь Reddit создал bash-скрипт, который использует настройку statusLine в Claude Code для отображения информации в реальном времени, включая использование контекстного окна, стоимость сессии, активную модель и текущую ветку git. Для работы скрипта требуется jq, и он доступен на GitHub.