Как отключить контекстное окно в 1 млн токенов в Claude Code для снижения расхода токенов

Пользователи Claude Code могут отключить функцию окна контекста в 1 млн токенов, которая может увеличивать использование токенов сверх ожидаемого. Согласно обсуждению на Reddit, недавнее ужесточение лимитов использования от Anthropic привело к более быстрому расходованию квот, и компания указывает на окно контекста в 1 млн токенов как на один из факторов.
Варианты настройки
В источнике предлагаются два способа управления поведением окна контекста:
Вариант 1: Полностью отключить контекст в 1 млн токенов
Добавьте это в ваш файл ~/.claude/settings.json:
{
"env": {
"CLAUDE_CODE_DISABLE_1M_CONTEXT": "1"
}
}Это полностью удаляет варианты модели с 1 млн токенов из выбора моделей. Данная конфигурация официально задокументирована в документации Claude Code в разделе "Настройка модели → Расширенный контекст".
Вариант 2: Ограничить окно контекста
Для большей гибкости вы можете ограничить автоматическое компактное окно:
{
"env": {
"CLAUDE_CODE_AUTO_COMPACT_WINDOW": "200000"
}
}Anthropic рекомендует этот подход в своём недавнем исследовательском посте. Примерное значение в 200 000 токенов устанавливает конкретное ограничение, сохраняя при этом некоторую возможность расширенного контекста.
В посте на Reddit отмечается, что это временные решения, и выражается сомнение в том, является ли окно контекста в 1 млн токенов полным объяснением увеличенного использования токенов. Пользователям, сталкивающимся с неожиданным расходованием квот, возможно, стоит протестировать эти настройки, чтобы увидеть, влияют ли они на их конкретные рабочие процессы.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Источники данных Claude: Когда запрашивать веб-поиск для получения актуальной информации
Claude иногда полагается на внутренние обучающие данные вместо выполнения веб-поиска, что может предоставлять устаревшую информацию. Пользователи могут специально запрашивать веб-поиск для получения более актуальных результатов.

Как нон-кодер создал переиспользуемый рабочий процесс на Claude для контент-маркетинга основателя
Бывший редактор журнала без опыта программирования рассказывает, как случайно создал повторяемый рабочий процесс с Claude для контент-маркетинга соло-основателя: выгрузить сырые мысли, затем переструктурировать с помощью Claude в форматы для конкретных платформ.

MTP уровень принятия: 50% порог определяет выгоду спекулятивного декодирования
MTP (Многотокеновое предсказание) через спекулятивное декодирование на Gemma-4 26B показывает выгоду только при уровне принятия черновиков токенов выше 50% — на основе тестов mlx-vlm на M4 Max Studio.

Сэкономьте на счетах за Claude Code, направив токены планирования на более дешевые модели
Пользователь сэкономил $40 на дополнительных сборах, разделив рабочие процессы Claude Code: этапы планирования отданы Haiku 3.5, а фактические правки и решения остаются на Opus/Sonnet. Обёртка из 30 строк обрабатывает маршрутизацию; настройка заняла ~2 часа.