Deblank: Инструмент для Удаления Форматирования Кода с Целью Сокращения Токенов для LLM

Что делает Deblank
Deblank — это инструмент предварительной обработки, который удаляет форматирование кода (отступы, пробелы, переносы строк) перед отправкой кода в LLM, с последующим шагом восстановления читаемости. Преобразование является двунаправленным и безопасным для AST.
Результаты производительности
В оценках на нескольких моделях (DeepSeek-V3, Claude, Gemini и др.):
- Сокращение токенов примерно на 30% для языков вроде Java и C++
- Сокращение токенов примерно на 9% для Python
- Незначительное влияние на точность Pass@1 для завершения кода
- Средняя задержка: около 76 мс
Поддерживаемые языки и функции
- Python, Java, C/C++, C#, JavaScript/TypeScript и Go
- Достаточно хорошо обрабатывает неполные фрагменты кода
- Полезен для рабочих процессов fill-in-the-middle
Начало работы
Проект имеет открытый исходный код со следующими ресурсами:
- GitHub: https://github.com/anpl-code/Deblank
- Статья: https://arxiv.org/abs/2508.13666
- Docker:
docker pull zhangcen456/deblank:latest
Такой тип оптимизации токенов может быть особенно полезен при работе с LLM с ограниченным контекстом или при обработке больших кодовых баз, хотя влияние варьируется в зависимости от языка из-за различий в соглашениях о форматировании.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

MCP Slim: Локальный поиск по эмбеддингам для инструментов MCP сокращает раздувание контекста
MCP Slim — это прокси, который заменяет полные каталоги инструментов MCP тремя мета-инструментами (поиск, описание, вызов), используя локальные эмбеддинги MiniLM для семантического поиска. Он достигает 96% сокращения контекстного окна и работает офлайн без API-ключей.

Инструмент Squeez сжимает вывод bash на 90%+, расширяя контекстное окно кода Claude.
Squeez — это хук, который автоматически сжимает необработанный вывод bash, такой как ps aux, docker logs и git log, до того, как он достигнет Claude Code. Он сокращает использование токенов в среднем на 92,8% для 19 распространённых команд, помогая сессиям длиться дольше.
Strata: семантический слой, который отклоняет неверные запросы до того, как их выполнит ваша LLM
Strata — это полноценный семантический слой, созданный бывшим инженером Netflix, который проверяет и отклоняет семантически некорректные запросы до их выполнения, с маршрутизацией с учётом партиций по ClickHouse, Druid, Snowflake и Athena.

LivingAgents.ai: Веб-симуляция ИИ-агентов на основе Claude API
LivingAgents.ai — это веб-симуляция, в которой каждый агент работает на основе API Claude, выполняя действия, такие как поиск ресурсов, торговля, создание предметов, атаки, размножение и постоянная смерть, причём каждое действие требует реального вызова LLM.