Аудит логов API показывает, что AI-агенты тратят токены впустую из-за раздувания контекстного окна

Разработчик на r/ClaudeAI проаудировал свои логи Anthropic API после того, как заметил взлетевший счет, и обнаружил ключевую неэффективность: ИИ-агенты не теряют рассудок — они задыхаются в собственном окне контекста. В посте описывается, как агенты в репозиториях размером более 10 000 строк тратят токены на слепое исследование, загрузку необработанных файлов и многословные выводы инструментов, что приводит к архитектурной лапше после 20+ шагов.
Ключевые выводы из аудита логов API
- Слепое исследование: Агенты рекурсивно выполняют
grepи читают ~40 файлов, чтобы найти одну функцию. Вместо поиска существующего UI-компонента они часто галлюцинируют дубликат с нуля. - Загрузка целиком: Агент может прочитать файл на 2000 строк, чтобы обновить интерфейс из 5 строк, тратя токены впустую.
- Поток shell и инструментов: Многословные логи тестов и раздутые определения MCP-инструментов потребляют ~30 000 токенов до того, как агент напишет хоть строчку кода.
- Память как у золотой рыбки: Каждая сессия заново читает те же файлы из-за отсутствия памяти о проекте — как в "Дне сурка".
Когда окно контекста заполняется этим шумом до ~80%, качество рассуждений агента заметно падает, и начинается архитектурная деградация. Стандартные RAG или сжатие вывода не устраняют коренную причину: у агента нет структурного понимания кодовой базы, пока он не сожжет токены на чтение сырого текста.
Практические последствия
Разработчики сталкиваются с парадоксом производительности: экономия часа на наборе текста оборачивается пятью часами исправления ИИ-спагетти-кода. В посте ставится вопрос о необходимости принципиально новой архитектуры агента, которая понимает код как граф до того, как тратить токены на сырой текст.
Для кого это
Инженеры, использующие ИИ-агентов для кодинга на больших кодовых базах, которые хотят понять скрытые потери токенов и повысить эффективность затрат.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Разработка LibreOffice Online возобновляется после голосования сообщества.
Фонд Document Foundation возобновил работу над LibreOffice Online после того, как голосование сообщества отменило заморозку 2022 года. TDF вновь откроет репозиторий для внесения вкладов, но не будет размещать серверы — вместо этого предоставит инструменты для самостоятельного размещения.

Delve обвиняют в форке открытого исходного кода SimStudio от Sim.ai и продаже его под названием Pathways.
Стартап по комплаенсу Delve, как утверждается, форкнул инструмент с открытым исходным кодом Sim.ai для создания агентов SimStudio, переименовал его в Pathways и продавал без надлежащего указания лицензии или денежного соглашения с Sim.ai, что потенциально нарушает условия лицензии Apache.
Пакет Nvidia на 500 млрд долларов для ИИ-инфраструктуры на Уолл-стрит: что это значит
Nvidia работает с группой финансовых компаний над пакетом финансирования ИИ-инфраструктуры на сумму 500 млрд долларов. Сделка поднимает вопросы о циклическом финансировании и о том, кто понесет риски, если спрос не оправдается.

OpenAI Codex OAuth возвращает ошибки 429 с 16 марта, несмотря на полную квоту.
OpenAI Codex OAuth постоянно возвращает ошибки 429 "вы превысили текущую квоту" с 16 марта, даже когда дашборды показывают 100% доступной квоты. Пользователи сообщают, что проблема сохраняется, несмотря на повторную аутентификацию, отзыв токенов и полную переконфигурацию.