Журналы сессий агента кодирования хранятся локально, что может обеспечить открытое федеративное обучение.

✍️ OpenClawRadar📅 Опубликовано: 25 февраля 2026 г.🔗 Source
Журналы сессий агента кодирования хранятся локально, что может обеспечить открытое федеративное обучение.
Ad

Когда вы используете кодирующих агентов, таких как Claude Code или Codex CLI, в режиме агента, они записывают подробные данные сессий локально на вашем компьютере. Эти журналы фиксируют полный цикл взаимодействия: вашу первоначальную задачу, процесс рассуждения модели, каждый сделанный вызов инструмента, каждый ответ среды, каждую встреченную ошибку и каждую попытку повтора. Это создаёт полные кортежи (состояние → действие → вознаграждение → следующее состояние) — точный формат данных, необходимый исследователям обучения с подкреплением.

Что находится в журналах

Автор источника проверил свои собственные машины и обнаружил:

  • Mac Mini: ~/.claude/projects/ содержащий 3.1 ГБ в 1103 файлах из 574 агентских сессий
  • MacBook: ~/.codex/sessions/ содержащий 2.4 ГБ в 3530 файлах из 79 агентских сессий
  • MacBook: ~/.claude/projects/ содержащий 652 МБ в 316 файлах из 99 агентских сессий

В общей сложности они идентифицировали 775 сессий с реальными вызовами инструментов, содержащих примерно 41 миллион токенов. Экстраполируя на тысячи разработчиков, это может представлять сотни миллиардов токенов реальных данных агентских траекторий — данных, для которых в настоящее время нет открытого аналога, такого как набор данных The Pile.

Почему эти данные важны

Среда предоставляет чёткие сигналы обратной связи: код выхода 0 или нет, тесты проходят или нет. Это даёт недостающий обучающий сигнал для причинно-следственных рассуждений, восстановления после ошибок и долгосрочного планирования — областей, в которых текущие модели испытывают трудности. Крупные AI-лаборатории уже собирают эти данные внутри для обучения своих проприетарных моделей, но открытого аналога нет, потому что данные фрагментированы на отдельных машинах разработчиков.

Ad

Предложение: Федеративное обучение

В посте предлагается использовать федеративное обучение, где ваши данные никогда не покидают вашу машину. Вы будете обучать небольшой адаптер LoRA локально, делиться только весами с добавленным дифференциально-приватным шумом и получать взамен улучшенную глобальную модель. Каждый вносит вклад в вычисления и сигнал, не раскрывая свои исходные данные. В качестве альтернативы сообщество могло бы анонимизировать данные, чтобы создать набор данных для тонкой настройки моделей.

Практические шаги

Чтобы сохранить ваши журналы (Claude Code удаляет их по умолчанию через 30 дней):

echo '{"cleanupPeriodDays": 36500}' > ~/.claude/settings.json

Чтобы проверить, что находится на ваших собственных машинах:

du -sh ~/.codex/sessions/ 2>/dev/null
du -sh ~/.claude/projects/ 2>/dev/null
find ~/.codex/sessions/ -name "*.jsonl" | wc -l
find ~/.claude/projects/ -name "*.jsonl" | wc -l

Пост на Reddit призывает разработчиков делиться своими цифрами в комментариях, чтобы оценить реальный масштаб неиспользуемых данных в сообществе, с целью создания открытого аналога, если будет достаточно интереса.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

Почему один разработчик оставляет теги AI-соавторов в коммитах
Новости

Почему один разработчик оставляет теги AI-соавторов в коммитах

Разработчик объясняет, почему он намеренно включает 'Co-Authored-by: Claude' в свои коммиты Git, сравнивая это с EXIF-данными в фотографии и обсуждая сложности хирургических изменений кода с помощью ИИ.

OpenClawRadar
Oracle запрещает ИИ-сгенерированный код в OpenJDK, несмотря на внутреннее использование LLM
Новости

Oracle запрещает ИИ-сгенерированный код в OpenJDK, несмотря на внутреннее использование LLM

Oracle запрещает ИИ-генерируемый код в OpenJDK, ссылаясь на риски безопасности и интеллектуальной собственности. Это противоречит заявлению Ларри Эллисона о том, что ИИ пишет код Oracle.

OpenClawRadar
Выпуск Claude Code 2.1.83: Кэширование промптов, проверка навыков и обновления SDK
Новости

Выпуск Claude Code 2.1.83: Кэширование промптов, проверка навыков и обновления SDK

Claude Code 2.1.83 добавляет кэширование промптов с руководством по проектированию, заменяет навык специалиста по верификации на новый навык Verify и обновляет ссылки на SDK для семи языков, включая поддержку бета-инструмента запуска для PHP.

OpenClawRadar
🦀
Новости

Исследовательское золото обещает «100% написанные человеком, никогда не ИИ» медицинские исследования — но его команда полностью состоит из ИИ

Сайт Research Gold рекламирует «100% написанные людьми, никогда ИИ» медицинские исследования, но его методологи с докторской степенью созданы ИИ, а личности реальных исследователей используются без разрешения. Телефонные звонки обслуживает ИИ-ассистент, который отрицает, что он ИИ.

OpenClawRadar