Пещерный человек против подсказки "будь кратким": сравнение эффективности подсказок для сжатия в Клоде

Разработчик сравнил «пещерный» стиль (популярный сокращающий запрос) с простым запросом «будь краток.», чтобы выяснить, оправдывает ли себя дополнительная сложность. Тест включал 24 запроса по 6 категориям, сравнивая 5 вариантов: базовый, «будь краток.», пещерный лайт, пещерный полный и пещерный ультра. Выводы оценивались отдельным экземпляром Claude по рубрикам для каждого запроса.
Результаты бенчмарка
- Базовый: средний балл 0.985, среднее количество токенов 636
- «будь краток.»: средний балл 0.985, среднее количество токенов 419
- Пещерный лайт: средний балл 0.976, среднее количество токенов 401
- Пещерный полный: средний балл 0.975, среднее количество токенов 404
- Пещерный ультра: средний балл 0.970, среднее количество токенов 449
Двухсловная версия сравнялась с пещерным стилем как по сжатию, так и по качеству. Однако ценность пещерного стиля в другом: стабильная структура вывода, переключение режимов и защита от разрушительных операций. Защита, правда, внесла значительную вариативность в качество вывода, что может быть проблемой для некоторых случаев использования.
Полная разбивка с данными по категориям и выводами о вариативности по вопросам безопасности доступна на сайте автора. Инструмент бенчмаркинга с открытым исходным кодом на GitHub.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также
Как работает водяной знак текста в Claude
Будущий метод водяных знаков Claude использует ключ и предыдущие слова для изменения случайных выборов без ущерба для качества вывода. Он разработан для соответствия закону ЕС об ИИ.

Изменения биллинга Claude Agent SDK с 15 июня: кредиты на пользователя, без переноса, жесткий дедлайн
Начиная с 15 июня использование Claude Agent SDK и claude -p перестает учитываться в рамках лимитов подписки Claude. Каждый пользователь получает отдельный ежемесячный кредит (например, Pro $20, Max 5x $100). Кредиты не объединяются, не переносятся и имеют жесткое ограничение.

Бенчмарки производительности Qwen3.5-27B-FP8 с агентами OpenClaw.
Тестирование показывает, что Qwen3.5-27B-FP8 может одновременно запускать шесть агентов OpenClaw с пропускной способностью до 120 токенов в секунду. Фреймворк SGLang с кэшированием префиксов сокращает время предзаполнения контекста в 100K с 10 секунд до 200 мс.

Выпуск Claude Code 2.1.83: Кэширование промптов, проверка навыков и обновления SDK
Claude Code 2.1.83 добавляет кэширование промптов с руководством по проектированию, заменяет навык специалиста по верификации на новый навык Verify и обновляет ссылки на SDK для семи языков, включая поддержку бета-инструмента запуска для PHP.