Opus 4.6 Средний против Низкого: Различия в производительности и ценообразовании

Анализ конфигураций модели Opus 4.6 выявляет значительные различия между версиями low и medium как в производительности, так и в стоимости.
Ключевые выводы из анализа Reddit
Исходный материал подчеркивает несколько конкретных проблем с Opus 4.6 (low):
- Opus 4.6 (low) демонстрирует "подлинно ленивое" поведение, которое может быть проблематичным, когда процесс важнее конечных результатов
- В одном задокументированном случае, когда модель попросили исследовать исторические данные об атаках США на Иран, маломощный агент решил полагаться на внутренние знания вместо выполнения поиска в Google, из-за чего пропустил недавние события
- Версия medium не имеет этой проблемы с ленью
Сравнение производительности и цены
- Opus 4.6 (medium) стоит примерно на 50% дороже, чем Opus 4.6 (low)
- По производительности версия medium занимает почти точно промежуточное положение между 4.6 low и 4.6 high
- Полный отчет о 26 конфигурациях моделей, протестированных на границах Парето по вычислительным ресурсам, доступен на everyrow.io
Для разработчиков, использующих ИИ-агентов для программирования, эта информация актуальна при выборе между конфигурациями моделей на основе бюджетных ограничений и требований к производительности.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Анализ негативного отношения к ИИ и эффекта «зловещей долины»
Недавние опросы показывают растущий общественный скептицизм в отношении ИИ: в марте 2026 года 55% американцев считали, что ИИ принесёт больше вреда, чем пользы в повседневной жизни. В статье исследуется, как ИИ вызывает реакции «зловещей долины» через несоответствие социальным ожиданиям.

Посмертный анализ Claude Code: три ошибки привели к ухудшению качества, теперь исправлены
Anthropic объяснил три отдельные проблемы, вызвавшие жалобы на качество Claude Code: пониженный уровень рассуждений по умолчанию, ошибка кэширования, приводящая к потере памяти сессии, и подсказка о краткости, ухудшившая качество кода. Все исправлено по состоянию на 20 апреля (v2.1.116).

Анализ Claude Opus 4.7: Высокий интеллект, но большая стоимость и многословность
Claude Opus 4.7 (Адаптивное рассуждение, Максимальные усилия) занимает первое место по интеллекту среди 133 моделей с оценкой 57 по Индексу интеллекта Artificial Analysis, но стоит $5 за 1 млн входных токенов и $25 за 1 млн выходных токенов, что делает его значительно дороже среднего.

Claude Code: Автоматический режим станет режимом разрешений по умолчанию 14 августа
Anthropic делает автоматический режим режимом разрешений по умолчанию в Claude Code для пользователей Pro, Max и Team с 14 августа. Классификатор в автоматическом режиме выявил 89% опасных команд в тестах, тогда как при ручном подтверждении — 14%.