Анализ Claude Opus 4.7: Высокий интеллект, но большая стоимость и многословность

Анализ производительности Claude Opus 4.7
Artificial Analysis опубликовал подробные данные об интеллекте, производительности и ценах для Claude Opus 4.7 (Адаптивное рассуждение, Максимальные усилия). Эта проприетарная модель от Anthropic была выпущена в апреле 2026 года и поддерживает текстовый и графический ввод с текстовым выводом.
Ключевые показатели и рейтинги
- Интеллект: #1/133 моделей с оценкой 57 по Индексу интеллекта Artificial Analysis (среднее значение — 31)
- Скорость: #71/133 моделей со скоростью 50 выходных токенов в секунду (среднее значение — 61)
- Цена ввода: #116/133 моделей по $5.00 USD за 1 млн токенов (среднее значение — $1.40)
- Цена вывода: #117/133 моделей по $25.00 USD за 1 млн токенов (среднее значение — $8.40)
- Многословность: #96/133 моделей, генерируя 100 млн токенов во время оценки (среднее значение — 35 млн)
Технические характеристики
- Модель рассуждений (иконка лампочки указывает на способность к рассуждению)
- Контекстное окно в 1 миллион токенов (~1500 страниц A4 шрифтом Arial 12 размера)
- Предел знаний: 1 января 2026 года
- Стоимость оценки: $4406.45 для запуска по Индексу интеллекта
Контекст сравнения
Модель сравнивается с 133 моделями в её классе. Проприетарные модели, такие как Claude Opus 4.7, сравниваются по проприетарным и открытым моделям с тем же ценовым диапазоном, используя смешанное соотношение цен ввода/вывода 3:1. Индекс интеллекта Artificial Analysis v4.0 включает 10 оценок: GDPval-AA, τ²-Bench Telecom, Terminal-Bench Hard, SciCode, AA-LCR, AA-Omniscience, IFBench, Humanity's Last Exam, GPQA Diamond и CritPt.
Анализ приходит к выводу, что Claude Opus 4.7 является одной из ведущих моделей по интеллекту, но особенно дорогой по сравнению с другими моделями аналогичной цены. Она также медленнее среднего и очень многословна в своих выводах.
📖 Read the full source: HN AI Agents
👀 Смотрите также

61% людей теперь используют ИИ для поддержки психического здоровья — глобальное исследование AXA/Ipsos
Согласно докладу AXA/Ipsos 2026 Mind Health Report, 61% людей в 18 странах уже используют ИИ для вопросов психического здоровья; 28% сообщили, что рекомендации ИИ привели к вредоносному поведению.

Локальный Qwen3.6 27b + Hermes Agent справляется с задачами младшего IT-администратора
30-летний IT-ветеран сообщает, что Qwen3.6 27b, работающая в среде Hermes Agent, выполнила список задач для младшего IT-администратора за 1,5 часа — включая установку исправлений, установку Docker и настройку сервисов.

OpenClaw 2026.3.13 вызывает ложные отчеты о недоступности из-за регрессии.
В версии OpenClaw 2026.3.13 была обнаружена диагностическая регрессия, при которой команды статуса ошибочно сообщают о недоступных шлюзах, несмотря на корректную работу RPC-зондов. Возврат к версии 2026.3.12 решает проблему.

Bloomberg сообщает об ИИ-агентах для программирования и проблемах с производительностью в 2026 году.
Статья Bloomberg от февраля 2026 года рассказывает об ИИ-агентах для написания кода, таких как Claude Code, и сообщает о «панике производительности» в технологической индустрии. Статья набрала 44 балла и 14 комментариев на Hacker News.