Выпущен Claude Opus 4.8: более быстрый и дешевый быстрый режим, динамические рабочие процессы и улучшения честности

✍️ OpenClawRadar📅 Опубликовано: 29 мая 2026 г.🔗 Source
Выпущен Claude Opus 4.8: более быстрый и дешевый быстрый режим, динамические рабочие процессы и улучшения честности
Ad

Компания Anthropic выпустила Claude Opus 4.8, обновив Opus 4.7 с улучшениями в бенчмарках по программированию, агентским навыкам, рассуждениям и работе со знаниями. Новая версия доступна по той же цене, что и предыдущая модель.

Ключевые особенности

  • Контроль усилий на claude.ai — пользователи теперь могут задавать, сколько усилий Claude вкладывает в задачу.
  • Динамические рабочие процессы в Claude Code — позволяют модели решать очень масштабные проблемы.
  • Быстрый режим работает со скоростью в 2,5 раза выше и теперь в три раза дешевле, чем быстрый режим для предыдущих моделей.

Основные результаты бенчмарков

Согласно заявлению, Claude Opus 4.8 — единственная модель, которая выполнила все кейсы от начала до конца в бенчмарке Super-Agent от Anthropic, превзойдя предыдущие модели Opus и GPT-5.5 при равной стоимости. В Online-Mind2Web (задачи компьютерного использования и браузерных агентов) модель набрала 84% — значительный скачок по сравнению с Opus 4.7 и GPT-5.5. В CursorBench она превосходит предыдущие модели Opus на всех уровнях усилий.

В бенчмарке Legal Agent Benchmark Opus 4.8 стала первой моделью, преодолевшей 10% по общему показателю all-pass. Ранние тестировщики также отметили повышение эффективности вызова инструментов (меньше шагов при той же интеллектуальности), точность цитирования и эффективность токенов в рабочих процессах извлечения.

Ad

Обучение честности

В Opus 4.8 внедрены явные улучшения честности — модель обучена избегать необоснованных утверждений и активно указывать на проблемы с входными/выходными данными. Это привело к более качественному анализу и лучшему соотношению сигнал/шум в оценках тестировщиков.

Ценообразование

Opus 4.8 доступен по той же цене, что и Opus 4.7. Цена быстрого режима в 3 раза ниже, чем в предыдущей версии. Стоимость мультимодальных токенов для Genie (агента Databricks) на 61% ниже, чем у Opus 4.7.

📖 Источник: HN AI Agents

Ad

👀 Смотрите также

Соучредитель Super Micro среди троих обвиняемых в деле об экспорте технологий ИИ.
Новости

Соучредитель Super Micro среди троих обвиняемых в деле об экспорте технологий ИИ.

Три человека, включая сооснователя Super Micro Computer Чарльза Лянга, обвинены властями США в планировании незаконного экспорта технологий искусственного интеллекта в Китай. Дело связано с предполагаемыми нарушениями законов об экспортном контроле.

OpenClawRadar
ChatGPT Workspace Agents: бесплатный предпросмотр завершается сегодня — сравнение с OpenClaw и Hermes
Новости

ChatGPT Workspace Agents: бесплатный предпросмотр завершается сегодня — сравнение с OpenClaw и Hermes

Бесплатная предварительная версия ChatGPT Workspace Agents от OpenAI завершается 6 мая, после чего будет введена кредитная система оплаты. В посте на Reddit проводится сравнение с OpenClaw, Hermes и управляемыми платформами, такими как BetterClaw, для командного и личного использования.

OpenClawRadar
Каннский фильм стоил $500 тыс. на производство, $400 тыс. из которых — затраты на AI-вычисления.
Новости

Каннский фильм стоил $500 тыс. на производство, $400 тыс. из которых — затраты на AI-вычисления.

Фильм, показанный в Каннах, стоил $500 тыс. на производство; $400 тыс. из них ушло на AI-вычисления. Яркий показатель для разработчиков AI-агентов, создающих генеративные видеопайплайны.

OpenClawRadar
Анализ кампании астротурфинга OpenClaw и накачки токена $CLAWD
Новости

Анализ кампании астротурфинга OpenClaw и накачки токена $CLAWD

Расследование на Reddit показало, что вирусный рост OpenClaw в конце января был обусловлен рекурсивной кампанией астротурфинга с использованием примерно 400 бот-инстансов, которые создали ажиотаж для накачки токена $CLAWD до рыночной капитализации в $16 млн, после чего его стоимость обвалилась на 90%.

OpenClawRadar