Бенчмарк IDP Leaderboard показывает, что Claude Sonnet 4.6 соответствует уровню Opus 4.6 в задачах по обработке документов с использованием искусственного интеллекта.

Лидерборд IDP, открытый эталонный тест для ИИ-обработки документов, опубликовал результаты сравнения моделей Claude по задачам обработки документов. Тестирование проверило 16 моделей по нескольким категориям, используя более 9000 реальных документов.
Результаты тестирования
Баллы моделей Claude по результатам Лидерборда IDP:
- Claude Sonnet 4.6: 80.8 в целом
- Claude Opus 4.6: 80.3 в целом
- Claude Haiku 4.5: 69.6 в целом
Sonnet и Opus показали практически одинаковые результаты по задачам извлечения, включая текст, таблицы, формулы и анализ структуры. Согласно результатам тестирования, радар-диаграммы обеих моделей выглядят идентично.
Сравнение стоимости
В источнике отмечаются значительные различия в стоимости:
- Sonnet стоит $24 за 1000 страниц
- Opus стоит $40 за 1000 страниц
Для рабочих нагрузок по обработке документов тестирование предполагает, что нет причин использовать Opus, учитывая эквивалентную производительность при более низкой стоимости.
Важное замечание
Одно примечательное наблюдение: у моделей Claude была более строгая модерация контента, которая повлияла на производительность с определёнными типами документов. Сканы старых газет, страницы учебников и исторические документы иногда активировали фильтры контента. Эта проблема проявлялась только в тестах OlmOCR и OmniDoc.
Все прогнозы из тестирования видны в Results Explorer на сайте idp-leaderboard.org, где можно увидеть, что именно выводила каждая модель Claude на каждом документе.
📖 Прочитать полный источник: r/ClaudeAI
👀 Смотрите также

Конкурс по протеомике Bohrium AI 2026 с призовым фондом $13K и поддержкой вычислительных ресурсов
Bohrium проводит соревнование по AI-протеомике в 2026 году с призовым фондом в 13 000 долларов, возможностями стажировки и вычислительной поддержкой. Соревнование обсуждалось на Hacker News, где набрало 17 баллов и 5 комментариев.
Исследовательское золото обещает «100% написанные человеком, никогда не ИИ» медицинские исследования — но его команда полностью состоит из ИИ
Сайт Research Gold рекламирует «100% написанные людьми, никогда ИИ» медицинские исследования, но его методологи с докторской степенью созданы ИИ, а личности реальных исследователей используются без разрешения. Телефонные звонки обслуживает ИИ-ассистент, который отрицает, что он ИИ.

Клод Код v2.1.205: Блокировка подделки стенограмм, исправления JSON-схем и улучшения автоматического режима
Claude Code v2.1.205 добавляет блокировку подделки протокола сессии в автоматическом режиме, исправляет проблемы с большими JSON-схемами, улучшает обработку фоновых агентов и сокращает потребление памяти обновлятора.

Рост экосистемы OpenClaw и ключевые участники на карте
Участник сообщества составил карту стремительного расширения экосистемы OpenClaw, отметив более 230 тысяч звёзд на GitHub, более 116 тысяч участников в Discord и появление компаний в сферах управляемого хостинга, маршрутизации LLM и слоёв безопасности в течение 60 дней с момента запуска.