Grok 4.5 против Claude Code: Принятые изменения на доллар — настоящий ориентир
Запуск Grok 4.5 от xAI (53% на DeepSWE 1.1 против 59% у Opus 4.8, 29.0% pass@1 на SWE Marathon против 26.0%, 80 токенов/с при $2/M за ввод, $6/M за вывод) стоит рассматривать как практическое сравнение с Claude Code, а не очередную заявку в лидерборде. Правильная метрика для разработчиков, использующих ИИ-агентов кодинга, — принятые изменения за доллар при одинаковом репозитории, промпте, разрешениях инструментов, тестовой команде, тайм-ауте и планке проверки.
Ключевые детали
Grok 4.5 доступен в Grok Build, Cursor и через API. Он поддерживает низкий, средний и высокий режимы рассуждения. Однако сторонний тест от 20 июля (через The New Stack) запускал Grok и Opus в режиме Cursor Agent на трех идентичных Rust-задачах:
- Исправление ошибки: Оба прошли начальные тесты.
- Многофайловый рефакторинг: Оба справились, но Opus затронул на один файл больше.
- Разработка функции (самый практичный тест): Оба сработали, но Opus добавил больше тестового покрытия и написал запись в man-страницу.
Дополнительные касания Opus важны для метрики «принятые изменения за доллар»: более дешевая модель, требующая одного дополнительного цикла доработок, может оказаться не дешевле. Сообщество рекомендует логировать: успех первого теста, количество доработок, выходные токены, реальное время и исправления рецензента.
Для кого это
Для всех, кто использует Claude Code, Cursor или Grok Build для агентного кодинга и хочет оценить полную стоимость доставленных изменений.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Исследование возможности запуска OpenClaw на Chromebook
Запуск OpenClaw на Chromebook может быть проще, чем вы думаете. Наше последнее исследование от OpenClawRadar погружается в пользовательский опыт и требования, чтобы выяснить, могут ли Chromebook справляться с этим ИИ-кодировщиком.

Claude Code превращается в инженерную ОС, а не просто в ИИ-чат для кода
Обсуждение на Reddit утверждает, что Claude Code становится меньше похожим на ИИ-чат для программирования и больше — на инженерную операционную систему с планированием, ревью кода, облачными агентами и автономными рабочими процессами.

Инструменты ИИ увеличивают нагрузку на инженеров и меняют профессиональные роли.
Исследование Harvard Business Review за февраль 2026 года показало, что 83% работников сообщили о возросшей нагрузке из-за инструментов ИИ, а 62% испытали выгорание. В статье описывается, как ИИ изменил роли инженеров: от написания кода к проверке кода, сгенерированного ИИ.

Мэрилендцы столкнутся с модернизацией сети за 2 млрд долларов для дата-центров ИИ в других штатах — власти подали жалобу в FERC
Управление народного адвоката Мэриленда подало жалобу в FERC на PJM Interconnection, которая выделила 2 миллиарда долларов из 22 миллиардов долларов на модернизацию сети для Мэриленда — что обойдется бытовым потребителям примерно в 345 долларов каждого, в основном для выгоды центров обработки данных ИИ из других штатов.