Grok 4.5 против Claude Code: Принятые изменения на доллар — настоящий ориентир
Запуск Grok 4.5 от xAI (53% на DeepSWE 1.1 против 59% у Opus 4.8, 29.0% pass@1 на SWE Marathon против 26.0%, 80 токенов/с при $2/M за ввод, $6/M за вывод) стоит рассматривать как практическое сравнение с Claude Code, а не очередную заявку в лидерборде. Правильная метрика для разработчиков, использующих ИИ-агентов кодинга, — принятые изменения за доллар при одинаковом репозитории, промпте, разрешениях инструментов, тестовой команде, тайм-ауте и планке проверки.
Ключевые детали
Grok 4.5 доступен в Grok Build, Cursor и через API. Он поддерживает низкий, средний и высокий режимы рассуждения. Однако сторонний тест от 20 июля (через The New Stack) запускал Grok и Opus в режиме Cursor Agent на трех идентичных Rust-задачах:
- Исправление ошибки: Оба прошли начальные тесты.
- Многофайловый рефакторинг: Оба справились, но Opus затронул на один файл больше.
- Разработка функции (самый практичный тест): Оба сработали, но Opus добавил больше тестового покрытия и написал запись в man-страницу.
Дополнительные касания Opus важны для метрики «принятые изменения за доллар»: более дешевая модель, требующая одного дополнительного цикла доработок, может оказаться не дешевле. Сообщество рекомендует логировать: успех первого теста, количество доработок, выходные токены, реальное время и исправления рецензента.
Для кого это
Для всех, кто использует Claude Code, Cursor или Grok Build для агентного кодинга и хочет оценить полную стоимость доставленных изменений.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Anthropic переносит фоновую автоматизацию Claude Code в отдельный кредитный пакет SDK, нарушая работу агентов
Начиная с 15 июня, claude -p, использование Agent SDK, Claude Code GitHub Actions и сторонние приложения Agent SDK больше не будут учитываться в интерактивных квотах Pro/Max. Применяется новый отдельный кредитный пул Agent SDK: $100 в месяц для планов Max 5x. Фоновые стеки агентов (например, тикеты → агенты → хуки → исполнитель → claude -p) быстро исчерпают этот лимит.

OpenClaw 4.2 исправляет ошибку сопряжения и добавляет устойчивые потоки задач.
OpenClaw 4.2 исправляет ошибку сопряжения, затронувшую пользователей, обновившихся около 31 марта, и представляет устойчивые потоки задач, позволяющие длительным задачам переживать разрывы соединения с шлюзом.

ИИ-кодеры ходят с открытыми ноутбуками, чтобы поддерживать работу агентов
Технари носят ноутбуки в режиме «раскладушка», чтобы ИИ-агенты для кодинга, такие как Claude Code и OpenAI Codex, не останавливались. Советы включают использование команды 'caffeinate' на Mac.
Голливудские креативщики обучают ИИ, чтобы он заменил их, — и получают $12–$200 в час
Лауреаты премий сценаристы, режиссеры и продюсеры берутся за подработку, чтобы обучать модели ИИ—писать сценарии, планировать съемки и многое другое—на фоне спада производства на 35%.