Клод Код против Кодекса: Реальное тестирование сборки – 36 файлов против 28, бесконечный цикл и разница в стоимости в $0.46

Разработчик провел прямое сравнение Claude Code и Codex (через Cursor), используя одинаковые промпты и одинаковую настройку MCP (GitHub + Slack). Никаких подсказок, никакой дополнительной помощи. Две задачи:
- Задача 1: Бот для триажа PR – читать открытые PR, оценивать сложность, писать отчет, отправлять уведомление в Slack для высокоприоритетных. Требовалась логика повторных попыток, логирование ошибок, строгий TypeScript (без
any). - Задача 2: Интерфейс ревью кода в реальном времени – React, WebSocket, встроенные комментарии, оптимистичные обновления с откатом, виртуализированный просмотр diff, переподключение с задержкой. Никаких библиотек UI, всё с нуля.
Результаты
- Claude Code: Перед написанием кода проверил, что инструменты MCP работают. Создал 36 файлов за 12 минут. Включил не запрошенный smoke-тест WebSocket с двумя клиентами. Задержка вещания: 3 мс. Ни одного
any. Первая же проверка типов прошла успешно. - Codex (Cursor): Не смог получить доступ к GitHub MCP для Задачи 1 (путь выполнения Cursor не раскрывал дескрипторы инструментов). После 3 попыток получил
tool not found, но корректно обработал ошибку – проблема окружения, а не качества модели. Задача 2 выдала рабочий интерфейс за ~15 минут, задержка 5 мс. Первая компиляция содержала ошибки TypeScript и бесконечный цикл React (useEffect, постоянно вызывающийhydrate), который потребовал патча с защитным флагом.
Стоимость
Стоимость API по обеим задачам: Claude ~$2.50, Codex ~$2.04. Claude был на ~23% дороже, но предложил более детальную архитектуру и чистый интерфейс с первой попытки.
Ключевые выводы
Автор отмечает, что эти два инструмента не совсем конкурируют в одной нише. Claude Code напоминает работу с тем, кто сначала читает документацию; Codex – старшего разработчика, который хочет быстро выпустить продукт. Ни один не использовал any, ни один не выдумал название инструмента, и оба обеспечили задержку WebSocket менее 10 мс – явное улучшение по сравнению с полугодом ранее.
📖 Читать полный источник: r/LocalLLaMA
👀 Смотрите также

OpenClaw-superpowers добавляет функции надежности для режимов операционных сбоев.
Репозиторий openclaw-superpowers пополнился восемью новыми навыками, ориентированными на надёжность, включая предварительные проверки перед развёртыванием, подтверждение выполнения cron-заданий, восстановление после сброса сессии и управление жизненным циклом аутентификации MCP. Эти дополнения увеличили общее количество навыков до 60, из которых 44 являются нативными для OpenClaw, а 23 предназначены для планирования по расписанию cron.

Представляем operate.txt: спецификация в формате YAML для ИИ-агентов, взаимодействующих с SaaS-продуктами.
Разработчик создал operate.txt — файл YAML, размещенный по адресу yourdomain.com/operate.txt, который документирует детали экранов, состояния загрузки, необратимые действия и пошаговые пути для ИИ-агентов, использующих функции компьютерного взаимодействия. Спецификация решает такие проблемы, как вопросы Claude вроде 'это сломано?' во время законных экранов загрузки.

Utilyze: Монитор GPU с открытым исходным кодом, измеряющий реальную вычислительную пропускную способность, а не только активность ядра
Utilyze выбирает образцы аппаратных счетчиков производительности, чтобы сообщать вычислительную и памятьную пропускную способность относительно теоретических пределов, показывая, что панели с 100% загрузкой могут иметь всего 1-10% реальной пропускной способности.

AIMEAT: Самодостаточный протокол для ИИ-агентов, локальных LLM и общих возможностей
AIMEAT — это самодельный протокол и сервер, который позволяет людям, ИИ-агентам и локальным LLM обмениваться приложениями, знаниями и возможностями через HTTP/JSON. Никакой привязки к вендору, никакого специального SDK — обычные запросы и загрузки по URL.