Клод Код против Кодекса: Реальное тестирование сборки – 36 файлов против 28, бесконечный цикл и разница в стоимости в $0.46

✍️ OpenClawRadar📅 Опубликовано: 14 мая 2026 г.🔗 Source
Клод Код против Кодекса: Реальное тестирование сборки – 36 файлов против 28, бесконечный цикл и разница в стоимости в $0.46
Ad

Разработчик провел прямое сравнение Claude Code и Codex (через Cursor), используя одинаковые промпты и одинаковую настройку MCP (GitHub + Slack). Никаких подсказок, никакой дополнительной помощи. Две задачи:

  • Задача 1: Бот для триажа PR – читать открытые PR, оценивать сложность, писать отчет, отправлять уведомление в Slack для высокоприоритетных. Требовалась логика повторных попыток, логирование ошибок, строгий TypeScript (без any).
  • Задача 2: Интерфейс ревью кода в реальном времени – React, WebSocket, встроенные комментарии, оптимистичные обновления с откатом, виртуализированный просмотр diff, переподключение с задержкой. Никаких библиотек UI, всё с нуля.

Результаты

  • Claude Code: Перед написанием кода проверил, что инструменты MCP работают. Создал 36 файлов за 12 минут. Включил не запрошенный smoke-тест WebSocket с двумя клиентами. Задержка вещания: 3 мс. Ни одного any. Первая же проверка типов прошла успешно.
  • Codex (Cursor): Не смог получить доступ к GitHub MCP для Задачи 1 (путь выполнения Cursor не раскрывал дескрипторы инструментов). После 3 попыток получил tool not found, но корректно обработал ошибку – проблема окружения, а не качества модели. Задача 2 выдала рабочий интерфейс за ~15 минут, задержка 5 мс. Первая компиляция содержала ошибки TypeScript и бесконечный цикл React (useEffect, постоянно вызывающий hydrate), который потребовал патча с защитным флагом.
Ad

Стоимость

Стоимость API по обеим задачам: Claude ~$2.50, Codex ~$2.04. Claude был на ~23% дороже, но предложил более детальную архитектуру и чистый интерфейс с первой попытки.

Ключевые выводы

Автор отмечает, что эти два инструмента не совсем конкурируют в одной нише. Claude Code напоминает работу с тем, кто сначала читает документацию; Codex – старшего разработчика, который хочет быстро выпустить продукт. Ни один не использовал any, ни один не выдумал название инструмента, и оба обеспечили задержку WebSocket менее 10 мс – явное улучшение по сравнению с полугодом ранее.

📖 Читать полный источник: r/LocalLLaMA

Ad

👀 Смотрите также

Архитектура памяти Vektori: принципы из утекшей системы Claude
Инструменты

Архитектура памяти Vektori: принципы из утекшей системы Claude

Vektori реализует трехуровневую иерархическую графовую структуру предложений для памяти ИИ, вдохновлённую утечкой принципов архитектуры Claude. Система использует строгие фильтры качества, скептическое извлечение с минимальным баллом 0.3 и сохраняет историю исправлений между сессиями.

OpenClawRadar
DecisionNode: CLI и MCP-сервер для семантического хранения решений
Инструменты

DecisionNode: CLI и MCP-сервер для семантического хранения решений

DecisionNode — это локальный CLI и MCP-сервер, который хранит структурированные решения в формате JSON, преобразует их в векторные представления для семантического поиска и делает доступными для различных AI-инструментов через MCP. Распространяется под лицензией MIT и предназначен для работы с Claude Code, Cursor, Windsurf, Antigravity и другими MCP-клиентами.

OpenClawRadar
CostHawk запускает публичную таблицу лидеров по потреблению токенов для Claude Code, Codex и Cursor
Инструменты

CostHawk запускает публичную таблицу лидеров по потреблению токенов для Claude Code, Codex и Cursor

Лидерборд CostHawk ранжирует публичных пользователей Claude Code, OpenAI Codex и Cursor по общему потреблению токенов, отслеживая количество, модели и временные метки синхронизации, не сохраняя промпты или код.

OpenClawRadar
SWE-CI: Новые эталонные тесты оценивают ИИ-агентов в долгосрочном сопровождении кода через CI
Инструменты

SWE-CI: Новые эталонные тесты оценивают ИИ-агентов в долгосрочном сопровождении кода через CI

SWE-CI — это бенчмарк на уровне репозитория, который оценивает агентов на основе LLM в поддержании кодовых баз через циклы непрерывной интеграции, смещая фокус со статического исправления ошибок на долгосрочную поддерживаемость в рамках 100 реальных задач.

OpenClawRadar