Claude Code contre Codex : Test de construction en conditions réelles – 36 fichiers contre 28, boucle infinie et différence de coût de 0,46 $

✍️ OpenClawRadar📅 Publié: May 14, 2026🔗 Source
Claude Code contre Codex : Test de construction en conditions réelles – 36 fichiers contre 28, boucle infinie et différence de coût de 0,46 $
Ad

Un développeur a comparé directement Claude Code et Codex (via Cursor) en utilisant les mêmes instructions et la même configuration MCP (GitHub + Slack). Sans indices, sans aide supplémentaire. Deux tâches :

  • Tâche 1 : Robot de tri de PR – lire les PR ouvertes, évaluer la complexité, rédiger un rapport, notifier Slack pour les priorités élevées. Nécessite une logique de réessai, une journalisation des erreurs, du TypeScript strict (pas de any).
  • Tâche 2 : Interface de révision de code en temps réel – React, WebSocket, commentaires en ligne, mises à jour optimistes avec retour arrière, visualiseur de différences virtualisé, reconnexion avec backoff. Aucune bibliothèque UI, tout fait maison.

Résultats

  • Claude Code : A vérifié que les outils MCP étaient actifs avant d'écrire du code. A construit 36 fichiers en 12 minutes. Incluait un test de fumée WebSocket à deux clients non demandé. Latence de diffusion : 3 ms. Zéro any. Vérification de type réussie du premier coup.
  • Codex (Cursor) : Impossible d'accéder à GitHub MCP pour la tâche 1 (le chemin d'exécution de Cursor n'exposait pas les descripteurs d'outils). A obtenu tool not found après 3 tentatives, mais a géré l'erreur proprement – problème d'environnement, pas de qualité du modèle. La tâche 2 a livré une interface fonctionnelle en ~15 min, latence de 5 ms. La première compilation avait des erreurs TypeScript et une boucle infinie React (useEffect appelant hydrate à plusieurs reprises) qui a nécessité un correctif de garde de référence.
Ad

Coût

Coût API pour les deux tâches : Claude ~2,50 $, Codex ~2,04 $. Claude était ~23 % plus cher mais a offert une architecture plus granulaire et une interface propre dès le premier essai.

Points clés

L'auteur note que les deux outils ne sont pas vraiment en concurrence pour le même cas d'usage. Claude Code donne l'impression de collaborer avec quelqu'un qui lit d'abord la documentation ; Codex donne l'impression d'un développeur senior qui veut livrer vite. Aucun n'a divulgué de any, aucun n'a halluciné un nom d'outil, et les deux ont obtenu une diffusion WebSocket en moins de 10 ms – une nette amélioration par rapport à il y a six mois.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

companion-capture : L'outil sauvegarde les bulles de parole éphémères de Claude Code
Tools

companion-capture : L'outil sauvegarde les bulles de parole éphémères de Claude Code

companion-capture est un outil open-source qui capture les bulles de dialogue du personnage compagnon de Claude Code avant qu'elles ne disparaissent du terminal. Il enregistre les messages dans des fichiers markdown et SQLite pour la recherche, en utilisant l'analyse du tampon d'écran VT100 pour suivre les positions du curseur.

OpenClawRadar
Oh-My-Mermaid : Compétence Claude Code pour la génération automatique de diagrammes d'architecture
Tools

Oh-My-Mermaid : Compétence Claude Code pour la génération automatique de diagrammes d'architecture

Oh-My-Mermaid est une compétence Claude Code qui analyse les bases de code et génère automatiquement des diagrammes d'architecture Mermaid ainsi que de la documentation. Il est installé via npm et utilisé avec la commande /omm-scan dans Claude Code.

OpenClawRadar
🦀
Tools

PullMD v2.4.1 ajoute un connecteur MCP natif pour claude.ai Web et l'authentification multi-utilisateur

PullMD v2.4.1 prend désormais en charge la boîte de dialogue de connecteur personnalisé de claude.ai via OAuth 2.1 + PKCE-S256 et ajoute des modes d'authentification multi-utilisateurs. Transformez n'importe quelle URL en Markdown propre via un MCP auto-hébergé.

OpenClawRadar
L'Agent Web TinyFish Surpasse les Concurrents dans les Tests de Performance de Tâches Web
Tools

L'Agent Web TinyFish Surpasse les Concurrents dans les Tests de Performance de Tâches Web

L'agent web TinyFish a atteint un taux de réussite de 81,9 % sur des tâches web difficiles, surpassant nettement des concurrents comme OpenAI Operator à 43,2 %.

OpenClawRadar