Claude Code contre Codex : Test de construction en conditions réelles – 36 fichiers contre 28, boucle infinie et différence de coût de 0,46 $

Un développeur a comparé directement Claude Code et Codex (via Cursor) en utilisant les mêmes instructions et la même configuration MCP (GitHub + Slack). Sans indices, sans aide supplémentaire. Deux tâches :
- Tâche 1 : Robot de tri de PR – lire les PR ouvertes, évaluer la complexité, rédiger un rapport, notifier Slack pour les priorités élevées. Nécessite une logique de réessai, une journalisation des erreurs, du TypeScript strict (pas de
any). - Tâche 2 : Interface de révision de code en temps réel – React, WebSocket, commentaires en ligne, mises à jour optimistes avec retour arrière, visualiseur de différences virtualisé, reconnexion avec backoff. Aucune bibliothèque UI, tout fait maison.
Résultats
- Claude Code : A vérifié que les outils MCP étaient actifs avant d'écrire du code. A construit 36 fichiers en 12 minutes. Incluait un test de fumée WebSocket à deux clients non demandé. Latence de diffusion : 3 ms. Zéro
any. Vérification de type réussie du premier coup. - Codex (Cursor) : Impossible d'accéder à GitHub MCP pour la tâche 1 (le chemin d'exécution de Cursor n'exposait pas les descripteurs d'outils). A obtenu
tool not foundaprès 3 tentatives, mais a géré l'erreur proprement – problème d'environnement, pas de qualité du modèle. La tâche 2 a livré une interface fonctionnelle en ~15 min, latence de 5 ms. La première compilation avait des erreurs TypeScript et une boucle infinie React (useEffectappelanthydrateà plusieurs reprises) qui a nécessité un correctif de garde de référence.
Coût
Coût API pour les deux tâches : Claude ~2,50 $, Codex ~2,04 $. Claude était ~23 % plus cher mais a offert une architecture plus granulaire et une interface propre dès le premier essai.
Points clés
L'auteur note que les deux outils ne sont pas vraiment en concurrence pour le même cas d'usage. Claude Code donne l'impression de collaborer avec quelqu'un qui lit d'abord la documentation ; Codex donne l'impression d'un développeur senior qui veut livrer vite. Aucun n'a divulgué de any, aucun n'a halluciné un nom d'outil, et les deux ont obtenu une diffusion WebSocket en moins de 10 ms – une nette amélioration par rapport à il y a six mois.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Envoyer les agents OpenClaw comme participants à une réunion avec voix, chat et partage d'écran
Une nouvelle compétence permet aux agents OpenClaw de participer à Google Meet, Teams et Zoom avec voix (STT/TTS), chat, avatar vidéo et partage d'écran.

Construire un système de connaissances auto-améliorant avec Claude Code et Obsidian
Un développeur a créé un système de 25 outils qui confère à Claude Code une mémoire persistante grâce à la recherche sémantique, aux graphes de connaissances et à la répétition espacée sur un coffre Obsidian. Le système indexe le contenu avec des embeddings bge-m3, détecte les contradictions, élagage automatique des notes obsolètes et génère automatiquement des cartes Obsidian Canvas.
Lathoa : une appli de maths pour enfants où l'IA est censée se tromper
Lathoa est une appli de maths pour les 10-14 ans où un robot nommé Errol résout des problèmes étape par étape, avec une étape volontairement fausse. Le plus difficile n'était pas de rendre l'IA intelligente, mais de la faire se tromper exprès.

Fonctionnalité Claw Voice ajoute le support de l'API 11Labs avec intégration CarPlay
Claw Voice s'intègre à CarPlay et permet des voix personnalisées via l'API 11Labs, offrant des conversations naturelles et fluides avec votre agent pendant la conduite.