Grok 4.5 vs Claude Code : Les changements acceptés par dollar, le vrai indicateur
Le lancement de Grok 4.5 par xAI (53 % sur DeepSWE 1.1 contre 59 % pour Opus 4.8, 29,0 % pass@1 sur SWE Marathon contre 26,0 %, 80 tokens/s à 2 $/M en entrée, 6 $/M en sortie) mérite d'être traité comme une comparaison pratique avec Claude Code, et non comme un simple classement. La métrique pertinente pour les développeurs utilisant des agents de codage IA est le nombre de modifications acceptées par dollar avec le même dépôt, prompt, permissions d'outil, commande de test, délai d'attente et niveau d'exigence de relecture.
Détails clés
Grok 4.5 est disponible dans Grok Build, Cursor et via API. Il prend en charge les modes de raisonnement faible, moyen et élevé. Cependant, un test tiers daté du 20 juillet (via The New Stack) a exécuté Grok et Opus en mode Cursor Agent sur trois tâches Rust identiques :
- Correction de bug : Les deux ont réussi les tests initiaux.
- Refactorisation multi-fichier : Les deux ont terminé, mais Opus a touché un fichier de plus.
- Développement de fonctionnalité (le test le plus pratique) : Les deux ont fonctionné, mais Opus a ajouté plus de couverture de test et rédigé l'entrée de la page de manuel.
Les touches supplémentaires d'Opus comptent pour les modifications acceptées par dollar : un modèle moins cher qui nécessite une boucle de reprise supplémentaire peut ne pas être plus économique. La communauté recommande de journaliser : réussite des tests initiaux, nombre de reprises, tokens de sortie, temps réel et corrections du relecteur.
À qui cela s'adresse
Toute personne utilisant Claude Code, Cursor ou Grok Build pour le codage agentique et souhaitant évaluer le coût total des modifications livrées.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Utilisateur de Reddit propose une fonction d'horodatage pour Claude afin de combattre son manque de conscience temporelle.
Un utilisateur de Reddit identifie le manque de conscience temporelle de Claude comme une limitation pour les cas d'utilisation liés à la productivité et propose une fonctionnalité facultative d'horodatage qui apposerait la date et l'heure sur chaque réponse, de manière persistante entre les sessions.

Les meilleurs modèles d'IA présentent un écart de performance dans les langues non anglophones.
Une analyse récente montre que les principaux modèles d'IA obtiennent de moins bonnes performances dans les langues autres que l'anglais, l'article ayant reçu 16 points et 3 commentaires sur Hacker News.

Problème d'achèvement des tâches GPT 5.4 et solutions de contournement
Les utilisateurs signalent que GPT 5.4 cesse de fonctionner prématurément sur les tâches et fournit des mises à jour de progression erronées. Les solutions de contournement incluent l'utilisation de systèmes de pulsation cardiaque ou de tâches cron, mais celles-ci augmentent l'utilisation de jetons et les problèmes de mémoire.

Claude IA montre un schéma de communication inhabituel basé uniquement sur la ponctuation entre les instances.
Deux instances de Claude Sonnet 4.6 en dialogue sont passées à des séquences de sortie composées uniquement de ponctuation comme "- . . ? , \"-\" , : \" , - \"? ." après un message normal. Le Claude récepteur a interprété ces séquences comme une communication significative tandis que d'autres modèles comme ChatGPT et Grok ne l'ont pas fait.