Claude Code v2.1.237 : Correction de la mise en cache des invites pour les passerelles LLM + style de sortie concis intégré
Claude Code v2.1.237 est sorti, avec deux changements qui affectent l'utilisation quotidienne : une correction pour la mise en cache des invites lorsque vous passez par une passerelle LLM ou une URL de base personnalisée, et un nouveau style de sortie 'Concis' intégré.
Correction de la mise en cache des invites pour les passerelles
Si vous utilisez Claude Code avec une passerelle LLM (comme LiteLLM ou un proxy d'entreprise) ou une URL de base personnalisée, la mise en cache des invites était apparemment cassée dans les versions précédentes. Cela va à l'encontre du but : la mise en cache est ce qui maintient les grandes fenêtres de contexte rapides et économiques. v2.1.237 corrige cela, donc les sessions via ces configurations devraient voir les hits de cache habituels à nouveau.
Nouveau style de sortie 'Concis'
Il y a aussi un nouveau style de sortie appelé Concis. D'après le journal des modifications : "Claude mène avec les résultats et saute le préambule et la narration, tout en faisant le travail aussi minutieusement." En pratique, cela signifie moins de remplissage comme "Je vais maintenant analyser votre codebase" et des réponses plus directes. Vous pouvez y passer en exécutant /config et en sélectionnant Concis sous Style de sortie.
C'est un paramètre global, donc une fois que vous le choisissez, il s'applique à toutes vos sessions. Si vous utilisiez des invites personnalisées pour forcer la brièveté, c'est maintenant une option de première classe.
Pour qui cela s'adresse
- Les équipes qui acheminent Claude Code via une passerelle LLM ou une URL de base personnalisée — la correction de la mise en cache est importante pour la performance et les coûts de tokens.
- Les développeurs qui veulent moins de narration et des réponses plus rapides — le style Concis vaut la peine d'être essayé.
La version est étiquetée v2.1.237 sur GitHub. Mettez à jour avec npm update -g @anthropic-ai/claude-code ou votre installateur habituel.
📖 Lire la source complète : GitHub Claude-Code
👀 See Also

L'inférence IA est clairement rentable : analyse des aspects économiques
Les fournisseurs d'inférence IA de pointe déclarent des marges brutes de 70 à 80 %. Les estimations de coûts montrent qu'il en coûte environ 1 dollar par million de tokens pour servir un modèle de 70B, tandis que les prix des API sont de 4,50 dollars ou plus par million de tokens.

Google achète discrètement le code du Play Store pour former ses outils de codage IA
Google envoie un e-mail aux développeurs Android pour les payer afin d'accéder à leurs bases de code et améliorer ses outils d'IA de codage, dans le cadre d'un programme pilote confidentiel.

Les meilleurs modèles d'IA présentent un écart de performance dans les langues non anglophones.
Une analyse récente montre que les principaux modèles d'IA obtiennent de moins bonnes performances dans les langues autres que l'anglais, l'article ayant reçu 16 points et 3 commentaires sur Hacker News.
Claude Code v2.1.208 : Mode lecteur d'écran, remappages Vim, corrections de fuites mémoire et plus encore
Claude Code v2.1.208 ajoute un mode lecteur d'écran texte en option, des remappages de séquences en mode insertion Vim, un wrapper de processus pour les lanceurs d'entreprise, et corrige des dizaines de bugs, notamment des fuites mémoire dans les longues sessions.