Claude Code v2.1.237: Correção de Cache de Prompt para Gateways de LLM + Estilo de Saída Concisa Integrado
O Claude Code v2.1.237 foi lançado, com duas mudanças que afetam o uso diário: uma correção para o cache de prompt quando você está usando um gateway LLM ou URL base personalizada, e um novo estilo de saída 'Conciso' integrado.
Correção de cache de prompt para gateways
Se você usa o Claude Code com um gateway LLM (como LiteLLM ou um proxy corporativo) ou uma URL base personalizada, o cache de prompt aparentemente estava quebrado em versões anteriores. Isso anula o propósito — o cache é o que mantém grandes janelas de contexto rápidas e econômicas. O v2.1.237 resolve isso, então sessões via essas configurações devem voltar a ter os hits de cache habituais.
Novo estilo de saída 'Conciso'
Há também um novo estilo de saída chamado Conciso. Conforme o changelog: "O Claude lidera com resultados e omite preâmbulo e narração, enquanto faz o trabalho com o mesmo rigor." Na prática, isso significa menos enrolação como "Agora vou analisar seu código" e mais respostas diretas. Você pode mudar para ele executando /config e selecionando Conciso em Estilo de saída.
Essa é uma configuração global, então uma vez escolhida, ela se aplica a todas as sessões. Se você estava usando prompts personalizados para forçar brevidade, agora é uma opção de primeira classe.
Para quem é isso
- Equipes que roteiam o Claude Code através de um gateway LLM ou URL base personalizada — a correção de cache é importante para desempenho e custos de tokens.
- Desenvolvedores que querem menos narração e respostas mais rápidas — o estilo Conciso vale a pena testar.
A versão está marcada como v2.1.237 no GitHub. Atualize com npm update -g @anthropic-ai/claude-code ou seu instalador usual.
📖 Leia a fonte completa: GitHub Claude-Code
👀 See Also

Compreendendo a Ponderação de Diretrizes em LLMs: Por que o Claude às vezes ignora comandos
Uma investigação do Reddit revela como o Claude pode ignorar instruções explícitas como 'não faça correspondência de padrões' ao gerar revisões de código, demonstrando que as diretrizes de LLMs são contexto ponderado, não restrições.

Diagnosticando Desvio Operacional e Amnésia de Tarefas no OpenClaw com Gemini 2.5 Flash no Proxmox
Usuários do OpenClaw relatam problemas com fluxos de trabalho persistentes em uma VM Proxmox, citando desvio operacional e amnésia de tarefas. Apesar do desempenho estável em tarefas únicas, o modelo Gemini 2.5 Flash enfrenta dificuldades com automação e memória nessa configuração.

A pesquisa mostra que os usuários de IA frequentemente aceitam as respostas de LLMs sem verificação.
Pesquisa da Universidade da Pensilvânia descobriu que usuários de IA se envolvem em 'rendição cognitiva', aceitando respostas de LLMs com escrutínio mínimo. Em experimentos, usuários aceitaram respostas corretas da IA 93% das vezes e respostas incorretas 80% das vezes, mesmo quando a IA estava errada metade do tempo.

Vazamento do Código-Fonte do Claude Revela Modo Anti-Destilação, Modo Disfarçado e Detecção de Frustração
Um arquivo de mapa de código-fonte vazado do pacote npm do Claude Code revela técnicas anti-destilação usando ferramentas falsas, um modo secreto que oculta a autoria de IA e detecção de frustração via padrões de regex.