Regresión de rendimiento de Claude Code diagnosticada: Configuración, no inteligencia del modelo

Anthropic publicó un informe post-mortem sobre la reciente regresión de rendimiento de Claude Code. El hallazgo contradice la interpretación inicial de la comunidad: la degradación no se debió a que el modelo se volviera más tonto. Fueron tres cambios en la configuración del producto.
Tres cambios específicos que causaron la regresión
- Reducción del esfuerzo de razonamiento predeterminado: El harness redujo el esfuerzo de razonamiento predeterminado, lo que llevó a un análisis más superficial.
- Error de caché de sesión: Un error eliminó el pensamiento previo de la caché, rompiendo la continuidad entre turnos.
- Cambio en la verbosidad del prompt: Una modificación en el prompt redujo la verbosidad, disminuyendo la calidad del código generado.
Anthropic revirtió estos cambios en el último parche, y el rendimiento volvió a los niveles anteriores — mismo modelo, configuración diferente, comportamiento diferente.
Implicaciones para equipos que usan agentes de codificación de IA
La conclusión práctica tiene que ver con la unidad de confianza. Si confías en el modelo, cambias de modelo cuando el comportamiento varía. Si confías en la instancia, buscas evidencia de que la configuración cambió. Estas dos respuestas requieren herramientas completamente diferentes: la mayoría de los equipos carecen de evidencia a nivel de sesión y confían en corazonadas sobre qué agente está funcionando.
El informe post-mortem es útil no porque resuelva el debate, sino porque demuestra cómo se ve una capa de evidencia cuando realmente se tiene una. Para los equipos que usan Claude Code, rastrear los deltas de configuración a nivel de sesión y el estado de la caché se ha convertido en una necesidad práctica.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

Usuario de Reddit informa 18.8 tok/s en inferencia por CPU con Qwen 3 30B Q4 en Zen 4.
Un usuario en r/LocalLLaMA probó Qwen 3 30B Q4 en CPU y logró 18.8 tokens por segundo con un procesador Zen 4 y memoria DDR5, superando significativamente las expectativas de 3-5 tok/s.

Mistral Medium 3.5 128B Lanzado: Modelo Denso con Razonamiento y Visión Configurables
Mistral AI lanzó Mistral Medium 3.5, un modelo denso de 128B con contexto de 256k, esfuerzo de razonamiento configurable y capacidades de visión, bajo una licencia MIT modificada.

Residentes de Maryland enfrentan una actualización de la red eléctrica de $2 mil millones para centros de datos de IA fuera del estado: el estado presenta una queja ante la FERC
La Oficina de Abogados del Pueblo de Maryland presentó una queja ante la FERC contra PJM Interconnection, que asignó $2 mil millones de una actualización de la red de $22 mil millones a los clientes de Maryland, costando a los residentes aproximadamente $345 cada uno, principalmente para beneficiar a centros de datos de IA fuera del estado.

Anthropic aumenta los límites de Claude y añade capacidad de cómputo de SpaceX
Anthropic ha aumentado los límites de uso de Claude y ha cerrado un acuerdo de cómputo con SpaceX. El debate en Reddit evalúa si esto es solo escalado de infraestructura o un movimiento estratégico para convertir a Claude en una mejor plataforma para el trabajo agentivo.