Grok 4.5 vs Claude Code: Cambios Aceptados por Dólar es el Verdadero Punto de Referencia
El lanzamiento de Grok 4.5 de xAI (53% en DeepSWE 1.1 vs 59% de Opus 4.8, 29.0% pass@1 en SWE Marathon vs 26.0%, 80 tokens/segundo a $2/M de entrada, $6/M de salida) merece tratarse como una comparación práctica con Claude Code, no solo como otra afirmación en un ranking. La métrica adecuada para los desarrolladores que usan agentes de codificación de IA son los cambios aceptados por dólar con el mismo repositorio, prompt, permisos de herramientas, comando de prueba, tiempo de espera y criterio de revisión.
Detalles clave
Grok 4.5 está disponible en Grok Build, Cursor y a través de API. Admite modos de razonamiento bajo, medio y alto. Sin embargo, una prueba de terceros del 20 de julio (vía The New Stack) ejecutó Grok y Opus en modo Cursor Agent en tres tareas idénticas de Rust:
- Corrección de errores: Ambos pasaron las pruebas iniciales.
- Refactorización de varios archivos: Ambos la completaron, pero Opus tocó un archivo más.
- Construcción de funciones (la prueba más práctica): Ambos funcionaron, pero Opus añadió más cobertura de pruebas y escribió la entrada del man page.
Los toques adicionales de Opus importan para los cambios aceptados por dólar: un modelo más barato que necesita un bucle de reparación extra puede no ser más barato. La comunidad recomienda registrar: éxito en pruebas iniciales, rondas de reelaboración, tokens de salida, tiempo real y correcciones del revisor.
Para quién es
Cualquier persona que use Claude Code, Cursor o Grok Build para codificación agente y quiera evaluar el costo total de los cambios entregados.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

Sistema de Indicaciones de Código Claude v2.1.51/52: Nuevas Indicaciones, Actualizaciones del SDK y Funciones de Disponibilidad General
Los prompts del sistema Claude Code v2.1.51 y v2.1.52 agregan seis nuevos prompts, actualizan referencias de SDK/API en siete lenguajes y promueven la ejecución de código y memoria a GA. El SDK del Agente Python ha sido reestructurado con cambios asíncronos y nuevas interfaces.

Anthropic Aclara la Política de Uso de la CLI de Claude para la Integración de OpenClaw
Anthropic ha confirmado que el uso de Claude CLI al estilo OpenClaw está permitido nuevamente, lo que permite a los desarrolladores reutilizar directamente los inicios de sesión existentes de Claude CLI. La documentación detalla tanto los métodos de autenticación por clave API como por CLI, junto con opciones de configuración para los modelos Claude 4.6, el modo rápido y el almacenamiento en caché de prompts.

Kimi K2.7-Code: Modelo de codificación de código abierto con mejor eficiencia de tokens
Moonshot AI lanzó Kimi K2.7-Code, un modelo open-source de imagen-texto a texto con eficiencia mejorada de tokens para tareas de programación. Disponible en Hugging Face con 334 me gusta y soporte de inferencia Novita.

Investigación de Errores de ACP: Desajuste de Protocolo Provoca el Error 'metadata is missing' con Ollama Local
Un error confirmado en la integración ACP/OpenClaw impide que los comandos de generación acpx funcionen con modelos locales de Ollama debido a una incompatibilidad de protocolo donde acpx espera JSON pero recibe salida de texto.