Grok 4.5 vs Claude Code: Cambios Aceptados por Dólar es el Verdadero Punto de Referencia

✍️ OpenClawRadar📅 Publicado: 23 de julio de 2026🔗 Source
Ad

El lanzamiento de Grok 4.5 de xAI (53% en DeepSWE 1.1 vs 59% de Opus 4.8, 29.0% pass@1 en SWE Marathon vs 26.0%, 80 tokens/segundo a $2/M de entrada, $6/M de salida) merece tratarse como una comparación práctica con Claude Code, no solo como otra afirmación en un ranking. La métrica adecuada para los desarrolladores que usan agentes de codificación de IA son los cambios aceptados por dólar con el mismo repositorio, prompt, permisos de herramientas, comando de prueba, tiempo de espera y criterio de revisión.

Ad

Detalles clave

Grok 4.5 está disponible en Grok Build, Cursor y a través de API. Admite modos de razonamiento bajo, medio y alto. Sin embargo, una prueba de terceros del 20 de julio (vía The New Stack) ejecutó Grok y Opus en modo Cursor Agent en tres tareas idénticas de Rust:

  • Corrección de errores: Ambos pasaron las pruebas iniciales.
  • Refactorización de varios archivos: Ambos la completaron, pero Opus tocó un archivo más.
  • Construcción de funciones (la prueba más práctica): Ambos funcionaron, pero Opus añadió más cobertura de pruebas y escribió la entrada del man page.

Los toques adicionales de Opus importan para los cambios aceptados por dólar: un modelo más barato que necesita un bucle de reparación extra puede no ser más barato. La comunidad recomienda registrar: éxito en pruebas iniciales, rondas de reelaboración, tokens de salida, tiempo real y correcciones del revisor.

Para quién es

Cualquier persona que use Claude Code, Cursor o Grok Build para codificación agente y quiera evaluar el costo total de los cambios entregados.

📖 Lee la fuente completa: r/ClaudeAI

Ad

👀 Ver también

Protocolo de Convergencia Quumble v5: Resultados del Experimento de LLM de Arquitectura Cruzada
Noticias

Protocolo de Convergencia Quumble v5: Resultados del Experimento de LLM de Arquitectura Cruzada

El Protocolo de Convergencia Quumble v5 prueba si instancias independientes de LLM convergen en descripciones de criaturas imaginarias cuando se les dan palabras sin sentido. Los resultados muestran que tanto Claude (Opus 4.6 y Sonnet 4.6) como GPT-5.3 produjeron de forma independiente una criatura pequeña, redonda, suave, de tono lavanda, bioluminiscente y que zumba a partir de la palabra 'quumble'.

OpenClawRadar
Los cambios en el límite de tasa de Slack interrumpen la recuperación de contexto de OpenClaw
Noticias

Los cambios en el límite de tasa de Slack interrumpen la recuperación de contexto de OpenClaw

Slack cambió los límites de tasa el 3 de marzo, restringiendo conversations.history y conversations.replies a 1 solicitud por minuto con un máximo de 15 mensajes para aplicaciones no pertenecientes al Marketplace. Esto hace que los agentes de OpenClaw pierdan el 85% de su ventana de contexto.

OpenClawRadar
Cuando Todos Tienen IA pero la Empresa Aún No Aprende Nada: El Desordenado Camino Medio de la Adopción de IA Empresarial
Noticias

Cuando Todos Tienen IA pero la Empresa Aún No Aprende Nada: El Desordenado Camino Medio de la Adopción de IA Empresarial

El marco de trabajo de Ethan Mollick muestra que los aumentos de productividad individual con IA no se convierten automáticamente en aprendizaje organizacional. El artículo explora por qué las empresas están atrapadas en un 'punto medio desordenado' donde el uso de la IA es desigual, oculto y desconectado del conocimiento compartido.

OpenClawRadar
🦀
Noticias

Perspectiva de un diseñador UX: El diseño de Claude no puede reemplazar a los diseñadores experimentados

Un diseñador UX sostiene que Claude Design está sobrevalorado y solo es útil para que no diseñadores prototipen ideas, startups en etapas tempranas y trabajos de portafolio de nivel inicial.

OpenClawRadar