Análisis: Los costos reales de cómputo de Anthropic para los usuarios de Claude Code son mucho más bajos que la cifra reportada de $5,000.

Un artículo reciente de Forbes afirmó que el plan Claude Code Max de $200/mes de Anthropic puede consumir alrededor de $5,000 en cómputo, sugiriendo que la empresa está perdiendo dinero en inferencia. Este análisis examina por qué esa cifra es engañosa.
Precios de API vs costos reales de cómputo
La cifra de $5,000 proviene de los precios minoristas de la API de Anthropic: $5 por millón de tokens de entrada y $25 por millón de tokens de salida para Opus 4.6. A estos precios, un usuario intensivo podría acumular efectivamente $5,000/mes en uso equivalente a API.
Sin embargo, los precios de la API no reflejan lo que realmente le cuesta a Anthropic servir esos tokens. Para estimar los costos reales de inferencia, observe los precios competitivos de modelos similares en OpenRouter:
- Qwen 3.5 397B-A17B (comparable a Opus 4.6): $0.39 por millón de tokens de entrada, $2.34 por millón de tokens de salida
- Kimi K2.5 1T parámetros con 32B activos: $0.45 por millón de tokens de entrada, $2.25 por millón de tokens de salida
- Lecturas de caché de DeepInfra en Kimi K2.5: $0.07/MTok vs $0.50/MTok de Anthropic
Las matemáticas reales
Estos proveedores de OpenRouter están operando negocios con márgenes, no asumiendo enormes pérdidas. Si pueden servir modelos comparables a aproximadamente el 10% del precio de la API de Anthropic, los costos reales de cómputo probablemente estén en ese rango.
Por lo tanto:
- Usuario intensivo que consume $5,000 en tokens equivalentes a API ≈ $500 en costo real de cómputo
- Pérdida en usuarios extremadamente intensivos: $300/mes (no $4,800)
- La mayoría de los usuarios no se acercan a los límites: Anthropic dice que menos del 5% de los suscriptores se verían afectados por los límites semanales
- El uso típico del plan Max 20x ronda el 50% del presupuesto semanal de tokens ≈ equilibrio o rentable para Anthropic
¿Quién enfrenta realmente costos de $5,000?
La cifra de $5,000 proviene del análisis interno de Cursor. Para Cursor, el número es aproximadamente correcto porque pagan los precios minoristas de la API de Anthropic (o cercanos a ellos) por el acceso a Opus 4.6.
Los desarrolladores quieren modelos de Anthropic en Cursor debido al reconocimiento de marca y las ventajas de rendimiento actuales sobre alternativas de peso abierto más baratas.
Implicaciones más amplias
Anthropic no es rentable en general debido a los costos de entrenamiento, salarios de investigadores y compromisos de cómputo, no por la inferencia. En una base por usuario, por token para inferencia, Anthropic probablemente sea rentable en promedio con los suscriptores de Claude Code.
La narrativa de "la inferencia de IA es un pozo sin fondo" beneficia a los laboratorios de vanguardia al desalentar la competencia y hacer que sus ventajas competitivas parezcan más profundas de lo que son.
📖 Read the full source: HN AI Agents
👀 Ver también

La actualización automática de Cron rompió OpenClaw debido a un error de validación de configuración.
Un trabajo cron configurado para actualizar automáticamente OpenClaw encontró un problema de validación de configuración con el campo cliBackends, causando pérdida de conexión. La solución implicó eliminar la sección problemática y reiniciar la puerta de enlace.

Qwen 3 8B supera a modelos más grandes en evaluaciones ciegas por pares en tareas difíciles.
En una evaluación ciega por pares de 10 modelos de lenguaje pequeños en 13 tareas difíciles de nivel frontera, Qwen 3 8B ganó 6 evaluaciones y se ubicó entre los 3 primeros en 12 de las 13 tareas, superando a modelos con hasta 4 veces su cantidad de parámetros. La evaluación cubrió depuración de bloqueos distribuidos, errores de concurrencia en Go, optimización SQL, diagnóstico médico bayesiano, la paradoja de Simpson, el teorema de votación de Arrow y análisis de sesgo de supervivencia.

Anthropic retrasa los cambios en los límites de tasa de la API de Claude Code
Anthropic ha retrasado la prohibición del SDK de Claude Agent y de claude -p de los límites de tarifa de suscripción. El plazo original del 15 de junio se ha pospuesto para actualizaciones del plan.

Claude duplica los límites de uso fuera de las horas pico durante dos semanas
Anthropic está duplicando temporalmente los límites de uso de Claude fuera de las horas pico para todos los planes. Los días de semana fuera de las 5–11 a. m. PT/12–6 p. m. GMT obtienen 2x de uso, y los fines de semana tienen 2x de uso todo el día.