Análisis: Los costos reales de cómputo de Anthropic para los usuarios de Claude Code son mucho más bajos que la cifra reportada de $5,000.

Un artículo reciente de Forbes afirmó que el plan Claude Code Max de $200/mes de Anthropic puede consumir alrededor de $5,000 en cómputo, sugiriendo que la empresa está perdiendo dinero en inferencia. Este análisis examina por qué esa cifra es engañosa.
Precios de API vs costos reales de cómputo
La cifra de $5,000 proviene de los precios minoristas de la API de Anthropic: $5 por millón de tokens de entrada y $25 por millón de tokens de salida para Opus 4.6. A estos precios, un usuario intensivo podría acumular efectivamente $5,000/mes en uso equivalente a API.
Sin embargo, los precios de la API no reflejan lo que realmente le cuesta a Anthropic servir esos tokens. Para estimar los costos reales de inferencia, observe los precios competitivos de modelos similares en OpenRouter:
- Qwen 3.5 397B-A17B (comparable a Opus 4.6): $0.39 por millón de tokens de entrada, $2.34 por millón de tokens de salida
- Kimi K2.5 1T parámetros con 32B activos: $0.45 por millón de tokens de entrada, $2.25 por millón de tokens de salida
- Lecturas de caché de DeepInfra en Kimi K2.5: $0.07/MTok vs $0.50/MTok de Anthropic
Las matemáticas reales
Estos proveedores de OpenRouter están operando negocios con márgenes, no asumiendo enormes pérdidas. Si pueden servir modelos comparables a aproximadamente el 10% del precio de la API de Anthropic, los costos reales de cómputo probablemente estén en ese rango.
Por lo tanto:
- Usuario intensivo que consume $5,000 en tokens equivalentes a API ≈ $500 en costo real de cómputo
- Pérdida en usuarios extremadamente intensivos: $300/mes (no $4,800)
- La mayoría de los usuarios no se acercan a los límites: Anthropic dice que menos del 5% de los suscriptores se verían afectados por los límites semanales
- El uso típico del plan Max 20x ronda el 50% del presupuesto semanal de tokens ≈ equilibrio o rentable para Anthropic
¿Quién enfrenta realmente costos de $5,000?
La cifra de $5,000 proviene del análisis interno de Cursor. Para Cursor, el número es aproximadamente correcto porque pagan los precios minoristas de la API de Anthropic (o cercanos a ellos) por el acceso a Opus 4.6.
Los desarrolladores quieren modelos de Anthropic en Cursor debido al reconocimiento de marca y las ventajas de rendimiento actuales sobre alternativas de peso abierto más baratas.
Implicaciones más amplias
Anthropic no es rentable en general debido a los costos de entrenamiento, salarios de investigadores y compromisos de cómputo, no por la inferencia. En una base por usuario, por token para inferencia, Anthropic probablemente sea rentable en promedio con los suscriptores de Claude Code.
La narrativa de "la inferencia de IA es un pozo sin fondo" beneficia a los laboratorios de vanguardia al desalentar la competencia y hacer que sus ventajas competitivas parezcan más profundas de lo que son.
📖 Read the full source: HN AI Agents
👀 Ver también
La reacción pública en contra de la IA es real: violencia, datos de encuestas y rendimientos decrecientes
Un ataque con cóctel molotov al CEO de OpenAI, la ira de la Generación Z sube al 31% y el 80% de las empresas no ven ganancias de productividad: la luna de miel de la IA ha terminado.

Google, Microsoft y xAI acuerdan compartir modelos tempranos de IA con el gobierno de EE. UU.
Google, Microsoft y xAI (la empresa de IA de Elon Musk) han acordado voluntariamente proporcionar acceso temprano a sus modelos de IA al gobierno de EE. UU. para pruebas de seguridad, como parte de una iniciativa informada por el Wall Street Journal.

Los frontends generados por IA convergen en patrones de diseño verde esmeralda.
Los componentes frontend generados por IA han pasado de la era anterior de gradientes púrpura a una nueva uniformidad centrada en acentos, botones y estados de hover de verde esmeralda. Esta convergencia parece estar vinculada a las habilidades de IA y a los prompts de componentes de Tailwind que asocian el esmeralda con un diseño de UI de calidad.

OpenClaw v2026.7.1: Renovación de la interfaz de control, incorporación, aplicaciones móviles, GPT-5.6, Tencent Hy3, Meta Muse Spark 1.1
OpenClaw v2026.7.1 trae una renovación importante de la interfaz de Control, un rediseño de la incorporación, aplicaciones iOS/Android/macOS actualizadas, compatibilidad con GPT-5.6, soporte para Tencent Hy3 y Meta Muse Spark 1.1, y flujos de trabajo mejorados para Codex y agentes de codificación.