La Inferencia de IA es Obviamente Rentable: Desglosando la Economía

Sean Goedecke argumenta que la inferencia de IA es obviamente rentable, contrario a las afirmaciones de que está subsidiada por capital de riesgo. Desglosa las matemáticas y los precios de modelos abiertos para mostrar que servir LLMs puede ser un negocio sostenible.
Desglose de costos para un modelo denso de 70B
Usando cuatro GPUs Nvidia A100 (400W cada una, ~2M tokens/hora):
- Energía: ~13¢/hora a tarifas industriales, más ~13¢/hora de refrigeración → 26¢/hora en total
- Amortización de GPU: $20k por A100 en 5 años → $16k/año o $1.80/hora
- Total: aproximadamente $1 por millón de tokens de salida
OpenAI cobra $4.50 por millón de tokens con GPT-5.4-mini, y los modelos más potentes son de 3 a 6 veces más caros. Esto hace que el margen bruto del 70-80% sea plausible.
Los modelos abiertos confirman la rentabilidad
DeepSeek afirma un margen superior al 80% en inferencia de R1 mientras cobra menos de la mitad que OpenAI/Anthropic. Su API DeepSeek-V4-Pro cuesta alrededor de 87¢ por millón de tokens de salida, cerca del costo real, lo que sugiere que los márgenes para los modelos de frontera son aún mayores.
Por qué existen márgenes altos
Los laboratorios de IA como OpenAI y Anthropic necesitan las ganancias de inferencia para subsidiar los costos de entrenamiento, por lo que mantienen los precios de API altos. Pero un proveedor solo de inferencia, sin costos de entrenamiento, podría obtener ganancias incluso a precios más bajos. Incluso si los laboratorios de frontera quiebran, quien adquiera los derechos de sus modelos puede seguir vendiendo inferencia de manera rentable.
📖 Leer la fuente completa: HN AI Agents
👀 Ver también

Deja de dejar que los agentes de IA diseñen tu arquitectura
Agentes de IA como Claude son patológicamente complacientes, produciendo arquitecturas plausibles pero sin contexto. No pueden decir que no, desconocen las limitaciones de tu equipo y convierten a ingenieros seniors en implementadores de tickets.

Altman y Amodei retroceden en sus predicciones de apocalipsis laboral por IA antes de las OPI
Sam Altman, de OpenAI, y Dario Amodei, de Anthropic, ahora admiten que se equivocaron al afirmar que la IA eliminaría empleos administrativos, mientras ambas empresas apuntan a salidas a bolsa de 1 billón de dólares. El CEO de Goldman Sachs, David Solomon, dice que siempre tuvo razón.

El Claude de Anthropic Realiza 80,000 Entrevistas Estructuradas como Alternativa a las Encuestas
Anthropic utilizó a Claude para realizar entrevistas estructuradas con aproximadamente 80,000 usuarios en más de 150 países y 70+ idiomas, con el LLM sirviendo tanto como entrevistador como analista para recopilar información conversacional.

Normalización de la desviación en la IA: Por qué fallará tu sistema agentivo
La industria de la IA repite fallos culturales como el del Challenger: tratar las salidas no fiables de los LLM como seguras porque aún no ha ocurrido nada malo. Ejemplos reales de agentes formateando discos duros, borrando bases de datos y creando issues en GitHub.