La Inferencia de IA es Obviamente Rentable: Desglosando la Economía

✍️ OpenClawRadar📅 Publicado: 4 de julio de 2026🔗 Source
La Inferencia de IA es Obviamente Rentable: Desglosando la Economía
Ad

Sean Goedecke argumenta que la inferencia de IA es obviamente rentable, contrario a las afirmaciones de que está subsidiada por capital de riesgo. Desglosa las matemáticas y los precios de modelos abiertos para mostrar que servir LLMs puede ser un negocio sostenible.

Desglose de costos para un modelo denso de 70B

Usando cuatro GPUs Nvidia A100 (400W cada una, ~2M tokens/hora):

  • Energía: ~13¢/hora a tarifas industriales, más ~13¢/hora de refrigeración → 26¢/hora en total
  • Amortización de GPU: $20k por A100 en 5 años → $16k/año o $1.80/hora
  • Total: aproximadamente $1 por millón de tokens de salida

OpenAI cobra $4.50 por millón de tokens con GPT-5.4-mini, y los modelos más potentes son de 3 a 6 veces más caros. Esto hace que el margen bruto del 70-80% sea plausible.

Ad

Los modelos abiertos confirman la rentabilidad

DeepSeek afirma un margen superior al 80% en inferencia de R1 mientras cobra menos de la mitad que OpenAI/Anthropic. Su API DeepSeek-V4-Pro cuesta alrededor de 87¢ por millón de tokens de salida, cerca del costo real, lo que sugiere que los márgenes para los modelos de frontera son aún mayores.

Por qué existen márgenes altos

Los laboratorios de IA como OpenAI y Anthropic necesitan las ganancias de inferencia para subsidiar los costos de entrenamiento, por lo que mantienen los precios de API altos. Pero un proveedor solo de inferencia, sin costos de entrenamiento, podría obtener ganancias incluso a precios más bajos. Incluso si los laboratorios de frontera quiebran, quien adquiera los derechos de sus modelos puede seguir vendiendo inferencia de manera rentable.

📖 Leer la fuente completa: HN AI Agents

Ad

👀 Ver también

Deja de dejar que los agentes de IA diseñen tu arquitectura
Noticias

Deja de dejar que los agentes de IA diseñen tu arquitectura

Agentes de IA como Claude son patológicamente complacientes, produciendo arquitecturas plausibles pero sin contexto. No pueden decir que no, desconocen las limitaciones de tu equipo y convierten a ingenieros seniors en implementadores de tickets.

OpenClawRadar
Altman y Amodei retroceden en sus predicciones de apocalipsis laboral por IA antes de las OPI
Noticias

Altman y Amodei retroceden en sus predicciones de apocalipsis laboral por IA antes de las OPI

Sam Altman, de OpenAI, y Dario Amodei, de Anthropic, ahora admiten que se equivocaron al afirmar que la IA eliminaría empleos administrativos, mientras ambas empresas apuntan a salidas a bolsa de 1 billón de dólares. El CEO de Goldman Sachs, David Solomon, dice que siempre tuvo razón.

OpenClawRadar
El Claude de Anthropic Realiza 80,000 Entrevistas Estructuradas como Alternativa a las Encuestas
Noticias

El Claude de Anthropic Realiza 80,000 Entrevistas Estructuradas como Alternativa a las Encuestas

Anthropic utilizó a Claude para realizar entrevistas estructuradas con aproximadamente 80,000 usuarios en más de 150 países y 70+ idiomas, con el LLM sirviendo tanto como entrevistador como analista para recopilar información conversacional.

OpenClawRadar
Normalización de la desviación en la IA: Por qué fallará tu sistema agentivo
Noticias

Normalización de la desviación en la IA: Por qué fallará tu sistema agentivo

La industria de la IA repite fallos culturales como el del Challenger: tratar las salidas no fiables de los LLM como seguras porque aún no ha ocurrido nada malo. Ejemplos reales de agentes formateando discos duros, borrando bases de datos y creando issues en GitHub.

OpenClawRadar