Na IA, os 41% Dependem dos -59%

O economista-chefe da Apollo, Torsten Slok, publicou uma nota repleta de gráficos detalhando as margens de lucro da IA por camada da cadeia de valor. A manchete: as margens de lucro estão invertidas na IA — quanto mais perto do usuário final, mais dinheiro você perde.
Os números
- Silício & Equipamentos (Nvidia, AMD, Broadcom, TSMC, SK Hynix, Micron, etc.): +41% de margem média
- Energia & Rede (Constellation Energy, Vistra, NextEra, Vertiv, Eaton): +17%
- Computação & Nuvem (AWS, Azure, Google Cloud, CoreWeave, Super Micro, Dell): +10%
- Modelos & Aplicações (OpenAI, Anthropic): -59%
Essas são médias ponderadas igualmente da Bloomberg, PitchBook e Financial Times (estimativas do 2º trimestre de 2026 para OpenAI e Anthropic).
A dependência
A principal percepção: as margens de 41% no topo não estão sendo pagas pela receita do cliente final. OpenAI e Anthropic estão queimando capital a uma taxa impressionante, e esse capital — não a demanda do cliente — é o que financia as compras de GPU, aluguéis de data centers e contratos de energia que fluem para montante.
Em um negócio normal, o lucro flui da entidade que possui o relacionamento com o cliente. Na IA, o poder de precificação está na camada de semicondutores e infraestrutura, mas esses lucros são, em última análise, subsidiados por investidores que apostam em retornos futuros da camada de modelos.
A conclusão de Slok: "A parte mais lucrativa da cadeia de valor da IA depende da parte menos lucrativa continuar crescendo receita ou levantando capital."
O capital pode preencher a lacuna "por um tempo, mas não indefinidamente". O risco, segundo ele, é se o ROI aparecerá para os clientes finais da IA rápido o suficiente para sustentar os gastos que estão gerando essas margens a montante.
Para engenheiros de IA, esta é uma lente macro útil sobre a fragilidade da indústria. As ferramentas que você constrói sobre modelos de ponta são tão estáveis quanto o financiamento de capital de risco que mantém esses provedores de modelos vivos. Se a OpenAI ou a Anthropic não encontrarem ROI em seus produtos voltados ao cliente, toda a cadeia de suprimentos a montante se redefine.
Vale a pena ler a nota original para o gráfico completo e as fontes de dados.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Teste de Raciocínio Espacial de LLM: Benchmark Sokoban Mostra ChatGPT, Qwen3.7-max, Gemini 3.5-thinking na Liderança
Um benchmark personalizado de Sokoban testou o raciocínio espacial zero-shot em LLMs com formatação rigorosa. Apenas ChatGPT, Qwen3.7-max e Gemini 3.5-thinking passaram. Modelos como Gemini 3.5-flash e Qwen3.7-plus falharam devido a movimentos ilegais ou deadlocks.

Revelada a Montagem e Estrutura do Prompt do Sistema Claude Code
Um vazamento de mapa de origem no pacote npm do Claude Code expôs o fluxo de montagem do prompt do sistema, mostrando seções de prefixo estático seguidas por conteúdo dinâmico específico da sessão, com três variantes de identidade e diretrizes de execução detalhadas.

Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA
O desenvolvedor DJLougen lançou o Harmonic-9B, um fine-tune do Qwen3.5-9B otimizado para uso em agentes com uma abordagem de treinamento em duas etapas. A Etapa 1 (raciocínio pesado) está completa, enquanto a Etapa 2 (chamada leve de ferramentas) ainda está em treinamento. Versões quantizadas GGUF já estão disponíveis.

Claude Code v2.1.218 Corrige /code-review, Autenticação MCP, Corrupção de Caminho no Windows
Claude Code v2.1.218 traz /code-review como subagente em segundo plano, corrige corrupção de caminhos no Windows com prefixo \u, melhora suporte a leitores de tela e corrige contagem excessiva na autenticação MCP.