Économie des vidéos Sora IA : 20 $ pour l'utilisateur coûtent 65 $ en calcul à OpenAI

Économie unitaire de Sora
Selon l'analyse de l'application de génération de vidéos IA Sora d'OpenAI, chaque abonné à 20 $/mois générant 50 vidéos coûte environ 65 $ en calcul à OpenAI. Plus les utilisateurs interagissent avec le produit, plus vite il perd de l'argent.
Détail des coûts
- Coûts de calcul de pointe : 15 millions de dollars par jour (estimation des analystes)
- Revenus totaux sur toute la durée de vie : 2,1 millions de dollars sur toutes les plateformes en six mois
- Estimation prudente : ~1 million de dollars de taux de brûlage net quotidien après limitation et optimisation
- Ratio de coût : Générer une vidéo IA de 10 secondes coûte environ 160 fois plus qu'une génération de texte équivalente
Détails techniques
Chaque vidéo de 10 secondes coûte environ 1,30 $ en calcul GPU, nécessitant approximativement 40 minutes de temps GPU total réparti sur 4 H100 en parallèle. En utilisation de pointe, avec 25 % des 4,5 millions d'utilisateurs cumulés de Sora publiant 10 vidéos par jour, cela a donné 11,3 millions de vidéos par jour à 1,30 $ chacune.
Le problème structurel de coût découle des exigences de calcul de la vidéo : une vidéo 720p de 10 secondes nécessite le traitement d'environ 80 000 petits fragments de pixels dans l'espace et le temps, contre quelques centaines de tokens pour les invites typiques de ChatGPT. Les besoins en calcul augmentent avec le carré du nombre de fragments - doubler la résolution quadruple le coût.
Contexte du marché
Aucune entreprise de vidéo IA n'a prouvé sa rentabilité nette selon l'analyse. Runway a déclaré un EBITDA de -155 M$, Pika avait 7,6 M$ de revenus sur 80 M$ levés, et bien que Kling ait rapporté 240 M$ de revenus annuels récurrents, ils n'ont pas publié de données de profit. Sora a montré une rétention de 1 % au jour 30 contre 32 % pour TikTok, les utilisateurs générant généralement des vidéos, les regardant une fois et ne revenant pas.
📖 Lire la source complète : HN LLM Tools
👀 See Also

Claude surpasse Gemini, ChatGPT et Grok dans un défi de codage Python en temps réel.
Un développeur a testé Claude, Gemini, ChatGPT et Grok dans un tournoi de programmation Python en temps réel où des bots générés par IA se sont affrontés pour trouver des mots sur une grille de lettres de 15×15. Claude a remporté une victoire décisive.

Qwen 3.6 27B testé sur DeepSWE : score de 2 %, 70 heures, 44k jetons de sortie en moyenne
Qwen 3.6 27B (FP8, cache KV BF16, contexte 262k) a obtenu 2% sur DeepSWE en 70 heures. Les tokens de sortie ont atteint en moyenne 44k par tâche — comparable à des modèles plus grands comme Qwen 3.6 Plus. Exécuté sur 1x RTX6000 Pro Blackwell via RunPod.

Du Prompting à l'Ingénierie des Spécifications : Le Changement d'Architecture Planificateur-Exécutant
Le développement de l'IA évolue des invites simples basées sur le chat vers une architecture planificateur-exécutant où les humains agissent comme des ingénieurs de spécifications. Cela nécessite de définir des critères d'acceptation stricts, une architecture de contraintes et des modèles de décomposition pour les agents d'IA autonomes.

Erreurs élevées sur Claude Opus 4.7 : Mise à jour et à quoi s'attendre
Claude Opus 4.7 rencontre actuellement des erreurs élevées depuis le 2026-05-19T15:21Z. Consultez status.claude.com pour l'avancement et les résolutions.