Construire une plateforme d'agents IA serverless sur AWS pour 0,01 $/mois avec Claude Code

Vue d'ensemble du projet
Serverless OpenClaw est une plateforme d'agents IA serverless full-stack entièrement construite via des invites conversationnelles à Claude Code sur 29 heures réparties sur 5 semaines. La plateforme exécute l'agent IA OpenClaw à la demande sur AWS avec une interface web de chat React et un bot Telegram, déployant toute l'infrastructure avec une seule commande cdk deploy.
Détails techniques
Optimisation des coûts : Le projet a réduit les coûts mensuels d'une configuration serverless typique d'environ 70 $+ à 0,01 $/mois sur Lambda avec zéro coût d'inactivité. Les éliminations spécifiques incluent :
- NAT Gateway : -32 $/mois
- ALB (Application Load Balancer) : -18 $/mois
- Fargate toujours actif : -15 $/mois
- Interface VPC Endpoints : -7 $/mois chacun
- DynamoDB provisionné : Économies variables
Métriques de performance :
- Démarrage à froid : 1,35 s (Lambda), 0,12 s à chaud
- Coût total AWS pendant le développement : ~0,25 $
- Coût mensuel d'exécution : ~0,01 $ (Lambda)
Qualité du code :
- Tests unitaires : 233
- Tests E2E : 35
- Piles CDK : 8
- Packages TypeScript : 6 (monorepo)
Processus de développement
L'ensemble du projet a été construit sans codage manuel – uniquement des invites, des revues et des corrections de trajectoire. Claude Code a été utilisé pour :
- Conception de l'architecture : « Concevez une plateforme serverless coûtant moins de 1 $/mois » → Claude Code a produit le PRD, les piles CDK, la conception réseau
- Workflow TDD : Claude Code a écrit les tests d'abord, puis l'implémentation (233 tests avant un seul déploiement)
- Sessions de débogage : Échecs de build Docker, optimisation du démarrage à froid (68 s → 1,35 s), problèmes d'authentification WebSocket
- Migration Phase 2 : Passage de Fargate à Lambda Container Image en cours de projet, incluant la persistance de session S3 et le routage intelligent
Les invites étaient à l'origine en coréen, et Claude Code a géré le développement bilingue de manière transparente.
Stack technologique
Monorepo TypeScript (6 packages) sur AWS utilisant : CDK pour l'IaC, API Gateway (WebSocket + REST), Lambda + Fargate Spot pour le calcul, DynamoDB, S3, authentification Cognito, CloudFront + SPA React, Telegram Bot API. Support multi-LLM via Anthropic API et Amazon Bedrock.
Modèles pratiques
API Gateway au lieu d'ALB : Économise 18 $+/mois. WebSocket + REST sur API Gateway avec gestionnaires Lambda.
Structure du tutoriel
Le tutoriel « vibe coding » en 7 chapitres documente chaque invite, échec et correction :
- Chapitre 1 : Le défi du 1 $/mois (~2 h) – PRD, conception d'architecture, analyse des coûts
- Chapitre 2 : MVP en un week-end (~8 h) – Phase 1 en 10 étapes, piles CDK, TDD
- Chapitre 3 : Réalité du déploiement (~4 h) – Docker, secrets, authentification, premier déploiement réel
- Chapitre 4 : La bataille du démarrage à froid (~6 h) – Optimisation Docker, réglage CPU, préchauffage
- Chapitre 5 : Migration Lambda (~4 h) – Phase 2, agent intégré, sessions S3
- Chapitre 6 : Routage intelligent (~3 h) – Hybride Lambda/Fargate, aperçu du démarrage à froid
- Chapitre 7 : Automatisation des versions (~2 h) – Compétences, revue parallèle, versions GitHub
Chaque chapitre inclut : l'invite réelle donnée → ce que Claude Code a fait → ce qui a cassé → comment nous avons réparé → leçons apprises → commandes reproductibles.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Recommandations de configuration de LLM local pour OpenClaw
Un utilisateur partage sa configuration pour exécuter un LLM local avec OpenClaw, utilisant un GB10 pour le traitement IA et un Mac mini pour l'installation d'OpenClaw, avec des détails spécifiques sur le modèle et le serveur.

Exécuter OpenClaw avec un LLM local sur macOS – Guide pour 16 à 24 Go de RAM
Guide pratique pour configurer un modèle Qwen 3.5 quantifié avec OpenClaw sur macOS (16–24 Go de RAM), incluant une compétence de test pour la vérification.

Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable
Alexander Lebedev raconte comment il est passé de 20 à 30 PR/semaine avec un humain à plus de 150 PR/semaine avec une nuée d'agents IA, dépensant 85 000 $ en tokens depuis janvier. Principaux enseignements : classification des risques, revue IA remplaçant la revue humaine, et le défi de préserver la diffusion des connaissances.

Cartes de flux : Apprendre l'intégrale d'un modèle de diffusion pour un échantillonnage plus rapide
Sander Dieleman explique les flow maps — des réseaux de neurones qui prédisent directement l'intégrale de l'ODE d'un modèle de diffusion, permettant un échantillonnage plus rapide, un apprentissage basé sur les récompenses et une orientabilité.