Construire une plateforme d'agents IA serverless sur AWS pour 0,01 $/mois avec Claude Code

✍️ OpenClawRadar📅 Publié: March 29, 2026🔗 Source
Construire une plateforme d'agents IA serverless sur AWS pour 0,01 $/mois avec Claude Code
Ad

Vue d'ensemble du projet

Serverless OpenClaw est une plateforme d'agents IA serverless full-stack entièrement construite via des invites conversationnelles à Claude Code sur 29 heures réparties sur 5 semaines. La plateforme exécute l'agent IA OpenClaw à la demande sur AWS avec une interface web de chat React et un bot Telegram, déployant toute l'infrastructure avec une seule commande cdk deploy.

Détails techniques

Optimisation des coûts : Le projet a réduit les coûts mensuels d'une configuration serverless typique d'environ 70 $+ à 0,01 $/mois sur Lambda avec zéro coût d'inactivité. Les éliminations spécifiques incluent :

  • NAT Gateway : -32 $/mois
  • ALB (Application Load Balancer) : -18 $/mois
  • Fargate toujours actif : -15 $/mois
  • Interface VPC Endpoints : -7 $/mois chacun
  • DynamoDB provisionné : Économies variables

Métriques de performance :

  • Démarrage à froid : 1,35 s (Lambda), 0,12 s à chaud
  • Coût total AWS pendant le développement : ~0,25 $
  • Coût mensuel d'exécution : ~0,01 $ (Lambda)

Qualité du code :

  • Tests unitaires : 233
  • Tests E2E : 35
  • Piles CDK : 8
  • Packages TypeScript : 6 (monorepo)

Processus de développement

L'ensemble du projet a été construit sans codage manuel – uniquement des invites, des revues et des corrections de trajectoire. Claude Code a été utilisé pour :

  • Conception de l'architecture : « Concevez une plateforme serverless coûtant moins de 1 $/mois » → Claude Code a produit le PRD, les piles CDK, la conception réseau
  • Workflow TDD : Claude Code a écrit les tests d'abord, puis l'implémentation (233 tests avant un seul déploiement)
  • Sessions de débogage : Échecs de build Docker, optimisation du démarrage à froid (68 s → 1,35 s), problèmes d'authentification WebSocket
  • Migration Phase 2 : Passage de Fargate à Lambda Container Image en cours de projet, incluant la persistance de session S3 et le routage intelligent

Les invites étaient à l'origine en coréen, et Claude Code a géré le développement bilingue de manière transparente.

Ad

Stack technologique

Monorepo TypeScript (6 packages) sur AWS utilisant : CDK pour l'IaC, API Gateway (WebSocket + REST), Lambda + Fargate Spot pour le calcul, DynamoDB, S3, authentification Cognito, CloudFront + SPA React, Telegram Bot API. Support multi-LLM via Anthropic API et Amazon Bedrock.

Modèles pratiques

API Gateway au lieu d'ALB : Économise 18 $+/mois. WebSocket + REST sur API Gateway avec gestionnaires Lambda.

Structure du tutoriel

Le tutoriel « vibe coding » en 7 chapitres documente chaque invite, échec et correction :

  • Chapitre 1 : Le défi du 1 $/mois (~2 h) – PRD, conception d'architecture, analyse des coûts
  • Chapitre 2 : MVP en un week-end (~8 h) – Phase 1 en 10 étapes, piles CDK, TDD
  • Chapitre 3 : Réalité du déploiement (~4 h) – Docker, secrets, authentification, premier déploiement réel
  • Chapitre 4 : La bataille du démarrage à froid (~6 h) – Optimisation Docker, réglage CPU, préchauffage
  • Chapitre 5 : Migration Lambda (~4 h) – Phase 2, agent intégré, sessions S3
  • Chapitre 6 : Routage intelligent (~3 h) – Hybride Lambda/Fargate, aperçu du démarrage à froid
  • Chapitre 7 : Automatisation des versions (~2 h) – Compétences, revue parallèle, versions GitHub

Chaque chapitre inclut : l'invite réelle donnée → ce que Claude Code a fait → ce qui a cassé → comment nous avons réparé → leçons apprises → commandes reproductibles.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Recommandations de configuration de LLM local pour OpenClaw
Guides

Recommandations de configuration de LLM local pour OpenClaw

Un utilisateur partage sa configuration pour exécuter un LLM local avec OpenClaw, utilisant un GB10 pour le traitement IA et un Mac mini pour l'installation d'OpenClaw, avec des détails spécifiques sur le modèle et le serveur.

OpenClawRadar
Exécuter OpenClaw avec un LLM local sur macOS – Guide pour 16 à 24 Go de RAM
Guides

Exécuter OpenClaw avec un LLM local sur macOS – Guide pour 16 à 24 Go de RAM

Guide pratique pour configurer un modèle Qwen 3.5 quantifié avec OpenClaw sur macOS (16–24 Go de RAM), incluant une compétence de test pour la vérification.

OpenClawRadar
Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable
Guides

Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable

Alexander Lebedev raconte comment il est passé de 20 à 30 PR/semaine avec un humain à plus de 150 PR/semaine avec une nuée d'agents IA, dépensant 85 000 $ en tokens depuis janvier. Principaux enseignements : classification des risques, revue IA remplaçant la revue humaine, et le défi de préserver la diffusion des connaissances.

OpenClawRadar
Cartes de flux : Apprendre l'intégrale d'un modèle de diffusion pour un échantillonnage plus rapide
Guides

Cartes de flux : Apprendre l'intégrale d'un modèle de diffusion pour un échantillonnage plus rapide

Sander Dieleman explique les flow maps — des réseaux de neurones qui prédisent directement l'intégrale de l'ODE d'un modèle de diffusion, permettant un échantillonnage plus rapide, un apprentissage basé sur les récompenses et une orientabilité.

OpenClawRadar