Construyendo una plataforma de agentes de IA sin servidor en AWS por $0.01/mes con Claude Code

✍️ OpenClawRadar📅 Publicado: 29 de marzo de 2026🔗 Source
Construyendo una plataforma de agentes de IA sin servidor en AWS por $0.01/mes con Claude Code
Ad

Resumen del Proyecto

Serverless OpenClaw es una plataforma completa de agentes de IA serverless construida enteramente mediante prompts conversacionales a Claude Code durante 29 horas distribuidas en 5 semanas. La plataforma ejecuta el agente de IA OpenClaw bajo demanda en AWS con una interfaz de chat web en React y un bot de Telegram, desplegando toda la infraestructura con un solo comando cdk deploy.

Detalles Técnicos

Optimización de Costos: El proyecto redujo los costos mensuales de una configuración serverless típica de ~$70+ a $0.01/mes en Lambda con cero costos de inactividad. Eliminaciones específicas incluyen:

  • NAT Gateway: -$32/mes
  • ALB (Application Load Balancer): -$18/mes
  • Fargate siempre activo: -$15/mes
  • Puntos de Terminación VPC de Interfaz: -$7/mes cada uno
  • DynamoDB aprovisionado: Ahorros variables

Métricas de Rendimiento:

  • Arranque en frío: 1.35s (Lambda), 0.12s caliente
  • Costo total de AWS durante el desarrollo: ~$0.25
  • Costo mensual de ejecución: ~$0.01 (Lambda)

Calidad del Código:

  • Pruebas unitarias: 233
  • Pruebas E2E: 35
  • Stacks CDK: 8
  • Paquetes TypeScript: 6 (monorepo)

Proceso de Desarrollo

Todo el proyecto fue construido sin codificación manual—solo prompts, revisiones y correcciones de curso. Claude Code fue utilizado para:

  • Diseño de arquitectura: "Diseña una plataforma serverless que cueste menos de $1/mes" → Claude Code produjo el PRD, stacks CDK, diseño de red
  • Flujo de trabajo TDD: Claude Code escribió las pruebas primero, luego la implementación (233 pruebas antes de un solo despliegue)
  • Sesiones de depuración: Fallos en la construcción de Docker, optimización de arranque en frío (68s → 1.35s), problemas de autenticación WebSocket
  • Migración de Fase 2: Movimiento de Fargate a Lambda Container Image a mitad del proyecto, incluyendo persistencia de sesiones S3 y enrutamiento inteligente

Los prompts estaban originalmente en coreano, y Claude Code manejó el desarrollo bilingüe sin problemas.

Ad

Tecnologías Utilizadas

Monorepo TypeScript (6 paquetes) en AWS usando: CDK para IaC, API Gateway (WebSocket + REST), Lambda + Fargate Spot para cómputo, DynamoDB, S3, autenticación Cognito, CloudFront + React SPA, Telegram Bot API. Soporte multi-LLM mediante Anthropic API y Amazon Bedrock.

Patrones Prácticos

API Gateway en lugar de ALB: Ahorra $18+/mes. WebSocket + REST en API Gateway con manejadores Lambda.

Estructura del Tutorial

El tutorial de 7 capítulos de "vibe coding" documenta cada prompt, fallo y solución:

  • Capítulo 1: El Desafío de $1/Mes (~2h) - PRD, diseño de arquitectura, análisis de costos
  • Capítulo 2: MVP en un Fin de Semana (~8h) - Fase 1 de 10 pasos, stacks CDK, TDD
  • Capítulo 3: Verificación de la Realidad del Despliegue (~4h) - Docker, secretos, autenticación, primer despliegue real
  • Capítulo 4: La Batalla del Arranque en Frío (~6h) - Optimización de Docker, ajuste de CPU, precalentamiento
  • Capítulo 5: Migración a Lambda (~4h) - Fase 2, agente embebido, sesiones S3
  • Capítulo 6: Enrutamiento Inteligente (~3h) - Híbrido Lambda/Fargate, vista previa de arranque en frío
  • Capítulo 7: Automatización de Lanzamiento (~2h) - Habilidades, revisión paralela, lanzamientos en GitHub

Cada capítulo incluye: el prompt real dado → lo que hizo Claude Code → lo que falló → cómo lo arreglamos → lecciones aprendidas → comandos reproducibles.

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

Cómo ejecutar de forma segura las herramientas nativas de llama.cpp (exec_shell_command) con múltiples sandboxes en Linux
Guías

Cómo ejecutar de forma segura las herramientas nativas de llama.cpp (exec_shell_command) con múltiples sandboxes en Linux

Guía práctica para habilitar las herramientas nativas de llama.cpp, especialmente exec_shell_command, y ejecutarlas dentro de múltiples sandboxes (Firejail + máquina virtual Alpine) para obtener contenido web y ejecutar comandos de forma segura desde la interfaz web de llama-server.

OpenClawRadar
OpenClaw Ollama Cloud: Solución de tres capas para modelos faltantes y el error de eliminación del doctor
Guías

OpenClaw Ollama Cloud: Solución de tres capas para modelos faltantes y el error de eliminación del doctor

Una instalación limpia de OpenClaw con modelos Ollama Cloud falló: solo kimi-k2.5 funcionó, las configuraciones desaparecieron. Causa raíz: lista de proveedores faltante, campo name requerido, y 'openclaw doctor --fix' borra tu bloque de proveedor.

OpenClawRadar
Patrones de Fallas de OpenClaw: 42 Incidentes Reales en 28 Días
Guías

Patrones de Fallas de OpenClaw: 42 Incidentes Reales en 28 Días

Un desarrollador que ejecutaba OpenClaw diariamente documentó 42 fallos específicos en ocho categorías, incluyendo alucinaciones de IA, fallos de autenticación y automatizaciones que consumen más tiempo del que ahorran. La fuente proporciona ejemplos concretos como la expiración de tokens OAuth de Google a los 7 días y Opus 4.6 añadiendo metadatos no deseados a los archivos.

OpenClawRadar
Flujo de trabajo de Claude Code Visual: Jerarquía de memoria, habilidades, ganchos y bucle
Guías

Flujo de trabajo de Claude Code Visual: Jerarquía de memoria, habilidades, ganchos y bucle

Una publicación de Reddit comparte un flujo de trabajo visual para Claude Code que cubre la estratificación de memoria de CLAUDE.md (global → repositorio → ámbito), las habilidades como patrones reutilizables en .claude/skills/ y un bucle de flujo de trabajo sugerido (planificar → describir → aceptar → commit).

OpenClawRadar