MicroVMs de AWS Lambda: aislamiento a nivel de VM para código generado por usuario e IA, con suspensión/reanudación de hasta 8 horas

AWS anunció Lambda MicroVMs, un nuevo primitivo de computación serverless que proporciona aislamiento a nivel de VM para ejecutar código generado por el usuario o IA. Está construido sobre Firecracker, la misma tecnología de virtualización que impulsa más de 15 billones de invocaciones de funciones Lambda al mes. La propuesta de valor clave: ya no tienes que elegir entre aislamiento, velocidad de lanzamiento y retención del estado.
Características clave
- Aislamiento a nivel de VM por usuario o por tarea — cada uno obtiene su propia MicroVM, limitando el radio de explosión de código malicioso o con errores.
- Velocidad de lanzamiento y reanudación casi instantánea mediante microVMs de Firecracker.
- Conservación del estado — puedes suspender y reanudar la ejecución hasta por 8 horas.
- URL HTTPS por MicroVM compatible con HTTP/2, gRPC y WebSockets.
Cómo empezar
Crea una imagen de MicroVM a partir de tu Dockerfile, luego lanza MicroVMs desde esa imagen. Cada MicroVM obtiene una URL HTTPS dedicada para conectividad.
Casos de uso
Aplicaciones multiinquilino que ejecutan código proporcionado por usuarios finales o IA: entornos de codificación interactivos, plataformas de análisis de datos, asistentes de codificación, plataformas de escaneo de vulnerabilidades.
Precios
Pagas por los recursos de computación base mientras tu MicroVM está en ejecución, y solo por la duración activa de los recursos adicionales consumidos cuando tu carga de trabajo supera la base.
Disponibilidad
Disponible a partir del 22 de junio de 2026 en US Este (Norte de Virginia), US Este (Ohio), US Oeste (Oregón), Asia Pacífico (Tokio) y Europa (Irlanda). Accesible a través de la consola de AWS Lambda, AWS CloudFormation, AWS Cloud Development Kit o el Agent Toolkit para AWS.
📖 Lee la fuente completa: HN LLM Tools
👀 Ver también

La burbuja de la IA está estallando; simplemente aún no lo sabemos.
Los resultados del segundo trimestre de las grandes tecnológicas revelan fuertes oscilaciones en las acciones, una disminución del flujo de caja libre y una enorme inversión en IA. El podcast de The Register analiza qué significa para los equipos de TI.

Cómo conectar OpenClaw a Ollama de forma remota.
Una guía completa sobre cómo conectar OpenClaw a Ollama desde otra PC, explorando las ideas de la comunidad y pasos prácticos para una integración sin problemas.
FairyFuse logra una aceleración del kernel de 29.6x en CPUs mediante inferencia sin multiplicación de pesos ternarios
FairyFuse fusiona ocho sub-GEMVs de valor real en un único bucle AVX-512 mediante sumas/restas enmascaradas, logrando 32.4 tokens/s en Xeon 8558P y una aceleración de 1.24x respecto a llama.cpp Q4_K_M con calidad casi sin pérdidas.

Investigación sobre la Consistencia de Agentes de IA: Hallazgos Clave y Conclusiones Prácticas
Un estudio de 3.000 experimentos en Claude, GPT-4o y Llama revela que los agentes consistentes logran una precisión del 80-92%, mientras que los inconsistentes caen al 25-60%, con un 69% de divergencia ocurriendo en la primera llamada a herramienta.