AWS Lambda MicroVMs: VM-Isolierung für Benutzer- und KI-generierten Code mit Suspend/Resume bis zu 8 Stunden

AWS hat Lambda MicroVMs angekündigt, eine neue serverlose Compute-Primitive, die VM-Isolation für die Ausführung von Benutzer- oder KI-generiertem Code bietet. Es basiert auf Firecracker, derselben Virtualisierungstechnologie, die über 15 Billionen monatliche Lambda-Funktionsaufrufe unterstützt. Das zentrale Wertversprechen: Sie müssen nicht mehr zwischen Isolation, Startgeschwindigkeit und Zustandsbeibehaltung wählen.
Wichtige Funktionen
- VM-Isolation pro Benutzer oder pro Auftrag – jeder erhält eine eigene MicroVM, was den Schadensbereich durch bösartigen oder fehlerhaften Code begrenzt.
- Nahezu sofortiger Start und Resume über Firecracker-MicroVMs.
- Zustandsspeicherung – Sie können die Ausführung für bis zu 8 Stunden anhalten und fortsetzen.
- HTTPS-URL pro MicroVM mit Unterstützung für HTTP/2, gRPC und WebSockets.
Erste Schritte
Erstellen Sie ein MicroVM-Image aus Ihrem Dockerfile und starten Sie dann MicroVMs aus diesem Image. Jede MicroVM erhält eine dedizierte HTTPS-URL für die Konnektivität.
Anwendungsfälle
Multi-Tenant-Anwendungen, die von Endbenutzern oder KI bereitgestellten Code ausführen: interaktive Programmierumgebungen, Datenanalyseplattformen, Programmierassistenten, Schwachstellen-Scanning-Plattformen.
Preise
Sie zahlen für die Basis-Compute-Ressourcen, solange Ihre MicroVM läuft, und nur für die aktive Nutzungsdauer zusätzlicher Ressourcen, die verbraucht werden, wenn Ihre Arbeitslast die Basis überschreitet.
Verfügbarkeit
Verfügbar ab 22. Juni 2026 in USA Ost (Nord-Virginia), USA Ost (Ohio), USA West (Oregon), Asien-Pazifik (Tokio) und Europa (Irland). Zugänglich über AWS Lambda-Konsole, AWS CloudFormation, AWS Cloud Development Kit oder das Agent Toolkit for AWS.
📖 Vollständige Quelle lesen: HN LLM Tools
👀 Siehe auch

Anthropic verdoppelt Claude Code-Ratenlimits, schließt Compute-Deal mit SpaceX
Claude Code-Fünf-Stunden-Limits für Pro-/Max-/Team-/Enterprise-Tarife verdoppelt, Spitzenzeiten-Reduzierungen entfernt und API-Ratenlimits für Opus-Modelle erhöht. SpaceX Colossus 1 fügt innerhalb eines Monats über 300 MW Kapazität (220.000 NVIDIA-GPUs) hinzu.

Claude-API-Nutzungsdaten zeigen Auswirkungen neuer Limits auf Max-Plan-Nutzer
Ein Claude Max 20x-Benutzer berichtet, dass die API-äquivalente tägliche Nutzung nach der Einführung neuer Limits von ~210 $/Tag auf ~52 $/Tag gesunken ist, was erhebliche Arbeitsablaufänderungen erfordert, einschließlich der Nutzung von Sonnet und Codex.

Richter stellt fest: Britisches Innenministerium nutzte KI-halluziniertes Dokument zur Ablehnung von Asylantrag
Ein hochrangiger britischer Richter entschied, dass das Home Office wahrscheinlich KI-generierte halluzinierte Beweise – eine nicht existierende Länderrichtliniennotiz – verwendet hat, um einen Asylantrag abzulehnen. Das fehlende Dokument wurde nie gefunden, und der Richter verglich die Praxis mit dem Stützen auf nichtige Beweise.

Die besten Token-Anbieter für Ihre API-Anforderungen auswählen
Erforschen Sie die Schlüsselfaktoren, die bei der Auswahl eines Anbieters für Tokens und APIs im Bereich der KI-Programmierung und Automatisierung zu berücksichtigen sind, basierend auf Erkenntnissen aus der OpenClaw-Community.