Sandbox externe pour agents : Exécution durable et démarrages à froid

✍️ OpenClawRadar📅 Publié: May 3, 2026🔗 Source
Sandbox externe pour agents : Exécution durable et démarrages à froid
Ad

Le blog de Mendral soutient que le harnais de l'agent — la boucle qui pilote un LLM en envoyant des invites, exécutant des appels d'outils et renvoyant les résultats — devrait s'exécuter en dehors du sandbox, en particulier pour les agents multi-utilisateurs. Ils comparent deux architectures et détaillent les trois défis qu'ils ont résolus en adoptant le modèle externe.

Deux architectures

  • Harnais à l'intérieur du sandbox : La boucle vit dans le même conteneur que le code sur lequel elle travaille. Les appels d'outils (bash, read, write) s'exécutent localement. Les compétences et les mémoires sont des fichiers sur le système de fichiers du conteneur. C'est ce que fait Claude Code localement. Modèle d'exécution simple, mais les identifiants sont à l'intérieur du sandbox, le sandbox est la session (le perdre fait perdre la progression), et le multi-utilisateur devient un problème de système de fichiers distribué.
  • Harnais à l'extérieur du sandbox : La boucle s'exécute sur le backend et appelle un sandbox via une API pour exécuter des outils. Les identifiants restent en dehors du sandbox (aucun modèle de permissions nécessaire). Les sandbox peuvent être suspendus lorsqu'ils sont inactifs, deviennent du bétail (survivent aux pannes), et le partage multi-utilisateur est un problème de base de données partagée, pas de système de fichiers distribué.
Ad

Trois défis résolus

  1. Exécution durable : Les sessions d'agent peuvent durer des heures et doivent survivre aux déploiements et aux pannes. Mendral utilise Inngest pour le checkpointing — chaque tour est une étape, et la boucle reprend là où elle s'est arrêtée si le serveur redémarre.
  2. Cycle de vie du sandbox avec des démarrages à froid faibles : La boucle est suspendue la plupart du temps (par exemple, pendant les appels LLM). Ils utilisent Blaxel pour reprendre les sandbox depuis un état d'attente en ~25ms, évitant les démarrages à froid de plusieurs secondes lors des tours interactifs.
  3. Abstraction du système de fichiers : Avec le harnais et le sandbox sur des machines différentes, un système de fichiers partagé n'est plus disponible. Mendral note qu'ils ont dû gérer cela, mais l'article se concentre sur les deux premiers comme problèmes clés résolus.

L'article conclut que le modèle externe est supérieur pour les configurations multi-utilisateurs malgré la complexité de l'exécution durable et de la gestion des démarrages à froid.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

Le verrouillage des fournisseurs d'IA s'intensifie : le changement de modèle coûte désormais plus cher que prévu
News

Le verrouillage des fournisseurs d'IA s'intensifie : le changement de modèle coûte désormais plus cher que prévu

Un sondage Zapier auprès de 542 dirigeants américains montre que 90 % pensaient pouvoir changer de fournisseur d'IA en moins de 4 semaines, mais 58 % des migrations réelles ont échoué ou ont pris beaucoup plus de temps. Parallèlement, OpenAI a augmenté le prix des tokens d'entrée de GPT-5.2 de 1,25 $ à 5,75 $, et Anthropic est passé à une tarification dynamique pour Claude Enterprise, ce qui pourrait doubler ou tripler les coûts pour les utilisateurs intensifs.

OpenClawRadar
Claude-Code v2.1.72 : Améliorations SSH, réduction des invites de permissions et corrections de bugs
News

Claude-Code v2.1.72 : Améliorations SSH, réduction des invites de permissions et corrections de bugs

Claude-Code v2.1.72 ajoute l'écriture de fichiers compatible SSH avec la touche /copy w, réduit les invites de permission bash en ajoutant des outils courants à la liste d'approbation automatique, et corrige plus de 20 bugs incluant des problèmes de mode vocal et d'installation de plugins.

OpenClawRadar
Précision du Cadre de Raisonnement STAR Chute de 100 % à 0 % dans les Prompts de Production
News

Précision du Cadre de Raisonnement STAR Chute de 100 % à 0 % dans les Prompts de Production

Un chercheur a découvert que le cadre de raisonnement STAR, qui a fait passer la précision de Claude sur un problème de contrainte implicite de 0 % à 100 % en isolation, est tombé à 0-30 % de précision lorsqu'il a été utilisé dans une invite système de production de 60 lignes. Le problème était causé par des instructions conflictuelles dans l'invite de production qui ont déclenché des engagements prématurés de réponse.

OpenClawRadar
Claude Opus 4.7 signale des questions sur le vaccin contre l'hantavirus comme un risque de sécurité, interrompant les conversations
News

Claude Opus 4.7 signale des questions sur le vaccin contre l'hantavirus comme un risque de sécurité, interrompant les conversations

Demander à Claude Opus 4.7 comment développer un vaccin contre le hantavirus déclenche des filtres de sécurité qui mettent la conversation en pause, tandis que Sonnet 4.6 bloque également la modélisation prédictive associée.

OpenClawRadar