OnPrem.LLM AgentExecutor : Lancez des Agents IA Sandboxés avec des Outils Intégrés

L'AgentExecutor d'OnPrem.LLM permet à des agents IA autonomes d'exécuter des tâches complexes en utilisant à la fois des modèles cloud et locaux. Le pipeline fonctionne avec tout modèle pris en charge par LiteLLM qui supporte l'appel d'outils, incluant les modèles cloud comme GPT-5.2-Codex d'OpenAI, Claude Sonnet 4.5 d'Anthropic, et Gemini 1.5 Pro de Google, ainsi que des modèles locaux via Ollama, vLLM ou llama.cpp.
Outils intégrés
Par défaut, AgentExecutor donne accès à neuf outils intégrés :
read_file- Lire le contenu complet d'un fichierread_lines- Lire des plages de lignes spécifiques dans les fichiersedit_file- Modifier des fichiers via recherche/remplacementwrite_file- Écrire le contenu complet d'un fichiergrep- Rechercher des motifs dans les fichiersfind- Trouver des fichiers par motif globrun_shell- Exécuter des commandes shellweb_search- Rechercher des informations sur le webweb_fetch- Récupérer et lire du contenu depuis des URL
Exemples de configuration
Vous pouvez personnaliser l'accès aux outils selon vos exigences de sécurité :
# Utiliser les paramètres par défaut (tous les outils incluant shell) :
executor = AgentExecutor(model='anthropic/claude-sonnet-4-5')
Par défaut mais sans accès shell (plus sûr) :
executor = AgentExecutor(
model='openai/gpt-5-mini',
disable_shell=True
)
Outils minimaux :
executor = AgentExecutor(
model='openai/gpt-5-mini',
enabled_tools=['read_file', 'write_file']
)
Recherche web uniquement :
executor = AgentExecutor(
model='openai/gpt-5-mini',
enabled_tools=['web_search', 'web_fetch']
)
Exécution isolée
Pour la sécurité, vous pouvez exécuter les agents dans des conteneurs éphémères en utilisant sandbox=True. Ceci est important car les agents avec accès shell peuvent potentiellement lire ou modifier des fichiers en dehors du répertoire de travail. L'agent opère dans le répertoire de travail spécifié et ne peut pas lire ou écrire en dehors de celui-ci, sauf s'il dispose d'un accès shell.
Exemple basique avec isolation :
executor = AgentExecutor(
model='anthropic/claude-sonnet-4-5',
sandbox=True,
)
result = executor.run(
task="""
Créer un module Python de calculatrice simple avec :
- calculator.py avec des fonctions add, subtract, multiply, divide
- test_calculator.py avec des tests pytest
- Tous les tests doivent passer
""",
working_dir='./calculator_project'
)
Cette approche est utile pour les développeurs qui doivent automatiser des tâches de codage tout en maintenant des limites de sécurité. L'outil nécessite l'installation de PatchPal avec pip install patchpal.
📖 Read the full source: HN AI Agents
👀 See Also

Statespace : Créez des applications Web interactives pour les agents OpenClaw avec Markdown
Statespace est un framework gratuit et open-source pour créer et partager des applications web conviviales pour l'IA, que les agents OpenClaw peuvent naviguer et avec lesquelles ils peuvent interagir en utilisant du Markdown pur. Il vous permet de définir des outils, des composants et des instructions dans des fichiers Markdown auxquels les agents accèdent via HTTP.

Serveur MCP Légal pour Claude Offre un Accès à Plus de 4 Millions d'Avis Judiciaires Américains
Un serveur MCP gratuit et open-source construit avec Claude Code donne à l'IA Claude accès à plus de 4 millions d'avis réels de tribunaux américains, offrant 18 outils pour la recherche de jurisprudence, le suivi des citations, l'analyse Bluebook, la gestion de pratique Clio et l'accès aux dossiers fédéraux PACER sans hallucinations.

OpenTrace : Serveur d'observabilité auto-hébergé avec plus de 75 outils MCP
OpenTrace est un serveur d'observabilité auto-hébergé qui fournit des journaux, des analyses utilisateur et une introspection de base de données via plus de 75 outils MCP, fonctionnant sur un VPS à 4 $ avec stockage SQLite et connexions PostgreSQL en lecture seule.

hipEngine : Inférence native rapide de Qwen 3.6 pour RDNA3 (Strix Halo, 7900 XTX)
hipEngine est un nouveau moteur d'inférence open-source (AGPLv3) natif ROCm pour Qwen 3.6 MoE sur GPU RDNA3. Les benchmarks montrent un préremplissage jusqu'à 2718 tok/s sur 7900 XTX, compétitif avec llama.cpp, et un cache KV INT8 permettant un contexte complet de 256K en moins de 24 Go.