OnPrem.LLM AgentExecutor: Lanza Agentes de IA en Sandbox con Herramientas Integradas

El AgentExecutor de OnPrem.LLM permite que agentes de IA autónomos ejecuten tareas complejas utilizando tanto modelos en la nube como locales. La canalización funciona con cualquier modelo compatible con LiteLLM que admita el uso de herramientas, incluyendo modelos en la nube como GPT-5.2-Codex de OpenAI, Claude Sonnet 4.5 de Anthropic y Gemini 1.5 Pro de Google, así como modelos locales a través de Ollama, vLLM o llama.cpp.
Herramientas Integradas
Por defecto, AgentExecutor proporciona acceso a nueve herramientas integradas:
read_file- Leer el contenido completo de archivosread_lines- Leer rangos específicos de líneas de archivosedit_file- Editar archivos mediante buscar/reemplazarwrite_file- Escribir el contenido completo de archivosgrep- Buscar patrones en archivosfind- Encontrar archivos por patrón globrun_shell- Ejecutar comandos de shellweb_search- Buscar información en la webweb_fetch- Obtener y leer contenido de URLs
Ejemplos de Configuración
Puedes personalizar el acceso a herramientas según tus requisitos de seguridad:
# Usar valores predeterminados (todas las herramientas incluyendo shell):
executor = AgentExecutor(model='anthropic/claude-sonnet-4-5')
Predeterminados pero sin acceso a shell (más seguro):
executor = AgentExecutor(
model='openai/gpt-5-mini',
disable_shell=True
)
Herramientas mínimas:
executor = AgentExecutor(
model='openai/gpt-5-mini',
enabled_tools=['read_file', 'write_file']
)
Solo investigación web:
executor = AgentExecutor(
model='openai/gpt-5-mini',
enabled_tools=['web_search', 'web_fetch']
)
Ejecución Aislada
Por seguridad, puedes ejecutar agentes en contenedores efímeros usando sandbox=True. Esto es importante porque los agentes con acceso a shell pueden potencialmente leer o modificar archivos fuera del directorio de trabajo. El agente opera dentro del directorio de trabajo especificado y no puede leer ni escribir fuera de él a menos que se le otorgue acceso a shell.
Ejemplo básico con aislamiento:
executor = AgentExecutor(
model='anthropic/claude-sonnet-4-5',
sandbox=True,
)
result = executor.run(
task="""
Crea un módulo simple de calculadora en Python con lo siguiente:
- calculator.py con funciones sumar, restar, multiplicar, dividir
- test_calculator.py con pruebas de pytest
- Todas las pruebas deben pasar
""",
working_dir='./calculator_project'
)
Este enfoque es útil para desarrolladores que necesitan automatizar tareas de programación manteniendo límites de seguridad. La herramienta requiere instalar PatchPal con pip install patchpal.
📖 Read the full source: HN AI Agents
👀 Ver también

Extensión de Claude para VS Code Deslizador de Esfuerzo de Razonamiento Envía Valores Inconsistentes
El control deslizante de esfuerzo de razonamiento en la extensión de Claude para VS Code envía valores numéricos inconsistentes al modelo, con un mapeo no monótono donde mover el control hacia arriba puede enviar un número más bajo.

Claude Code v2.1.217: Límite de profundidad de subagente, autocompletado de emojis y correcciones críticas
Claude Code v2.1.217 limita a 20 los subagentes concurrentes, añade autocompletado de emojis, corrige una fuga de memoria en las salidas de herramientas MCP y resuelve problemas de actualización automática en Windows.

Plataforma ELBO: Capacitación con IA para el Pensamiento Crítico y las Habilidades de Comunicación
ELBO es una plataforma de entrenamiento en vivo construida con Claude Code que utiliza IA para ayudar a los usuarios a practicar habilidades de pensamiento crítico, persuasión, negociación y oratoria a través de escenarios simulados y debates.

Benchmark Flash-MOE en M5 Max: 12.99 tok/s con Qwen3.5-397B
Una evaluación comparativa del modelo Qwen3.5 de 397 mil millones de parámetros ejecutándose localmente en un MacBook Pro M5 Max con 128 GB de RAM logró 12.99 tokens por segundo utilizando cuantización de 4 bits y cache-io-split 4, tres veces más rápido que la evaluación original de 48 GB.