PromptForest: Detección de Inyección de Prompts Local-Primero con Incertidumbre

PromptForest es una nueva biblioteca de primera local creada para abordar los problemas que comúnmente se observan con los detectores de inyección de comandos actuales. Su objetivo es detectar inyecciones de comandos y jailbreaks de manera eficiente y con un grado de incertidumbre para evitar la sobreconfianza en los resultados. Este enfoque la diferencia de los sistemas tradicionales, particularmente al mantener el rendimiento mientras proporciona salidas más matizadas.
Detalles Clave
Uno de los problemas fundamentales con los detectores de inyección existentes es la dependencia de modelos grandes como Llama 2 8B y Qualifire Sentinel 0.6B. Estos modelos no solo son lentos, sino que su sobreconfianza en los resultados puede llevar a falsos positivos que socavan su credibilidad en escenarios de producción. Reconociendo estas limitaciones, PromptForest aprovecha un método de ensamblaje de votación que comprende tres modelos más pequeños y especializados:
- Llama Prompt Guard (86M): Ofrece el Error de Calibración Esperado (ECE) más alto en su categoría de peso.
- Vijil Dome (ModernBERT): Proporciona la mayor precisión por parámetro.
- XGBoost Personalizado: Entrenado en incrustaciones para diversidad arquitectónica.
Estos modelos utilizan colectivamente un método de votación suave ponderada para determinar los resultados, donde los modelos más precisos tienen mayor influencia. Este método simplifica la toma de decisiones mientras se mantiene alta precisión y consistencia.
El benchmarking muestra que PromptForest tiene una latencia media de ~141ms, en comparación con ~225ms para el Qualifire Sentinel v2, mientras ofrece una precisión comparable del 90% frente a su 97%. La calibración ECE también se desempeña bien en 0.070 frente a 0.096 del Sentinel. El rendimiento es impresionante también, con aproximadamente 27 comandos procesados por segundo en una GPU de consumo usando la herramienta pfranger.
Para pruebas e implementación, los desarrolladores pueden experimentar con PromptForest en Google Colab o auditar comandos con la herramienta PFRanger, que funciona completamente de manera local. PFRanger utiliza paralelización para mejorar la velocidad y el rendimiento.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

Gremio OpenClaw: Servidor de agentes de IA multiusuario para equipos
OpenClaw Guild amplía OpenClaw de usuario único a un servidor de IA multiusuario con control de acceso basado en roles, datos aislados por agente y un sistema de memoria de 4 niveles. Incluye un panel de administración web y despliegue con Docker-compose para configuración en 15 minutos.

ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo
ToolLoop es un framework de código abierto en Python con 11 herramientas para operaciones de archivos, búsqueda de código, acceso a shell y subagentes que funciona con cualquier LLM a través de LiteLLM. El framework de 2,700 líneas permite cambiar de modelo a mitad de conversación con contexto compartido.

LocalSynapse MCP Server Agrega Compatibilidad con macOS y Mejoras en la Búsqueda
LocalSynapse, un servidor MCP sin conexión para buscar en documentos locales, ahora es compatible con macOS e incluye correcciones para consultas de búsqueda de varias palabras. El desarrollador ha implementado mejoras basadas en comentarios, incluyendo el impulso de clics ajustado por posición y la descomposición temporal como promoción.

AgentHandover: Aplicación de la barra de menú de Mac que crea habilidades de agente observando tu pantalla
AgentHandover es una aplicación de código abierto para la barra de menú de Mac que utiliza Gemma 4 ejecutándose localmente a través de Ollama para observar tu pantalla y convertir flujos de trabajo repetidos en archivos de Habilidades estructurados que cualquier agente puede seguir. Ofrece tanto Grabación Enfocada para tareas específicas como Descubrimiento Pasivo que detecta patrones a partir de la observación en segundo plano.