FORGE: Marco de Pruebas de Seguridad de IA de Código Abierto para Sistemas LLM

✍️ OpenClawRadar📅 Publicado: 7 de marzo de 2026🔗 Source
FORGE: Marco de Pruebas de Seguridad de IA de Código Abierto para Sistemas LLM
Ad

FORGE (Framework for Orchestrated Reasoning & Generation of Engines) es un marco de pruebas de seguridad de IA autónomo de código abierto para sistemas LLM que funciona 24/7 y cubre las 10 principales vulnerabilidades OWASP LLM.

Características Clave

  • Construye sus propias herramientas durante la ejecución — genera módulos Python personalizados al instante cuando encuentra vulnerabilidades desconocidas
  • Se autoreplica en un enjambre — crea copias en subprocesos que comparten una mente colmena en vivo
  • Aprende de cada sesión — usa SQLite para almacenar patrones, la IA puntúa hallazgos y algoritmos genéticos evolucionan sus propios prompts
  • Pentesting de IA por IA — 7 módulos que cubren las 10 principales vulnerabilidades OWASP LLM
  • Honeypot — endpoint de IA vulnerable falso que atrapa atacantes y clasifica si son humanos o agentes de IA
  • Monitor 24/7 — vigila la IA en producción, alerta sobre picos de latencia, ráfagas de ataques e intentos de inyección mediante webhook de Slack/Discord
  • Probador de estrés — pruebas de resiliencia OWASP LLM04 DoS con panel de TPS en vivo y calificación A-F
  • Funciona con cualquier modelo — Claude, Llama, Mistral, DeepSeek, GPT-4, Groq, cualquiera — una variable de entorno para cambiar
Ad

Cobertura de las 10 Principales Vulnerabilidades OWASP LLM

  • LLM01 Inyección de Prompt → prompt_injector + jailbreak_fuzzer (125 payloads)
  • LLM02 Salida Insegura → rag_leaker
  • LLM04 DoS del Modelo → overloader (8 modos de estrés)
  • LLM06 Divulgación de Información Sensible → system_prompt_probe + rag_leaker
  • LLM07 Plugin Inseguro → agent_hijacker
  • LLM08 Agencia Excesiva → agent_hijacker
  • LLM10 Robo de Modelo → model_fingerprinter

Configuración y Uso

Comandos de instalación:

git clone https://github.com/umangkartikey/forge
cd forge
pip install anthropic rich
export ANTHROPIC_API_KEY=your_key

Ejecutar con Ollama local de forma gratuita:

FORGE_BACKEND=ollama FORGE_MODEL=llama3.1 python forge.py

La herramienta aborda las brechas de seguridad comunes de LLM: la mayoría de las aplicaciones de IA implementadas hoy nunca han sido sometidas a pruebas de red teaming, los prompts del sistema son completamente extraíbles, los jailbreaks funcionan, las canalizaciones RAG tienen fugas y la inyección indirecta de prompts a través de salidas de herramientas está casi universalmente desprotegida. FORGE automatiza la búsqueda de estas vulnerabilidades de la misma manera que lo haría un equipo rojo humano, pero más rápido y funcionando 24/7.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Presentamos SkillFence: El nuevo monitor en tiempo de ejecución que observa lo que realmente hacen las habilidades.
Seguridad

Presentamos SkillFence: El nuevo monitor en tiempo de ejecución que observa lo que realmente hacen las habilidades.

SkillFence ofrece un avance en el monitoreo de las acciones de los agentes de IA, abordando la necesidad de transparencia y seguridad en entornos impulsados por IA. Descubre cómo esta herramienta innovadora puede mejorar el control sobre procesos autónomos.

OpenClawRadar
Traducción al español:

**La aplicación de escritorio Claude de Anthropic instala un puente de mensajería nativa no revelado**
Seguridad

Traducción al español: **La aplicación de escritorio Claude de Anthropic instala un puente de mensajería nativa no revelado**

Claude Desktop instala silenciosamente una extensión de navegador preautorizada que permite la mensajería nativa, generando preocupaciones de seguridad.

OpenClawRadar
El complemento de código Claude causa picos de CPU y drena la batería
Seguridad

El complemento de código Claude causa picos de CPU y drena la batería

Un usuario descubrió que el complemento de Telegram de Claude Code genera múltiples procesos bun.exe que se ejecutan al 100% de la CPU incluso con la tapa del portátil cerrada, causando un drenaje rápido de la batería. Los procesos sobreviven a los ciclos de suspensión/activación y requieren pasos de limpieza específicos para eliminarlos.

OpenClawRadar
OpenClaw Security: 13 Pasos Prácticos para Proteger Tu Agente de IA
Seguridad

OpenClaw Security: 13 Pasos Prácticos para Proteger Tu Agente de IA

Una publicación de Reddit describe 13 medidas de seguridad para instalaciones de OpenClaw, incluyendo ejecutarlo en una máquina separada, usar Tailscale para aislamiento de red, aislar subagentes en Docker y configurar listas de permitidos para acceso de usuarios.

OpenClawRadar