FORGE: Marco de Pruebas de Seguridad de IA de Código Abierto para Sistemas LLM

✍️ OpenClawRadar📅 Publicado: 7 de marzo de 2026🔗 Source
FORGE: Marco de Pruebas de Seguridad de IA de Código Abierto para Sistemas LLM
Ad

FORGE (Framework for Orchestrated Reasoning & Generation of Engines) es un marco de pruebas de seguridad de IA autónomo de código abierto para sistemas LLM que funciona 24/7 y cubre las 10 principales vulnerabilidades OWASP LLM.

Características Clave

  • Construye sus propias herramientas durante la ejecución — genera módulos Python personalizados al instante cuando encuentra vulnerabilidades desconocidas
  • Se autoreplica en un enjambre — crea copias en subprocesos que comparten una mente colmena en vivo
  • Aprende de cada sesión — usa SQLite para almacenar patrones, la IA puntúa hallazgos y algoritmos genéticos evolucionan sus propios prompts
  • Pentesting de IA por IA — 7 módulos que cubren las 10 principales vulnerabilidades OWASP LLM
  • Honeypot — endpoint de IA vulnerable falso que atrapa atacantes y clasifica si son humanos o agentes de IA
  • Monitor 24/7 — vigila la IA en producción, alerta sobre picos de latencia, ráfagas de ataques e intentos de inyección mediante webhook de Slack/Discord
  • Probador de estrés — pruebas de resiliencia OWASP LLM04 DoS con panel de TPS en vivo y calificación A-F
  • Funciona con cualquier modelo — Claude, Llama, Mistral, DeepSeek, GPT-4, Groq, cualquiera — una variable de entorno para cambiar
Ad

Cobertura de las 10 Principales Vulnerabilidades OWASP LLM

  • LLM01 Inyección de Prompt → prompt_injector + jailbreak_fuzzer (125 payloads)
  • LLM02 Salida Insegura → rag_leaker
  • LLM04 DoS del Modelo → overloader (8 modos de estrés)
  • LLM06 Divulgación de Información Sensible → system_prompt_probe + rag_leaker
  • LLM07 Plugin Inseguro → agent_hijacker
  • LLM08 Agencia Excesiva → agent_hijacker
  • LLM10 Robo de Modelo → model_fingerprinter

Configuración y Uso

Comandos de instalación:

git clone https://github.com/umangkartikey/forge
cd forge
pip install anthropic rich
export ANTHROPIC_API_KEY=your_key

Ejecutar con Ollama local de forma gratuita:

FORGE_BACKEND=ollama FORGE_MODEL=llama3.1 python forge.py

La herramienta aborda las brechas de seguridad comunes de LLM: la mayoría de las aplicaciones de IA implementadas hoy nunca han sido sometidas a pruebas de red teaming, los prompts del sistema son completamente extraíbles, los jailbreaks funcionan, las canalizaciones RAG tienen fugas y la inyección indirecta de prompts a través de salidas de herramientas está casi universalmente desprotegida. FORGE automatiza la búsqueda de estas vulnerabilidades de la misma manera que lo haría un equipo rojo humano, pero más rápido y funcionando 24/7.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

BlindKey: Inyección de Credenciales Ciegas para Agentes de IA
Seguridad

BlindKey: Inyección de Credenciales Ciegas para Agentes de IA

BlindKey es una herramienta de seguridad que evita que los agentes de IA accedan a credenciales de API en texto plano mediante el uso de tokens de bóveda cifrados y un proxy local. Los agentes hacen referencia a tokens como bk://stripe, y el proxy inyecta la credencial real en el momento de la solicitud.

OpenClawRadar
ClawCare: Guardián de Seguridad para Agentes de Codificación de IA Tras Fuga de Claves de AWS
Seguridad

ClawCare: Guardián de Seguridad para Agentes de Codificación de IA Tras Fuga de Claves de AWS

ClawCare es una herramienta de Python que escanea comandos antes de su ejecución en agentes de codificación con IA como Claude Code, bloqueando patrones riesgosos como volcados masivos de entorno y shells inversos. Fue creada después de que un desarrollador filtrara accidentalmente una clave de AWS a través de un agente.

OpenClawRadar
Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador
Seguridad

Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador

Anthropic lanzó un plugin de guía de seguridad para Claude Code que identifica y corrige vulnerabilidades mientras se programa. Disponible para todos los usuarios a través del marketplace de plugins, no solo para Enterprise. Se debate si se convierte en un asistente ligero, una capa seria de AppSec o un puente hacia Claude Security.

OpenClawRadar
Por que las herramientas internas de RAG y doc-chat fallan en auditorias de seguridad
Seguridad

Por que las herramientas internas de RAG y doc-chat fallan en auditorias de seguridad

La comunidad discute bloqueadores reales de seguridad y cumplimiento que impiden que las herramientas RAG lleguen a produccion.

OpenClaw Radar