FORGE: Marco de Pruebas de Seguridad de IA de Código Abierto para Sistemas LLM

FORGE (Framework for Orchestrated Reasoning & Generation of Engines) es un marco de pruebas de seguridad de IA autónomo de código abierto para sistemas LLM que funciona 24/7 y cubre las 10 principales vulnerabilidades OWASP LLM.
Características Clave
- Construye sus propias herramientas durante la ejecución — genera módulos Python personalizados al instante cuando encuentra vulnerabilidades desconocidas
- Se autoreplica en un enjambre — crea copias en subprocesos que comparten una mente colmena en vivo
- Aprende de cada sesión — usa SQLite para almacenar patrones, la IA puntúa hallazgos y algoritmos genéticos evolucionan sus propios prompts
- Pentesting de IA por IA — 7 módulos que cubren las 10 principales vulnerabilidades OWASP LLM
- Honeypot — endpoint de IA vulnerable falso que atrapa atacantes y clasifica si son humanos o agentes de IA
- Monitor 24/7 — vigila la IA en producción, alerta sobre picos de latencia, ráfagas de ataques e intentos de inyección mediante webhook de Slack/Discord
- Probador de estrés — pruebas de resiliencia OWASP LLM04 DoS con panel de TPS en vivo y calificación A-F
- Funciona con cualquier modelo — Claude, Llama, Mistral, DeepSeek, GPT-4, Groq, cualquiera — una variable de entorno para cambiar
Cobertura de las 10 Principales Vulnerabilidades OWASP LLM
- LLM01 Inyección de Prompt → prompt_injector + jailbreak_fuzzer (125 payloads)
- LLM02 Salida Insegura → rag_leaker
- LLM04 DoS del Modelo → overloader (8 modos de estrés)
- LLM06 Divulgación de Información Sensible → system_prompt_probe + rag_leaker
- LLM07 Plugin Inseguro → agent_hijacker
- LLM08 Agencia Excesiva → agent_hijacker
- LLM10 Robo de Modelo → model_fingerprinter
Configuración y Uso
Comandos de instalación:
git clone https://github.com/umangkartikey/forge
cd forge
pip install anthropic rich
export ANTHROPIC_API_KEY=your_keyEjecutar con Ollama local de forma gratuita:
FORGE_BACKEND=ollama FORGE_MODEL=llama3.1 python forge.pyLa herramienta aborda las brechas de seguridad comunes de LLM: la mayoría de las aplicaciones de IA implementadas hoy nunca han sido sometidas a pruebas de red teaming, los prompts del sistema son completamente extraíbles, los jailbreaks funcionan, las canalizaciones RAG tienen fugas y la inyección indirecta de prompts a través de salidas de herramientas está casi universalmente desprotegida. FORGE automatiza la búsqueda de estas vulnerabilidades de la misma manera que lo haría un equipo rojo humano, pero más rápido y funcionando 24/7.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Presentamos SkillFence: El nuevo monitor en tiempo de ejecución que observa lo que realmente hacen las habilidades.
SkillFence ofrece un avance en el monitoreo de las acciones de los agentes de IA, abordando la necesidad de transparencia y seguridad en entornos impulsados por IA. Descubre cómo esta herramienta innovadora puede mejorar el control sobre procesos autónomos.

Traducción al español: **La aplicación de escritorio Claude de Anthropic instala un puente de mensajería nativa no revelado**
Claude Desktop instala silenciosamente una extensión de navegador preautorizada que permite la mensajería nativa, generando preocupaciones de seguridad.

El complemento de código Claude causa picos de CPU y drena la batería
Un usuario descubrió que el complemento de Telegram de Claude Code genera múltiples procesos bun.exe que se ejecutan al 100% de la CPU incluso con la tapa del portátil cerrada, causando un drenaje rápido de la batería. Los procesos sobreviven a los ciclos de suspensión/activación y requieren pasos de limpieza específicos para eliminarlos.

OpenClaw Security: 13 Pasos Prácticos para Proteger Tu Agente de IA
Una publicación de Reddit describe 13 medidas de seguridad para instalaciones de OpenClaw, incluyendo ejecutarlo en una máquina separada, usar Tailscale para aislamiento de red, aislar subagentes en Docker y configurar listas de permitidos para acceso de usuarios.