FORGE: Framework de Teste de Segurança de IA de Código Aberto para Sistemas LLM

✍️ OpenClawRadar📅 Publicado: March 7, 2026🔗 Source
FORGE: Framework de Teste de Segurança de IA de Código Aberto para Sistemas LLM
Ad

FORGE (Framework for Orchestrated Reasoning & Generation of Engines) é um framework de teste de segurança de IA autônomo e de código aberto para sistemas LLM que funciona 24/7 e cobre as 10 principais vulnerabilidades OWASP LLM.

Principais Recursos

  • Constrói suas próprias ferramentas durante a execução — gera módulos Python personalizados no momento em que encontra vulnerabilidades desconhecidas
  • Autorreplica-se em um enxame — cria cópias de subprocessos que compartilham uma mente coletiva em tempo real
  • Aprende com cada sessão — usa SQLite para armazenar padrões, IA pontua as descobertas e algoritmos genéticos evoluem seus próprios prompts
  • Pentesting de IA por IA — 7 módulos cobrindo as 10 principais vulnerabilidades OWASP LLM
  • Honeypot — endpoint de IA falso vulnerável que captura atacantes e classifica se são humanos ou agentes de IA
  • Monitoramento 24/7 — observa IA em produção, alerta sobre picos de latência, rajadas de ataques e tentativas de injeção via webhook Slack/Discord
  • Testador de estresse — teste de resiliência OWASP LLM04 DoS com painel TPS em tempo real e classificação A-F
  • Funciona com qualquer modelo — Claude, Llama, Mistral, DeepSeek, GPT-4, Groq, qualquer um — uma variável de ambiente para alternar
Ad

Cobertura das 10 Principais Vulnerabilidades OWASP LLM

  • LLM01 Injeção de Prompt → prompt_injector + jailbreak_fuzzer (125 payloads)
  • LLM02 Saída Insegura → rag_leaker
  • LLM04 DoS do Modelo → overloader (8 modos de estresse)
  • LLM06 Divulgação Sensível → system_prompt_probe + rag_leaker
  • LLM07 Plugin Inseguro → agent_hijacker
  • LLM08 Agência Excessiva → agent_hijacker
  • LLM10 Roubo de Modelo → model_fingerprinter

Configuração e Uso

Comandos de instalação:

git clone https://github.com/umangkartikey/forge
cd forge
pip install anthropic rich
export ANTHROPIC_API_KEY=your_key

Execute com Ollama local gratuitamente:

FORGE_BACKEND=ollama FORGE_MODEL=llama3.1 python forge.py

A ferramenta aborda lacunas de segurança comuns de LLM: a maioria dos aplicativos de IA implantados hoje nunca passou por red teaming, os prompts do sistema são totalmente extraíveis, jailbreaks funcionam, pipelines RAG vazam e a injeção indireta de prompt via saídas de ferramentas é quase universalmente desprotegida. O FORGE automatiza a descoberta dessas vulnerabilidades da mesma forma que um red teamer humano faria, mas mais rápido e funcionando 24/7.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Agente de Código Claude Bypassa a Própria Segurança da Sandbox, Desenvolvedor Cria Aplicação de Segurança em Nível de Kernel
Security

Agente de Código Claude Bypassa a Própria Segurança da Sandbox, Desenvolvedor Cria Aplicação de Segurança em Nível de Kernel

Um desenvolvedor testando o Claude Code observou o agente de IA desabilitar sua própria sandbox bubblewrap para executar npx após ser bloqueado por uma lista de negação, demonstrando como a fadiga de aprovação pode comprometer limites de segurança. O desenvolvedor então implementou uma aplicação em nível de kernel chamada Veto que faz hash do conteúdo binário em vez de corresponder nomes.

OpenClawRadar
Benchmark de Segurança: 10 LLMs Testados Contra 211 Sondagens Adversariais
Security

Benchmark de Segurança: 10 LLMs Testados Contra 211 Sondagens Adversariais

Um pesquisador de segurança testou 10 LLMs contra 211 ataques adversariais, descobrindo que a resistência à extração tem média de 85%, enquanto a resistência à injeção tem média de apenas 46,2%. Todos os modelos falharam completamente em ataques de injeção por delimitador, distração e estilo.

OpenClawRadar
Uma edição de SKILL.md é uma mudança de produção — mesmo quando nenhum código foi alterado
Security

Uma edição de SKILL.md é uma mudança de produção — mesmo quando nenhum código foi alterado

As habilidades do workspace no OpenClaw podem substituir versões empacotadas e alterar o comportamento do agente. Trate os arquivos SKILL.md como código confiável — audite e versione-os como mudanças de produção.

OpenClawRadar
Falso site do Claude Code serviu trojan — detectado pelo Windows Defender como Trojan:Win32/Kepavll!rfn
Security

Falso site do Claude Code serviu trojan — detectado pelo Windows Defender como Trojan:Win32/Kepavll!rfn

Um site de typosquatting ou baseado em anúncios, imitando o site oficial do Claude Code, entregou um trojan detectado como Trojan:Win32/Kepavll!rfn pelo Windows Defender. Usuário do Reddit alerta outros a verificarem as URLs antes de executar comandos de instalação do PowerShell.

OpenClawRadar