McpVanguard: Proxy de segurança de código aberto para agentes de IA baseados em MCP

McpVanguard é um proxy de segurança e firewall de código aberto projetado especificamente para agentes de IA locais que usam o Model Context Protocol (MCP). Ele aborda preocupações de segurança que surgem ao dar aos LLMs acesso a ferramentas como terminais ou sistemas de arquivos.
Como funciona
O proxy fica entre o agente de IA e as ferramentas MCP, envolvendo servidores MCP existentes sem exigir reescrita de configuração. Ele pode ser executado localmente como um proxy leve ou ser implantado como um gateway em nuvem, com um modelo Railway disponível para implantação mais fácil.
Camadas de segurança
- Mecanismo de regras/assinaturas: Contém cerca de 50 assinaturas YAML que detectam ataques comuns como shells reversos, tentativas de SSRF e outras ameaças óbvias. Esta camada adiciona aproximadamente 16ms de latência.
- Camada de pontuação semântica (opcional): Quando as solicitações parecem suspeitas, mas não claramente maliciosas, elas podem ser avaliadas por um pequeno LLM (Ollama ou OpenAI) que avalia a intenção.
- Monitoramento comportamental: Bloqueia padrões anômalos, como um agente tentando ler centenas de arquivos em um curto período de tempo.
Capacidades de auditoria
Cada solicitação bloqueada é registrada em um log de auditoria imutável que é assinado criptograficamente e armazenado localmente, fornecendo um registro verificável do que foi bloqueado e por quê.
A ferramenta foi desenvolvida para abordar preocupações específicas de segurança com implementações MCP, incluindo injeção de prompt, travessia de caminho e exclusão acidental de diretórios por agentes de IA.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Ferramentas de IA de Código Aberto Apresentam Riscos de Segurança Devido à 'Segurança Ilusória Através da Transparência'
Uma postagem no Reddit alerta sobre malware disfarçado como agentes e ferramentas de IA de código aberto, onde código malicioso pode estar escondido em grandes bases de código que os usuários assumem ser seguras porque estão no GitHub. A postagem descreve como o 'vibe-coding' e os agentes de IA autônomos condicionam os usuários a executar programas desconhecidos sem revisão.

Uma edição de SKILL.md é uma mudança de produção — mesmo quando nenhum código foi alterado
As habilidades do workspace no OpenClaw podem substituir versões empacotadas e alterar o comportamento do agente. Trate os arquivos SKILL.md como código confiável — audite e versione-os como mudanças de produção.

Vulnerabilidades Críticas de Segurança do OpenClaw Corrigidas em 28/03/2026.
A versão 2026.3.28 do OpenClaw corrige 8 vulnerabilidades críticas de segurança descobertas pelo Ant AI Security Lab, incluindo bypass de sandbox, escalonamento de privilégios e riscos de SSRF. Usuários nas versões ≤2026.3.24 devem atualizar imediatamente.

Os LLMs podem identificar usuários anônimos de fóruns com 68% de precisão e 90% de acurácia.
Pesquisadores usaram Gemini e ChatGPT para analisar postagens do Hacker News e Reddit, identificando 68% dos usuários anônimos com 90% de precisão. Os modelos completaram em minutos o que levaria horas para humanos ou seria impossível.