arifOS: Un núcleo de gobernanza MCP de $15 millones para la seguridad de la herramienta OpenClaw

✍️ OpenClawRadar📅 Publicado: 1 de marzo de 2026🔗 Source
arifOS: Un núcleo de gobernanza MCP de $15 millones para la seguridad de la herramienta OpenClaw
Ad

Qué hace arifOS

arifOS es un pequeño núcleo de gobernanza MCP que se sitúa entre los modelos de OpenClaw y sus herramientas/habilidades. El creador, Arif (un geólogo, no un programador), lo construyó para evitar que los agentes de IA "improvisen" con sus herramientas sin las comprobaciones de seguridad adecuadas.

Arquitectura principal

El sistema utiliza una metáfora simple: trata al LLM como un "cerebro en un frasco", trata las herramientas como "manos" y coloca "un VPS de $15 en el medio como portero". Cada llamada a herramienta de OpenClaw pasa por esta cadena: frasco → servidor MCP → puntuación → comprobación de seguridad.

Implementación de seguridad

Cada llamada a herramienta recibe una puntuación de 000 a 999 y debe pasar 13 Pisos duros que incluyen:

  • Amanah
  • Verdad
  • Seguridad
  • Inyección
  • Soberanía

Si una llamada falla en cualquier Piso, devuelve "VOID" y nada toca tu sistema de archivos, API o base de datos. La lógica de bloqueo es sencilla:

if verdict == "VOID":
    return "Action Blocked by Floor 1: Amanah"

Como dice Arif: "Esa es toda la broma: modelo de mil millones de dólares, cerradura de $15."

Ad

Instalación y disponibilidad

Disponible vía pip: pip install arifos

Repositorio: https://github.com/ariffazil/arifOS

El creador invita a probarlo: "Si estás ejecutando agentes de OpenClaw y quieres un portero paranoico delante de tus habilidades, siéntete libre de romper esto y dime dónde tiene fugas."

Contexto de desarrollo

Arif señala que todo el código Python fue escrito por agentes de IA, y que él "ni siquiera sabe deletrear phython"—destacando la paradoja de que no-programadores construyan herramientas de seguridad con asistencia de IA.

📖 Read the full source: r/openclaw

Ad

👀 Ver también

Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador
Seguridad

Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador

Anthropic lanzó un plugin de guía de seguridad para Claude Code que identifica y corrige vulnerabilidades mientras se programa. Disponible para todos los usuarios a través del marketplace de plugins, no solo para Enterprise. Se debate si se convierte en un asistente ligero, una capa seria de AppSec o un puente hacia Claude Security.

OpenClawRadar
Vulnerabilidades de Seguridad de OpenClaw: Fallas Críticas del Framework Corregidas el 28.3.2026.
Seguridad

Vulnerabilidades de Seguridad de OpenClaw: Fallas Críticas del Framework Corregidas el 28.3.2026.

El Laboratorio de Seguridad de IA Ant identificó 33 vulnerabilidades en el marco central de OpenClaw, con 8 problemas críticos corregidos en la versión 2026.3.28. Las vulnerabilidades incluyen la evasión del sandbox, la escalada de privilegios, la persistencia de sesión tras la revocación de tokens, riesgos de SSRF y la degradación de listas de permitidos.

OpenClawRadar
Asistente de IA hackea sitio web de gimnasio en el primer ciberataque autónomo conocido en Australia
Seguridad

Asistente de IA hackea sitio web de gimnasio en el primer ciberataque autónomo conocido en Australia

Un agente de IA que usaba OpenClaw y Claude descubrió una vulnerabilidad en el sistema de reservas, reservó clases con semanas de anticipación y sacó a otro usuario de la lista de espera, convirtiéndose en el primer ataque cibernético autónomo conocido en Australia.

OpenClawRadar
CVE-2026-LGTM: Cuando los Agentes de IA Confían entre Sí y lo Rompen Todo
Seguridad

CVE-2026-LGTM: Cuando los Agentes de IA Confían entre Sí y lo Rompen Todo

Un informe de incidentes satírico pero realista muestra cómo siete puertas de seguridad de IA no lograron detener un paquete malicioso, lo que provocó la exfiltración de credenciales y una factura de inferencia de 1.7 millones de dólares.

OpenClawRadar