Règles de la Griffe : Ensemble de Règles de Sécurité Open Source pour les Agents OpenClaw

✍️ OpenClawRadar📅 Publié: March 28, 2026🔗 Source
Règles de la Griffe : Ensemble de Règles de Sécurité Open Source pour les Agents OpenClaw
Ad

Ensemble de Règles de Sécurité en Production pour les Agents OpenClaw

Rules of the Claw est un ensemble de règles JSON qui agit comme une couche de refus strict au-dessus des appels d'outils des agents dans OpenClaw. Il aborde le risque de sécurité des agents ayant un large accès aux outils, qui pourraient être vulnérables à des installations de compétences malveillantes ou à des injections d'invites pouvant causer de réels dommages.

Fonctionnalités de Sécurité Clés

  • Bloque les exécutions destructrices, y compris rm -rf sur les répertoires workspace/config, les opérations pipe-to-shell et les appels curl vers des exécutables inconnus
  • Protège les fichiers d'identification contre les lectures et écritures : openclaw.json, auth-profiles.json et les fichiers du répertoire .secrets/
  • Préserve les fichiers d'instructions (SOUL.md, AGENTS.md) contre les modifications non autorisées par les agents
  • Interdit les outils de reconnaissance réseau, notamment nmap, masscan et netcat
  • Bloque les lectures par les agents des profils d'authentification d'autres agents
Ad

Implémentation Technique

L'ensemble de règles contient 139 règles au total avec trois configurations prédéfinies : minimal, standard et strict. Il est livré avec un schéma JSON, des scripts de validation et une compétence d'installation en une commande. La décision de conception clé est l'absence totale de dépendance LLM - les règles s'exécutent au niveau de la couche d'outils via des motifs regex, offrant une latence en microsecondes. Contrairement aux garde-fous basés sur les LLM, les motifs regex ne peuvent pas être manipulés socialement ou faire l'objet d'injections d'invites.

Disponibilité et Licence

Le projet est disponible sur github.com/Bahuleyandr/rules-of-the-claw et est sous licence MIT. Le créateur accueille favorablement les pull requests pour de nouveaux motifs de règles.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Recherche : Les caractères Unicode invisibles peuvent détourner les agents LLM via l'accès aux outils
Security

Recherche : Les caractères Unicode invisibles peuvent détourner les agents LLM via l'accès aux outils

Une étude a testé si les LLM suivent des instructions cachées dans des caractères Unicode invisibles intégrés dans du texte normal, en utilisant deux schémas d'encodage sur cinq modèles et 8 308 sorties évaluées. Résultat clé : l'accès aux outils amplifie la conformité de moins de 17 % à 98-100 %, les modèles écrivant des scripts Python pour décoder les caractères cachés.

OpenClawRadar
Le système d'IA découvre 12 zero-days dans OpenSSL, Curl annule son programme de prime aux bogues à cause du spam généré par l'IA.
Security

Le système d'IA découvre 12 zero-days dans OpenSSL, Curl annule son programme de prime aux bogues à cause du spam généré par l'IA.

Le système d'IA d'AISLE a découvert les 12 vulnérabilités zero-day dans la dernière mise à jour de sécurité d'OpenSSL, marquant la première démonstration à grande échelle de la cybersécurité basée sur l'IA. Pendant ce temps, curl a annulé son programme de prime aux bogues en raison des soumissions de spam générées par l'IA.

OpenClawRadar
Clawndom : Un crochet de sécurité pour Claude Code pour bloquer les paquets npm vulnérables
Security

Clawndom : Un crochet de sécurité pour Claude Code pour bloquer les paquets npm vulnérables

Un développeur a créé Clawndom, un crochet open-source pour Claude Code qui vérifie les packages npm dans la base de données de vulnérabilités OSV.dev avant l'installation, bloquant les packages vulnérables connus tout en préservant l'autonomie de l'agent.

OpenClawRadar
Injection d’invites multi-messages : le schéma d’attaque « créature fictive » contre Claude
Security

Injection d’invites multi-messages : le schéma d’attaque « créature fictive » contre Claude

Une attaque qui construit une règle fictive en trois messages, puis invoque un fantôme pour l'activer — chaque message inoffensif isolément. Le modèle converge indépendamment chez les attaquants.

OpenClawRadar