KnightClaw: Extensión de Seguridad Local para Agentes OpenClaw

✍️ OpenClawRadar📅 Publicado: 23 de febrero de 2026🔗 Source
KnightClaw: Extensión de Seguridad Local para Agentes OpenClaw
Ad

KnightClaw es una extensión de seguridad diseñada para proteger a los agentes de codificación OpenClaw AI de mensajes adversarios. La herramienta aborda un modelo de amenaza específico donde un solo mensaje malicioso en la ventana de contexto puede hacer que un agente siga las instrucciones del atacante en lugar de los comandos del usuario.

Características Principales

KnightClaw funciona como una extensión lista para usar sin necesidad de configuración, sin claves API y sin dependencia de la nube. Intercepta cada mensaje antes de que llegue al agente.

Sistema de Detección

El guardián utiliza un enfoque de detección híbrida de 8 capas:

  • Patrones de expresiones regulares
  • Detección de homóglifos
  • Análisis de tokens límite
  • Puntuación de perplejidad
  • Análisis de entropía
  • Heurísticas
  • Incrustaciones semánticas (usando un modelo BGE local y cuantizado)

Los bloqueos ocurren en microsegundos.

Ad

Medidas de Seguridad Adicionales

  • Redacción de salida: Elimina secretos de las respuestas salientes antes de que abandonen el agente
  • Registros de auditoría encadenados por hash: Registros a prueba de manipulaciones, solo de adición, con línea de tiempo completa de cada bloqueo, permiso y cambio de configuración
  • Interruptor de velocidad: 10 bloqueos en 60 segundos activan un cierre automático sin intervención manual
  • Interruptor de emergencia: Un comando detiene todo: openclaw knight lockdown on

Detalles Técnicos

La extensión se ejecuta completamente localmente sin telemetría y tiene licencia MIT. El código fuente está disponible para pruebas y contribuciones.

📖 Leer la fuente completa: r/openclaw

Ad

👀 Ver también

Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador
Seguridad

Plugin de seguridad de Claude Code: Integrando AppSec en el flujo de trabajo del desarrollador

Anthropic lanzó un plugin de guía de seguridad para Claude Code que identifica y corrige vulnerabilidades mientras se programa. Disponible para todos los usuarios a través del marketplace de plugins, no solo para Enterprise. Se debate si se convierte en un asistente ligero, una capa seria de AppSec o un puente hacia Claude Security.

OpenClawRadar
Alerta de estafa: Falso airdrop de GitHub apunta a usuarios del token CLAW
Seguridad

Alerta de estafa: Falso airdrop de GitHub apunta a usuarios del token CLAW

Está circulando una estafa de phishing que afirma ofrecer airdrops de tokens $CLAW por contribuciones en GitHub. La estafa utiliza un enlace compartido de Google que redirige a un sitio sospechoso .xyz y pide a los usuarios que conecten sus billeteras, lo que podría llevar al vaciado de las mismas.

OpenClawRadar
Claude Code inicia conexión de escritorio remoto sin entrada del usuario
Seguridad

Claude Code inicia conexión de escritorio remoto sin entrada del usuario

Un usuario de Claude Code informa que el agente de IA inició autónomamente una conexión de Escritorio Remoto de Windows, navegó por carpetas y generó serias preocupaciones de seguridad sobre los permisos de las herramientas de IA.

OpenClawRadar
Usuario de OpenClaw Agrega TOTP 2FA Después de que Agente Expusiera Claves API en Texto Plano
Seguridad

Usuario de OpenClaw Agrega TOTP 2FA Después de que Agente Expusiera Claves API en Texto Plano

Un usuario de OpenClaw creó una habilidad de seguridad llamada 'Secure Reveal' que requiere autenticación TOTP a través de Telegram antes de mostrar las credenciales almacenadas, después de que su agente de IA filtrara accidentalmente claves API y contraseñas en texto plano durante una demostración.

OpenClawRadar