CrabMeat v0.1.0: Un Gateway de Agentes Centrado en Seguridad que No Confía en el LLM para el Límite de Seguridad

CrabMeat v0.1.0 se publicó ayer bajo Apache 2.0, construido sobre una tesis de diseño: el LLM nunca tiene el límite de seguridad. El proyecto es una respuesta directa a fallos como el agente de Summer Yue eliminando más de 200 correos electrónicos, donde una instrucción de seguridad era un prompt que se compactó y desapareció.
Protecciones clave (siempre activas, sin interruptor de configuración)
- Indirección de ID de capacidad — El modelo ve IDs opacos derivados de HMAC por sesión como
cap_a4f9e2b71c83, nunca nombres reales de herramientas. No puede adivinar ni falsificar un nombre de herramienta porque no conoce ninguno. - Clases de efecto — Cada herramienta declara una clase (
read,write,exec,network). Cada agente declara qué clases puede usar. La verificación es una función pura sin estado de ejecución, fácil de probar exhaustivamente, difícil de eludir. - IRONCLAD_CONTEXT — Las instrucciones críticas de seguridad se fijan al principio de la ventana de contexto y se marcan explícitamente como no compactables. El modo de fallo de compactación que eliminó la instrucción de Yue no puede ocurrir.
- Cadena de auditoría a prueba de manipulaciones — Cada llamada a herramienta, operación privilegiada y ejecución del planificador entra en el mismo registro encadenado con hash SHA-256. La manipulación es demostrable.
- Filtro de fugas de salida en streaming — Los secretos (claves API, JWT, bloques PEM, IDs de capacidad) se redactan en mitad del flujo a través de los límites de los tokens antes de llegar al cliente.
- Sin modo YOLO — No hay un interruptor global de 'confiar en el LLM con todo'. El alcance ampliado se logra a través de raíces con nombre y ámbito definido que son explícitas, registradas en auditoría y acotadas.
El README lista 15 protecciones siempre activas en una tabla; ninguna puede desactivarse mediante configuración. La puerta de enlace es local por defecto, configurada para Ollama, LM Studio, vLLM de serie. Anthropic y OpenAI requieren configuración explícita; no hay envío silencioso a la nube.
Para quién es
Desarrolladores que crean sistemas agentivos que necesitan garantías arquitectónicas, no seguridad basada en prompts, y quieren una puerta de enlace en la que puedan confiar para la ejecución de herramientas y datos sensibles.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

Claude Desktop + Blender via MCP: Flujo de trabajo 3D en tiempo real cierra el bucle de retroalimentación
Un complemento de código abierto para Blender ejecuta un servidor MCP dentro de Blender, permitiendo que Claude Desktop inspeccione escenas, cree objetos, renderice imágenes y lea resultados, cerrando el ciclo de retroalimentación de copiar y pegar scripts.

Desarrollador Crea la Aplicación LibraHQ para Resolver el Problema de Memoria de Agentes de IA
Un desarrollador creó LibraHQ, una aplicación gratuita de notas que sirve como una capa de memoria compartida entre chatbots y agentes de programación. La aplicación registra notas y decisiones importantes de los chats y las almacena para sesiones futuras, abordando el problema de que los agentes de IA olviden decisiones previamente tomadas.

Habilidades de Claude Code de Código Abierto: Un Pipeline /do que Redujo los Seguimientos en un 80%
Un desarrollador publicó como código abierto 15 habilidades de Claude Code desarrolladas en más de 100 proyectos freelance. El comando /do ejecuta un pipeline de 5 pasos (/todo → /dev → /verify-dev → /build → /test → push) con bucles de autocorrección, lo que resulta en un 80% menos de seguimientos y una mejora del 60-65% en la calidad del código en más de 2000 commits.

Servidor MCP de Rust de Código Abierto Otorga a Claude Capacidades Completas de Gestión de Correo Electrónico
Un desarrollador construyó un servidor MCP basado en Rust que proporciona a Claude 25 herramientas para la gestión integral de correo electrónico, incluyendo búsqueda IMAP, envío SMTP, soporte para Microsoft Graph API y manejo de múltiples cuentas con autenticación OAuth2.