Pasaporte de Decisión: Una Capa de Auditoría para la Gobernanza de la Ejecución de Agentes de IA

Lo que aborda Decision Passport
La reciente discusión sobre la filtración del código fuente de Claude en r/LocalLLaMA resalta una brecha arquitectónica crítica en los sistemas de agentes de IA. A medida que los agentes adquieren capacidades como acceso a herramientas, acceso al navegador, manejo de memoria, ejecución en segundo plano y flujos de trabajo de múltiples pasos, la pregunta de gobernanza cambia de "¿puede el agente hacer un trabajo útil?" a preguntas de responsabilidad.
La brecha de gobernanza
La fuente identifica preguntas clave que las herramientas actuales de registro y observabilidad no abordan completamente:
- ¿Quién autorizó esta acción?
- ¿Bajo qué política?
- ¿Qué contexto de ejecución existía en ese momento?
- ¿Qué cambió?
- ¿Qué fue bloqueado?
- Si ese registro aún puede ser confiable más tarde fuera del entorno de ejecución original
El autor señala: "Los registros te ayudan a inspeccionar. La prueba te ayuda a defender."
Características de Decision Passport
La herramienta proporciona:
- Registros de ejecución de solo anexión
- Paquetes de prueba portátiles
- Verificación sin conexión
- Cadenas resistentes a manipulaciones
- Diseño centrado en el verificador
El autor aclara que esto no "resuelve" por sí mismo el escape del entorno aislado o la seguridad del agente, pero hace más visible la brecha de gobernanza y proporciona respuestas más sólidas sobre qué sucedió, en qué orden, bajo qué permiso, con qué evidencia y si alguien puede verificarlo más tarde sin confiar en la plataforma original.
Repositorios disponibles
El proyecto es de código abierto con dos componentes principales:
- Núcleo:
https://github.com/brigalss-a/decision-passport-core - OpenClaw Lite:
https://github.com/brigalss-a/decision-passport-openclaw-lite
Puntos de discusión
La fuente plantea preguntas para que la comunidad considere:
- ¿Es esto solo una mejor observabilidad?
- ¿Una capa de auditoría/prueba faltante?
- ¿Sobreingeniería para la mayoría de los flujos de trabajo de agentes?
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Auditoría SecureCode: Un Auditor de Seguridad para Servidores Linux Construido con Claude Code
Un desarrollador independiente creó SecureCode Audit usando Claude Code — ejecuta un comando SSH y obtén un informe de seguridad con 22 comprobaciones y correcciones priorizadas. Los primeros 30 registrados obtienen la auditoría completa gratis.

Bernstein: Un orquestador similar a Kubernetes para agentes de codificación de IA con verificación y políticas de modelos.
Bernstein es un orquestador para agentes de codificación con IA que incluye verificación independiente de las salidas de los agentes, controles de políticas de modelos, 13 adaptadores de agentes y programación determinista basada en Python. El proyecto tiene más de 5000 pruebas y características como interruptores de circuito, detección de anomalías de costos y escaneo de información personal identificable (PII).

Agente Smith: Un comando para andamiar servidores MCP, habilidades y un pipeline de Ticket a PR para Claude Code
Agent Smith escanea tu repositorio, detecta la pila exacta (Go/Echo, React/Zustand, golang-jwt, pgx, etc.), configura servidores MCP, hooks y skills adaptados a tu configuración, y proporciona un pipeline autónomo de ticket a PR.

Extensión Codex Chrome agrega automatización del navegador en segundo plano entre pestañas
La nueva extensión de Chrome de Codex en macOS/Windows permite la ejecución paralela de tareas en el navegador en pestañas de fondo sin tomar el control — cubriendo flujos de depuración, paneles, investigación y actualizaciones de CRM.