Pasaporte de Decisión: Una Capa de Auditoría para la Gobernanza de la Ejecución de Agentes de IA

Lo que aborda Decision Passport
La reciente discusión sobre la filtración del código fuente de Claude en r/LocalLLaMA resalta una brecha arquitectónica crítica en los sistemas de agentes de IA. A medida que los agentes adquieren capacidades como acceso a herramientas, acceso al navegador, manejo de memoria, ejecución en segundo plano y flujos de trabajo de múltiples pasos, la pregunta de gobernanza cambia de "¿puede el agente hacer un trabajo útil?" a preguntas de responsabilidad.
La brecha de gobernanza
La fuente identifica preguntas clave que las herramientas actuales de registro y observabilidad no abordan completamente:
- ¿Quién autorizó esta acción?
- ¿Bajo qué política?
- ¿Qué contexto de ejecución existía en ese momento?
- ¿Qué cambió?
- ¿Qué fue bloqueado?
- Si ese registro aún puede ser confiable más tarde fuera del entorno de ejecución original
El autor señala: "Los registros te ayudan a inspeccionar. La prueba te ayuda a defender."
Características de Decision Passport
La herramienta proporciona:
- Registros de ejecución de solo anexión
- Paquetes de prueba portátiles
- Verificación sin conexión
- Cadenas resistentes a manipulaciones
- Diseño centrado en el verificador
El autor aclara que esto no "resuelve" por sí mismo el escape del entorno aislado o la seguridad del agente, pero hace más visible la brecha de gobernanza y proporciona respuestas más sólidas sobre qué sucedió, en qué orden, bajo qué permiso, con qué evidencia y si alguien puede verificarlo más tarde sin confiar en la plataforma original.
Repositorios disponibles
El proyecto es de código abierto con dos componentes principales:
- Núcleo:
https://github.com/brigalss-a/decision-passport-core - OpenClaw Lite:
https://github.com/brigalss-a/decision-passport-openclaw-lite
Puntos de discusión
La fuente plantea preguntas para que la comunidad considere:
- ¿Es esto solo una mejor observabilidad?
- ¿Una capa de auditoría/prueba faltante?
- ¿Sobreingeniería para la mayoría de los flujos de trabajo de agentes?
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Código de Claude Utilizado para Simular Más de 4,000 Juegos de Hombre Lobo Ciego con LLMs
Un desarrollador utilizó Claude Code para construir un simulador donde los LLM juegan al Werewolf ciego de una noche, ejecutando aproximadamente 4,600 juegos en modelos de OpenAI y xAI. El experimento reveló patrones de votación consistentes basados en nombres a pesar de las señales mínimas del juego.

Claude-Real-Video: Extracción de Fotogramas Consciente de la Escena + Transcripción para Cualquier LLM
Una herramienta de código abierto que extrae fotogramas con detección de escenas y transcripciones de audio de videos, permitiendo que cualquier LLM "vea" un video localmente sin necesidad de subirlo. Incluye detección de cambios de escena, deduplicación por ventana deslizante y transcripción con Whisper.

SDK de código abierto para el trabajo de conocimiento en IA
ClioAI ha lanzado el <strong>kw-sdk</strong>, un Kit de Desarrollo de Software de código abierto diseñado para dar estructura a los agentes de IA que realizan tareas en sectores de trabajo del conocimiento, como investigación, análisis, estrategia y redacción. A diferencia de los marcos de código tradicionales, que tienen señales naturales de verificación a través de pruebas, el trabajo del conocimiento requiere enfoques estructurados para la verificación y evaluación de tareas.

Reduciendo la Latencia del Agente Multimodal al Omitir el Historial de Capturas de Pantalla
Un desarrollador descubrió que omitir capturas de pantalla anteriores de las solicitudes de agentes multimodales y reemplazar los datos de imagen en base64 con cadenas "[imagen omitida]" reduce significativamente la latencia mientras mantiene el rendimiento. El experimento se realizó usando Claude y está documentado en GitHub.