Arquitectura de Validación en Frío: Sistema de Revisión de Código con Agentes Duales de Código Abierto

✍️ OpenClawRadar📅 Publicado: 31 de marzo de 2026🔗 Source
Arquitectura de Validación en Frío: Sistema de Revisión de Código con Agentes Duales de Código Abierto
Ad

Cold Validation Architecture es un sistema de código abierto que implementa validación de doble agente para código generado por IA. Un agente escribe el código, mientras que un agente separado lo revisa de forma independiente sin acceso al razonamiento o contexto del constructor.

Cómo funciona

El sistema aborda el sesgo de autorrevisión de un solo agente aplicando una separación de funciones similar a las auditorías independientes. El revisor opera en completo aislamiento del proceso de pensamiento del constructor.

Fases del flujo de trabajo

  • Escribir plan/review-plan (Puerta A)
  • Implementar/review-impl (Puerta C)
  • Enviar/acceptance-report (Puerta D)

Detalles clave de implementación

  • El revisor se ejecuta en un directorio temporal aislado
  • El revisor solo ve: documento de plan, diferencia de código y resultado de pruebas
  • Los hallazgos persisten con huellas digitales para seguimiento
  • El constructor puede estar en desacuerdo con la justificación del revisor
  • Máximo 2 rondas por fase
  • Construido con scripts bash y esquemas JSON
  • Actualmente funciona con Claude Code + Codex CLI
  • El patrón es independiente del agente (puede funcionar con diferentes agentes de IA)
Ad

Especificaciones técnicas

El sistema se implementa como scripts bash que coordinan entre dos agentes de IA separados. Los esquemas JSON definen la estructura para documentos de plan, revisiones de código e informes de aceptación. El entorno de ejecución aislado garantiza que el revisor no tenga acceso al razonamiento interno o pasos intermedios del constructor.

Este enfoque es útil para desarrolladores que desean implementar una validación más rigurosa para código generado por IA, particularmente cuando trabajan con sistemas complejos donde la autorrevisión de un solo agente podría introducir sesgo de confirmación.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Extensión Codex Chrome agrega automatización del navegador en segundo plano entre pestañas
Herramientas

Extensión Codex Chrome agrega automatización del navegador en segundo plano entre pestañas

La nueva extensión de Chrome de Codex en macOS/Windows permite la ejecución paralela de tareas en el navegador en pestañas de fondo sin tomar el control — cubriendo flujos de depuración, paneles, investigación y actualizaciones de CRM.

OpenClawRadar
OpenMontage: Sistema de Producción de Video Agéntico de Código Abierto para Asistentes de Codificación con IA
Herramientas

OpenMontage: Sistema de Producción de Video Agéntico de Código Abierto para Asistentes de Codificación con IA

OpenMontage es un sistema de producción de vídeo de código abierto que transforma asistentes de codificación con IA como Claude Code en estudios de producción completos. Maneja investigación, planificación de escenas, escritura de guiones, narración de voz, selección de música, generación de subtítulos y validación a través de flujos de trabajo automatizados.

OpenClawRadar
devcontainer-mcp: Dale a los agentes de IA su propio entorno de desarrollo, no el tuyo
Herramientas

devcontainer-mcp: Dale a los agentes de IA su propio entorno de desarrollo, no el tuyo

devcontainer-mcp es un servidor MCP que expone 45 herramientas para que agentes de IA creen, gestionen y trabajen dentro de contenedores de desarrollo respaldados por Docker, DevPod o GitHub Codespaces, manteniendo limpia la máquina anfitriona.

OpenClawRadar
Spec27: Validación basada en especificaciones para agentes de IA – Pruebas a nivel de API sin acceso interno
Herramientas

Spec27: Validación basada en especificaciones para agentes de IA – Pruebas a nivel de API sin acceso interno

Spec27 es una nueva herramienta de Safe Intelligence para la validación basada en especificaciones de agentes de IA. Prueba el comportamiento del agente desde afuera hacia adentro, ejecutando comprobaciones adversariales y de robustez contra interfaces principales sin necesidad de SDK, pasarelas o trazas internas.

OpenClawRadar