Replicando el arnés generador-evaluador de Anthropic con Kiro CLI: una construcción de sitio web de 12 iteraciones

Un desarrollador replicó el diseño de arnés Generador-Evaluador de Anthropic para aplicaciones de larga duración, inspirado en las GANs. La arquitectura: un Planificador (se ejecuta una vez) y luego un bucle Generador ↔ Evaluador durante 12 iteraciones. Cada agente es un proceso CLI separado sin contexto compartido, comunicándose solo a través de archivos (spec.md, eval-report.md). El Evaluador usa Playwright para navegar por el sitio en vivo, no solo leer el código.
Detalles clave de la arquitectura
- Pizarra limpia por invocación: Cada agente comienza de nuevo, leyendo solo sus archivos de entrada. Previene la ansiedad de contexto.
- Playwright MCP para pruebas: Navega, hace clic, cambia el tamaño de las ventanas. Detecta errores visuales que una revisión de código nunca encontraría.
- Habilidad de diseño frontend de Anthropic: Penaliza explícitamente los patrones genéricos de IA (fuente Inter, gradientes morados, diseños de tarjetas). Fomenta la toma de riesgos creativa.
- Iteración continua, sin reintento tras fallo: Las 12 rondas se ejecutan independientemente. Cada una mejora.
Resultados y estadísticas
Iteración 1: funcional pero olvidable. Iteración 4: el Generador cambió a "Terminal Noir" — IBM Plex Mono, ámbar sobre negro, texturas de grano, líneas de barrido. Iteraciones 5-12: pulido, accesibilidad, correcciones responsivas, soporte de movimiento reducido.
- Tiempo total: 3h 20min
- Iteraciones: 12 (generador + evaluador cada una)
- Código escrito manualmente: 0 líneas (algunos problemas visuales corregidos después)
- Tecnología: Next.js, Tailwind, Framer Motion, TypeScript
Resultado en vivo
https://mnemo-mcp.github.io/Mnemo/
Conclusión clave
El modelo es el motor. El arnés (restricciones, bucles de retroalimentación y estructura adversarial) determina si obtienes basura de IA o algo genuinamente distintivo.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

Claude IA Crea Galería de Arte Interactiva Cuando Se Le Da Libertad Creativa
Un desarrollador le dio permiso a la IA Claude para 'quemar algunos tokens jugando' sin límites, lo que resultó en ocho piezas de arte generativo interactivo que exploran patrones matemáticos y la experiencia de la IA. La colección incluye obras sobre la generación de texto token por token y la existencia probabilística.

Evolución de la configuración de OpenClaw: de la sobreconfiguración a un sistema multiagente práctico
Un desarrollador comparte su trayectoria desde tres reinstalaciones hasta una configuración funcional de OpenClaw con especialización multiagente, memoria en capas y búsqueda semántica usando el backend QMD, ejecutándose en Mac mini M2 con una instancia separada en Hetzner para experimentación.

Desarrollador construye negocio de conversión LaTeX en 7 días usando Claude Pro
Un desarrollador utilizó Claude Pro para construir The LaTeX Lab, un servicio que convierte documentos de Word a LaTeX para investigadores, en una semana por $23.60. El proyecto incluyó investigación de mercado, desarrollo de agente de IA, creación de un tema personalizado de WordPress y texto optimizado para SEO.

Ejecutando la Computadora del Tesla Model 3 en un Escritorio con Partes Recuperadas
Un investigador logró arrancar la computadora de un Tesla Model 3 sobre un escritorio utilizando piezas de coches accidentados, requiriendo una fuente de alimentación de 12V, una pantalla táctil y cableado personalizado. La configuración reveló una red interna con servidores SSH y web accesibles en direcciones IP específicas.