Reproduction du harnais générateur-évaluateur d'Anthropic avec Kiro CLI : Construction d'un site web en 12 itérations

Un développeur a reproduit le concept du Générateur-Évaluateur d'Anthropic pour des applications longues, inspiré des GAN. L'architecture : un Planificateur (exécuté une fois) puis une boucle Générateur ↔ Évaluateur pendant 12 itérations. Chaque agent est un processus CLI distinct sans contexte partagé, communiquant uniquement via des fichiers (spec.md, eval-report.md). L'Évaluateur utilise Playwright pour naviguer sur le site en direct, pas seulement lire le code.
Détails clés de l'architecture
- Page blanche à chaque invocation : Chaque agent démarre à zéro, ne lit que ses fichiers d'entrée. Évite l'anxiété de contexte.
- Playwright MCP pour les tests : Navigue, clique, redimensionne les fenêtres. Détecte les bugs visuels qu'une revue de code ne verrait jamais.
- Compétence en design frontend d'Anthropic : Pénalise explicitement les motifs génériques de l'IA (police Inter, dégradés violets, dispositions en cartes). Force la prise de risque créative.
- Itération continue, pas de réessai en cas d'échec : Les 12 tours s'exécutent quoi qu'il arrive. Chacun apporte une amélioration.
Résultats et statistiques
Itération 1 : fonctionnelle mais oubliable. Itération 4 : le Générateur est passé à "Terminal Noir" — IBM Plex Mono, ambre sur fond noir, textures de grain, lignes de balayage. Itérations 5-12 : polissage, accessibilité, corrections responsives, prise en charge des mouvements réduits.
- Temps total : 3 h 20 min
- Itérations : 12 (générateur + évaluateur chacune)
- Code écrit manuellement : 0 ligne (quelques problèmes visuels corrigés après)
- Technologies : Next.js, Tailwind, Framer Motion, TypeScript
Résultat en direct
https://mnemo-mcp.github.io/Mnemo/
Enseignement clé
Le modèle est le moteur. Le harnais — contraintes, boucles de rétroaction et structure adversariales — détermine si vous obtenez du brouet IA ou quelque chose de vraiment distinctif.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Construit un pipeline quotidien YouTube → LinkedIn avec OpenClaw : Architecture, pièges et leçons apprises
Un développeur partage l'architecture d'une compétence OpenClaw qui récupère quotidiennement 30 chaînes YouTube, analyse les transcriptions via un LLM et écrit dans Google Sheets. Il détaille les pièges clés comme Apify async vs sync, le watchdog de tour inactif de Codex et les limites ARG_MAX.

Claude + Remotion : Créer une vidéo de lancement de produit sans aucune compétence en animation
Un développeur a utilisé la connaissance approfondie de Claude sur l'API de Remotion pour créer une vidéo de lancement de produit animée de 30 secondes pour une application boursière — sans transitions CSS, avec physique à ressort, effets de machine à écrire et animations décalées sur 10 fichiers de scène.

Utilisation de Claude Code avec les outils MCP pour la prospection automatisée de leads
Un professionnel des ventes rapporte avoir réduit le temps de recherche de prospects de 2-3 heures à 30 minutes quotidiennement en utilisant Claude Code connecté à des outils MCP. La configuration interroge des sources de données réelles et renvoie des listes de prospects structurées avec enrichissement et notation ICP.

Le développeur utilise Claude pour créer une application complète de journal de rêves, puis supprime toutes les fonctionnalités d'IA du produit final.
Un fondateur solo a entièrement construit l'application d'incubation de rêves Somnia en utilisant Claude pour toutes les tâches de codage, puis a délibérément supprimé toutes les fonctionnalités d'IA du produit final. L'application utilise Next.js, Supabase et un service worker, mais ne contient aucune interprétation ou suggestion d'IA.