Un Flujo de Desarrollo TDD Utilizando Agentes de IA para Proyectos de Sitios Web

Flujo de Trabajo de Desarrollo con Agentes de IA
Un desarrollador describe su enfoque para el desarrollo de sitios web utilizando agentes de codificación con IA mediante una metodología de desarrollo guiado por pruebas. Utilizan tanto Claude Code para proyectos laborales como modelos locales para proyectos privados, específicamente Qwen Code sobre Qwen3.5-27B ejecutándose en llama.cpp con 2xRTX 3090 GPUs.
Configuración Inicial del Proyecto
Al inicio de un proyecto, implementan módulos básicos:
- Esquema básico de base de datos
- API básica de autenticación
- Enrutamiento de interfaz de usuario
- Diseño básico de interfaz de usuario
- API básica (administradores y usuarios)
- Pruebas básicas de API/E2E (escritas manualmente o por IA)
- Archivos de contexto para agentes de codificación (AGENTS.md, CLAUDE.md)
Proceso de Desarrollo Iterativo
Después de la configuración, comienza el proceso iterativo:
- Escribir especificaciones detalladas de pruebas API/E2E en markdown para una funcionalidad
- Generar pruebas API/E2E a partir de las descripciones de pruebas en markdown
- Iniciar sesión del agente de codificación con capacidad para ejecutar pruebas
- Solicitar al agente que implemente la funcionalidad hasta que las pruebas pasen
Capacidades y Compensaciones de los Modelos
El desarrollador señala que modelos más capaces como Claude permiten omitir completamente los archivos markdown para sitios web simples, mientras que Qwen3.5-27B tiene umbrales diferentes. Los modelos menos capaces requieren instrucciones más específicas para mitigar modos de fallo, incluyendo bloquear lógica instruyendo no tocar ciertos archivos o usar solo envoltorios específicos.
Hipotetizan que los desarrolladores no deberían obsesionarse con patrones y calidad del código si el código está cubierto por pruebas y funciona, comparando los agentes de IA con gestionar 10-100 desarrolladores junior/intermedios al costo de una suscripción de IA.
Especificaciones del Modelo Local
Para modelos locales ejecutándose en 2xRTX3090, utilizan Qwen3.5-27B-GGUF-Q8_0 con paralelo = 1 y contexto completo, creyendo que esto es importante para que las sesiones agenticas no sean autocomprimidas tempranamente. Notan que modelos menos inteligentes obligan a una articulación más clara de pruebas E2E y la implementación deseada, mientras que Claude completa automáticamente las decisiones de diseño pero puede llevar a pérdida de control.
Implementación del Bucle TDD de Codificación
El desarrollador proporciona un borrador de su bucle TDD de codificación:
comienza el bucle externo: ejecutar todas las pruebas pytest usando el comando `pytest tests/ -x` y saldrá si no hay fallos; el nivel de registro predeterminado será warning, por lo que no habrá mucha salida allí
si todo pasa; salir del bucle externo; si algo falló, extrae el nombre de la prueba fallida
ejecuta el nombre de la prueba fallida con registros completos, como `pytest tests/../test_first_failing_test.py --log-level DEBUG` y recoge la salida de las pruebas en el archivo
extrae líneas cerca de las cadenas 'error'/'fail' con `egrep -i -C 10 '(error|fail)' <failEste enfoque representa una implementación práctica de TDD con agentes de IA, equilibrando automatización con la supervisión necesaria para mantener el control de la base de código.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Fundador no técnico crea aplicación de ficción lenta con Claude: React Native, lógica de ramificación y monetización
Un ex trabajador humanitario utilizó Claude para construir The Parallel, una aplicación de ficción lenta que ofrece una escena por día con opciones ramificadas, paisajes sonoros ambientales y sin mecanismos de atracones.

Los Usuarios de Claude Code Reportan Problemas de Consistencia en el Desarrollo de Producción
Un suscriptor pagado de Claude Code reporta desafíos significativos al usar la herramienta para un proyecto de panel de control empresarial basado en Flask a lo largo de 22+ sesiones de desarrollo, citando tres patrones recurrentes de incumplimiento de instrucciones que llevaron a pérdida de productividad y problemas técnicos.

El agente de IA OpenClaw autoalojado crea un sistema de rendición de cuentas pasivo para desarrolladores.
Un desarrollador que ejecuta OpenClaw en un Mac mini las 24 horas del día, los 7 días de la semana, informa que la memoria persistente del agente de IA sobre tareas y proyectos crea un sistema de responsabilidad efectivo, ayudando a completar proyectos que antes se estancaban.

Desarrollador depura error redundante en el service worker de PWA en Next.js con la ayuda de Claude.
Un desarrollador creó Somnia, una PWA de Next.js 14 con notificaciones push, usando Claude como compañero de codificación. El error más difícil involucró a los service workers que se volvían REDUNDANT en Android Samsung debido a un ID de compilación obsoleto en sw.js.