Como Scripts de Teste Frágeis Causaram Atrasos na Liberação e o que uma Equipe Fez a Respeito

O Problema: Testes Frágeis Ocultos por Métricas
Uma equipe de aplicativo para consumidores com cerca de 15 engenheiros tinha o que consideravam uma configuração de QA decente, com mais de 200 casos de teste. Eles mediam a saúde do QA pela contagem de casos de teste, o que parecia ótimo no papel.
Quando o engenheiro de QA saiu de licença-paternidade em março, o pipeline de CI começou a falhar em fluxos que estavam estáveis há meses. O problema: uma atualização da interface duas sprints antes havia deslocado elementos, e os localizadores dos scripts Appium estavam apontando para elementos movidos ou renomeados. O aplicativo parecia quase idêntico para os usuários, mas os scripts não conseguiam se adaptar.
Três pessoas tentaram corrigir, incluindo dois engenheiros que não tocavam na suíte de testes há meses. Levou a maior parte de uma semana, e uma versão foi lançada sem testes de regressão adequados porque os prazos não mudaram.
O Custo Real da Manutenção
Quando o engenheiro de QA retornou, ele revelou que 50-60% de sua semana era gasta mantendo scripts: atualizando localizadores, corrigindo coisas que quebravam após mudanças na interface e mantendo a suíte de testes viva. Apenas cerca de um terço do seu tempo era realmente gasto encontrando bugs.
A equipe percebeu que estava medindo a coisa errada. Ninguém estava rastreando quanto tempo era gasto apenas para evitar que os testes se desfizessem.
A Solução: Indo Além dos Localizadores
A equipe tem reconstruído sua suíte de testes nos últimos meses usando uma ferramenta que não depende de localizadores. Os testes são escritos em inglês simples, e a ferramenta lê a tela da maneira como um humano faria. Quando a interface muda, ela se adapta.
O engenheiro de QA relatou que, pela primeira vez em dois anos, chegou a uma segunda-feira sem uma lista de scripts quebrados para corrigir antes de poder fazer seu trabalho real.
O problema dos localizadores vinha silenciosamente estabelecendo um limite para a velocidade com que podiam lançar, e eles não o perceberam completamente até que desabou.
📖 Read the full source: r/openclaw
👀 See Also

Jogo de Viagem no Tempo do Claude Evolui de Prompt para Sistema Completo Implantado
Um usuário do Reddit descreve como evoluiu um prompt de RPG de viagem no tempo no Claude em um sistema complexo ao longo de 40 dias, adicionando arquivos de estado YAML, mais de 50 NPCs, gatilhos de eventos e eventualmente implantando-o no Fly com um banco de dados e um servidor MCP personalizado para acesso multiplataforma.

API de Lote Custo-Eficaz para Alterações de Código em Múltiplos Arquivos
Um desenvolvedor relata o uso do Claude Sonnet e Opus para processamento em lote para modificar mais de 30 arquivos e gerar 3 mil linhas de código por aproximadamente £2, com prompts específicos e ferramentas como Repomix para coleta de conteúdo e Minimax para limpeza.

Fundador não técnico constrói marketplace de produção com Claude Code
Um fundador não técnico usou o Claude Code no terminal para construir um marketplace bilateral com Next.js, TypeScript, Supabase, Tailwind e implantação no Vercel, incluindo autenticação completa, RLS e migrações de banco de dados.

Desenvolvedor Usa Claude AI para Construir o Aplicativo PosturePal de Escaneamento de Postura
Um desenvolvedor criou o PosturePal: Posture Scanner usando a Claude AI para múltiplos aspectos, incluindo código, decisões de produto, comunicação de feedback do usuário e redação. O aplicativo analisa fotos de perfil lateral para fornecer pontuações de postura, identificar problemas específicos e gerar exercícios personalizados.