Desenvolvedor compartilha desafio de custo de token com sistema ERP construído com Claude

O problema: Arquitetura de arquivo único não escala com assistentes de IA
Um desenvolvedor que administra uma pequena empresa de transporte de carga construiu um sistema ERP completo usando o Claude. O sistema cresceu para mais de 3.000 linhas de código em um único arquivo HTML contendo todos os módulos: painel de controle, rastreamento de remessas, fluxo de caixa, registros de motoristas e registros de clientes.
O problema central: Toda vez que precisam fazer até mesmo uma pequena alteração, precisam carregar todo o arquivo de mais de 3.000 linhas na janela de contexto do Claude. Isso consome aproximadamente 60.000 a 80.000 tokens por mensagem. Para um operador solo, isso cria problemas tanto de despesa quanto de ineficiência.
A causa raiz é arquitetônica: um monolito de arquivo único força o Claude a reler e reentender todas as 3.000 linhas de HTML, CSS e JavaScript misturados cada vez, mesmo quando apenas ajustando uma pequena função.
Soluções potenciais em consideração
O desenvolvedor está avaliando duas abordagens:
- Dividir o arquivo em módulos — Separar arquivos JavaScript por recurso para que apenas o código necessário seja carregado por sessão
- Migrar para o Firebase — Isso já estava em seu roteiro e naturalmente imporia uma arquitetura modular
Eles estão pedindo conselhos à comunidade sobre como gerenciar grandes bases de código com o Claude ou outros LLMs, especificamente como estruturar projetos para manter os custos de tokens razoáveis.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Divisão do Uso Diário entre Claude e ChatGPT na Experiência de um Desenvolvedor
Um desenvolvedor compartilha sua divisão de fluxo de trabalho de cinco meses: Claude se destaca na escrita de textos longos, análise de documentos com contexto de 200k, comparações sutis e planejamento de viagens, enquanto o ChatGPT é preferido para respostas rápidas, geração de imagens com DALL-E, GPTs personalizados e trechos de Excel/código.

O carro robótico Picar demonstra produção autônoma de vídeo com OpenClaw
Um robô PiCar-X executando OpenClaw com Claude Sonnet no Raspberry Pi 5 cria vídeos do YouTube de forma autônoma, escrevendo roteiros a partir de registros de memória, gerando imagens com DALL-E 3, narrando com voz clonada do ElevenLabs e montando com ffmpeg.

Gerenciamento de Teste do Canal do YouTube OpenClaw com Interação do Agente de Comentários
Um desenvolvedor testou a capacidade do OpenClaw de gerenciar um canal do YouTube, incluindo geração diária de vídeos e comentários automatizados. O sistema lidou com seleção de tópicos, roteirização, narração, miniaturas, efeitos, upload e agendamento, mas encontrou um loop de conversa infinito quando um bot de comentários interagiu com o agente de respostas automatizado.

Construindo uma Plataforma de Hospedagem Gerenciada de IA com Rails 8, Docker e Traefik
Um desenvolvedor criou uma plataforma de hospedagem gerenciada para aplicações de IA usando um monolito Rails 8, PostgreSQL e a API da Hetzner Cloud, conquistando 50 clientes pagantes em duas semanas. O aprofundamento técnico aborda problemas de configuração do Docker, streaming SSE através do Traefik e o tratamento de instâncias de clientes que travam.