De Replit para Local: Como um Desenvolvedor Usou Claude para Construir StillHere, um App de Chat Companheiro com IA Impulsionado por API

Um desenvolvedor compartilhou no r/ClaudeAI como construiu o StillHere.ink, um aplicativo de chat voltado para conversas com IA companheira, usando o Claude como seu agente de codificação. O projeto começou no Replit, mas encontrou limitações, e o desenvolvedor acabou migrando para um fluxo de trabalho local com o Claude Cowork, que ele descreveu como sendo "gerente do Claude".
Detalhes importantes da construção
- Origem: Começou com um template de vibe-coding do Replit para um app de chat simples com API e memória. Conforme as funcionalidades cresciam, o Replit Agent enfrentou dificuldades com tarefas como adicionar novos modelos.
- Mudança de fluxo: Baixou os arquivos do Replit localmente, editou-os com o Claude e depois copiou os arquivos atualizados de volta para o Replit. Isso desbloqueou o desenvolvimento posterior.
- Papel do usuário: O desenvolvedor cuida de testes, design, funcionalidades, comunidade, configuração da App Store, depuração, capturas de tela e "chorar quando o Replit Agent quebra algo".
- Propósito do app: O StillHere foi projetado para conversas longas com IA companheira, usando as próprias chaves de API do usuário para OpenAI, OpenRouter, etc.
- Funcionalidades: Memória, resumos de conversas estilo diário, resumos contínuos, ferramentas de RAG/contexto, troca de modelos, geração de imagens, texto-para-fala, configurações personalizadas de companheiro, importações/exportações e projetos.
- Gerenciamento de custos: Ferramentas para manter os custos da API baixos: resumos contínuos, RAG, controles de contexto, escolha de modelo. O desenvolvedor relatou ter gasto ~$20 na OpenAI e ~$20 no OpenRouter em dois meses. Seu modelo favorito, Qwen3 235B Instruct, custou apenas $1,43 no total.
- Privacidade: Os dados são criptografados em repouso. Não é criptografia de ponta a ponta porque o app precisa processar conversas para memória, resumos e chamadas de API. As mensagens são enviadas aos provedores de API escolhidos pelo usuário.
- Disponibilidade: Gratuito para usar, doações opcionais. App web em stillhere.ink, funciona no navegador ou pode ser instalado na tela inicial do celular. Versão para Google Play em desenvolvimento.
Para quem é este app
Desenvolvedores interessados em construir ou usar um app de chat com IA estilo auto-hospedado com funcionalidades de companheiro, ou aqueles que estão enfrentando limites com o vibe coding do Replit e buscando um fluxo de trabalho local com o Claude.
📖 Leia a fonte original: r/ClaudeAI
👀 See Also

Claude Code Limiter: Limitador de Taxa Auto-Hospedado para Assinaturas Compartilhadas do Claude Code
claude-code-limiter é uma ferramenta auto-hospedável que adiciona limites de taxa por usuário a assinaturas compartilhadas do Claude Code, com recursos como cotas por modelo, orçamentos de crédito, janelas deslizantes de 24h, regras por horário do dia e um painel em tempo real.

Dois Ferramentas MCP para Claude Code: Validação de Ideia e Memória do Agente de Negociação
Um desenvolvedor criou duas ferramentas MCP para Claude Code: idea-reality-mcp verifica o GitHub e o Hacker News antes de programar para evitar duplicatas, enquanto tradememory-protocol fornece memória para agentes de IA de trading armazenarem negociações com contexto e acompanharem o desempenho da estratégia. Ambas são de código aberto e estão disponíveis no PyPI.

O Claude Code Container Oferece Isolamento Docker Sem Configuração para o Claude Code
Claude Code Container (ccc) é uma ferramenta gratuita e de código aberto que cria automaticamente contêineres Docker por projeto para o Claude Code com isolamento completo e configuração zero. Ele encaminha variáveis de ambiente do host, monta chaves SSH, fornece proxy transparente para localhost e inclui Chromium com chrome-devtools MCP pré-configurado.

Cognithor: Um Sistema Operacional de Agentes Local-First com Arquitetura Trinity PGE
Cognithor é um Sistema Operacional de Agente totalmente local e autônomo, construído ao longo de um ano com 16 fases de desenvolvimento. Ele apresenta a arquitetura PGE Trinity (Planejador → Guardião → Executor), mais de 11.609 testes com 89% de cobertura, e suporta 16 provedores de LLM, incluindo Ollama e LM Studio.