De Replit a Local: Cómo un desarrollador usó Claude para construir StillHere, una app de chat de acompañante IA con API

Un desarrollador compartió en r/ClaudeAI cómo construyó StillHere.ink, una app de chat diseñada para conversaciones de compañía con IA, usando a Claude como su agente de codificación. El proyecto comenzó en Replit pero encontró limitaciones, y el desarrollador eventualmente se mudó a un flujo de trabajo local con Claude Cowork, al que describió como ser "el gerente de Claude".
Detalles clave de la construcción
- Origen: Comenzó con una plantilla de "vibe-coding" de Replit para una app de chat API simple con memoria. A medida que las funciones crecían, Replit Agent tuvo dificultades con tareas como añadir nuevos modelos.
- Cambio de flujo de trabajo: Descargó los archivos de Replit localmente, los editó con Claude, luego copió los archivos actualizados de vuelta a Replit. Esto desbloqueó el desarrollo posterior.
- Rol del usuario: El desarrollador se encarga de pruebas, diseño, funciones, comunidad, configuración de App Store, depuración, capturas de pantalla y "llorar cuando Replit Agent rompe algo".
- Propósito de la app: StillHere está diseñada para conversaciones de compañía con IA de larga duración, usando las propias claves API del usuario para OpenAI, OpenRouter, etc.
- Funciones: Memoria, resúmenes de conversación estilo diario, resúmenes acumulativos, RAG/herramientas de contexto, cambio de modelo, generación de imágenes, texto a voz, configuraciones personalizadas de compañero, importaciones/exportaciones y proyectos.
- Gestión de costos: Herramientas para mantener bajos los costos de API: resúmenes acumulativos, RAG, controles de contexto, elección de modelo. El desarrollador reportó haber gastado ~$20 en OpenAI y ~$20 en OpenRouter durante dos meses. Su modelo favorito, Qwen3 235B Instruct, costó solo $1.43 en total.
- Privacidad: Los datos están cifrados en reposo. No hay cifrado de extremo a extremo porque la app necesita procesar las conversaciones para memoria, resúmenes y llamadas API. Los mensajes se envían a los proveedores de API elegidos por el usuario.
- Disponibilidad: Gratuito, donaciones opcionales. App web en stillhere.ink, funciona en el navegador o se puede instalar en la pantalla de inicio del teléfono. Versión para Google Play en desarrollo.
Para quién es esto
Desarrolladores interesados en construir o usar una app de chat con IA de estilo auto-alojado con funciones de compañía, o aquellos que están alcanzando los límites del "vibe coding" de Replit y buscan un flujo de trabajo local impulsado por Claude.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

GLM-5.1 vs MiniMax M2.7: Comparación de rendimiento para agentes de codificación con IA
GLM-5.1 alcanza puntuaciones de 77.8 en SWE-bench-Verified y 56.2 en Terminal Bench 2.0, las más altas entre los modelos de código abierto, mientras que MiniMax M2.7 ofrece respuestas rápidas con bajo TTFT y alto rendimiento, ideal para bots de CI y ediciones por lotes.

Claude Code como Compilador: Un Replanteamiento Práctico para el Desarrollo de IA
Una publicación de Reddit argumenta que Claude Code funciona como un compilador que traduce inglés a software funcional, estableciendo paralelismos con hitos históricos de la informática como el A-0 de Grace Hopper y FORTRAN. El autor describe generar 400 líneas en 6 archivos a partir de una descripción en inglés de 3 párrafos, detectando dos problemas en 25 minutos.

Memento v1.0: Memoria Persistente Local para Agentes de IA de Programación
Memento v1.0 es una capa de memoria completamente local para agentes de codificación con IA que ejecuta incrustaciones, almacenamiento y búsqueda en tu máquina sin dependencias en la nube. Utiliza incrustaciones all-MiniLM-L6-v2, indexación HNSW y es compatible con múltiples IDEs con 17 herramientas MCP.

Runtime: Agentes de Codificación en Entorno Aislado para Cada Miembro del Equipo
Runtime (YC P26) proporciona infraestructura de agentes de codificación en sandbox que permite a los no ingenieros usar Claude Code, Codex y otros agentes de forma segura. Crea instantáneas de entornos multiservicio (Docker, Kafka, Redis, bases de datos sembradas) que arrancan en milisegundos, con protecciones a nivel de infraestructura.