InsForge: Plataforma de Backend de Código Abierto para Agentes de Codificación de IA

InsForge (YC P26) es una plataforma de backend de código abierto diseñada específicamente para agentes de IA de codificación. En lugar de que los agentes tengan que manejar paneles y configuraciones manuales, InsForge les proporciona una CLI y habilidades para gestionar todas las tareas de backend/infraestructura de extremo a extremo. El proyecto está disponible en GitHub bajo licencia Apache 2.0.
Cómo funciona
Los agentes de codificación interactúan con InsForge a través de dos interfaces:
- Servidor MCP (autoalojado y en la nube): expone las operaciones de InsForge como herramientas para cualquier agente compatible con MCP.
- CLI + Habilidades (solo nube): una interfaz de línea de comandos emparejada con Habilidades que los agentes invocan directamente desde la terminal.
Ambos permiten a los agentes leer el contexto del backend (documentación, esquemas, registros) y configurar primitivas (desplegar funciones edge, ejecutar migraciones, crear buckets, configurar proveedores de autenticación).
Productos principales
- Autenticación – gestión de usuarios, autenticación, sesiones
- Base de datos – base de datos relacional PostgreSQL
- Almacenamiento – almacenamiento de archivos compatible con S3
- Puerta de enlace de modelos – API compatible con OpenAI para múltiples proveedores de LLM
- Funciones Edge – código sin servidor en el borde
- Computación (vista previa privada) – servicios de contenedores de larga duración
- Despliegue de sitios – construir y desplegar sitios
Funciones específicas para agentes
- Ramificación del backend: ramifica todo el backend (BD, autenticación, almacenamiento, funciones, programaciones). Los agentes trabajan en una rama, tú revisas las diferencias, fusionas o descartas. Inspirado en Neon.
- Telemetría del servidor: los agentes leen registros, CPU, memoria, disco para encontrar picos y causas raíz.
- Agente de depuración: cada proyecto tiene un agente de depuración dedicado. Tu agente de codificación hace preguntas como "¿por qué falló el despliegue?", el agente de depuración ejecuta diagnósticos y propone correcciones.
- Asesor de backend: escanea tu backend diariamente en busca de problemas de seguridad y rendimiento, propone remedios y los envía a tu agente de codificación.
Inicio rápido (autoalojado)
git clone https://github.com/InsForge/InsForge.git
cd insforge
cp .env.example .env
docker compose -f docker-compose.prod.yml upLuego abre http://localhost:7130 para conectar el servidor MCP. Después de la configuración, pídele a tu agente: "Estoy usando InsForge como plataforma de backend."
La versión en la nube está disponible en insforge.dev.
El equipo señala que comenzaron InsForge porque las configuraciones manuales de MCP tenían problemas: herramientas precargadas en el contexto, payloads grandes (>10k tokens) y capacidades faltantes como telemetría y configuraciones. Al poner todo en una CLI y enseñar a los agentes mediante habilidades, evitaron esos problemas.
📖 Read the full source: HN AI Agents
👀 Ver también

Rever UI Cloner: Alternativa Optimizada por IA para la Replicación de UI en lugar del Scraping HTML
Rever UI Cloner es un endpoint API que proporciona a los agentes de IA planos de diseño limpios en lugar de HTML crudo, evitando la saturación de la ventana de contexto y los problemas de alucinación de la interfaz de usuario. Utiliza el protocolo de pago x402 que requiere una microtransacción de 1 USDC en la red Base para pagos entre agentes.

Claude 4.6 Opus Razonamiento Destilado a 14GB para Apple Silicon mediante Cuantización MLX
Un desarrollador ha cuantizado un modelo Qwen 3.5 27B destilado a partir de trayectorias de razonamiento de Claude 4.6 Opus, reduciéndolo de 55.6GB a 14GB utilizando MLX para Apple Silicon, logrando ~16 tokens/seg en un M4 Pro mientras mantiene las capacidades de razonamiento analítico del modelo.
Títulos de macOS con Apple Silicon: Inferencia de LLM de 11 a 16 veces más rápida con el shim de capacidad de Metal
El shim de capacidades Metal a nivel de proceso de Cua desbloquea kernels más nuevos en VMs de macOS, acelerando la inferencia de llama.cpp hasta 16× en Apple Silicon. Lanzamiento de investigación de código abierto.

Asistente de Enseñanza de IA de UIUC Ejecuta 11 Modelos en Paralelo para Respuestas en Menos de 2 Segundos
El chatbot AI TA de UIUC ejecuta 11 modelos en paralelo para recuperación y generación de texto e imágenes, moderación y clasificación, logrando un tiempo de respuesta medio de 2 segundos. Código abierto con RAG de Pinecone y conjunto de datos RLHF.