Limonada por AMD: Servidor de LLM Local de Código Abierto para GPU y NPU

Qué es Lemonade
Lemonade es un servidor de IA local creado por AMD y la comunidad de IA local que ejecuta modelos de texto, imagen y voz en GPUs y NPUs. Es de código abierto, está diseñado para ser privado y afirma estar listo en minutos en cualquier PC.
Características y Especificaciones Clave
- Backend Nativo en C++: Servicio ligero de solo 2MB
- Instalación en un Minuto: Instalador sencillo que configura la pila automáticamente
- Compatible con la API de OpenAI: Funciona con cientos de aplicaciones de inmediato y se integra en minutos
- Se configura automáticamente para tu hardware: Configura las dependencias para tu GPU y NPU
- Compatibilidad multi-motor: Funciona con llama.cpp, Ryzen AI SW, FastFlowLM y más
- Múltiples Modelos a la Vez: Ejecuta más de un modelo simultáneamente
- Multiplataforma: Una experiencia consistente en Windows, Linux y macOS (beta)
- Aplicación integrada: Una interfaz gráfica que te permite descargar, probar y cambiar modelos rápidamente
- API Unificada: Un servicio local para cada modalidad incluyendo chat, visión, generación de imágenes, transcripción y generación de voz
Soporte de Modelos y Rendimiento
El servidor puede cargar modelos como gpt-oss-120b o Qwen-Coder-Next para uso avanzado de herramientas. Para ajustes, puedes usar --no-mmap para acelerar los tiempos de carga y aumentar el tamaño de contexto a 64 o más. La fuente menciona que con 128 GB de RAM unificada, puedes cargar modelos más grandes.
Integración en el Ecosistema
Lemonade está integrado en muchas aplicaciones y funciona de inmediato con cientos más gracias al estándar de la API de OpenAI. Las integraciones mencionadas incluyen Open WebUI, n8n, Gaia Infinity, Arcade, GitHub Copilot, OpenHands, Dify, Deep Tutor e Iterate.ai.
Comunidad y Desarrollo
El proyecto tiene 2.1k estrellas en GitHub y una comunidad activa en Discord con 117 en línea en el momento de la fuente. Se describe como construido por la comunidad de IA local para cada PC, con la filosofía de que la IA local debe ser gratuita, abierta, rápida y privada.
📖 Leer la fuente completa: HN LLM Tools
👀 Ver también

MegaClaw: Configuración de OpenClaw en Contenedores con Playwright y Homebrew
MegaClaw es una configuración de Podman de dos imágenes para OpenClaw que aborda problemas comunes de instalación como errores de permisos y dependencias faltantes. Utiliza una construcción multi-etapa con Playwright y Homebrew preinstalados, e integra la configuración del usuario en una imagen de tiempo de ejecución.

Memento Vault: Herramienta Local para Contexto Persistente en Sesiones de Código Claude
Memento Vault es un conjunto de hooks que captura automáticamente las transcripciones de sesión, las puntúa y almacena notas atómicas en un repositorio git local. Ofrece recuperación sin costo mediante búsqueda BM25 + vectorial con una latencia promedio de 472 ms e inyecta contexto relevante al inicio de sesión, en cada solicitud y en lecturas de archivos.

Resultados de Referencia: Cuándo Usar Claude Opus con Codex vs. Opus Puro para Generación de Código
Un punto de referencia controlado probó el enfoque 'Planificar con Opus, Ejecutar con Codex' en tres tareas de programación reales. Los resultados muestran un punto de cruce de costos en aproximadamente 600 líneas de código, con recomendaciones específicas basadas en el tamaño del proyecto.

SendToAI Extensión de VS Code Resuelve el Límite de 20 Archivos de Claude con Agrupación de Proyectos
SendToAI es una extensión gratuita de VS Code que empaqueta proyectos completos en un solo pegado del portapapeles, evitando el límite de 20 archivos de Claude. Incluye selección visual de archivos, conteo de tokens, estimaciones de costos y notas de proyecto que persisten entre sesiones.