Limonada por AMD: Servidor Local de LLM de Código Aberto para GPU e NPU

O que é o Lemonade
Lemonade é um servidor de IA local desenvolvido pela AMD e pela comunidade de IA local que executa modelos de texto, imagem e fala em GPUs e NPUs. É de código aberto, projetado para ser privado e afirma estar pronto em minutos em qualquer PC.
Recursos e Especificações Principais
- Backend Nativo em C++: Serviço leve que tem apenas 2MB
- Instalação em Um Minuto: Instalador simples que configura a pilha automaticamente
- Compatível com API da OpenAI: Funciona com centenas de aplicativos prontos para uso e integra em minutos
- Configura-se automaticamente para seu hardware: Configura dependências para sua GPU e NPU
- Compatibilidade com múltiplos mecanismos: Funciona com llama.cpp, Ryzen AI SW, FastFlowLM e mais
- Múltiplos Modelos Simultaneamente: Execute mais de um modelo ao mesmo tempo
- Multiplataforma: Uma experiência consistente no Windows, Linux e macOS (beta)
- Aplicativo integrado: Uma interface gráfica que permite baixar, testar e alternar modelos rapidamente
- API Unificada: Um serviço local para cada modalidade incluindo chat, visão, geração de imagens, transcrição e geração de fala
Suporte a Modelos e Desempenho
O servidor pode carregar modelos como gpt-oss-120b ou Qwen-Coder-Next para uso avançado de ferramentas. Para ajustes, você pode usar --no-mmap para acelerar os tempos de carregamento e aumentar o tamanho do contexto para 64 ou mais. A fonte menciona que com 128 GB de RAM unificada, você pode carregar modelos maiores.
Integração com o Ecossistema
Lemonade está integrado em muitos aplicativos e funciona prontamente com centenas de outros graças ao padrão da API da OpenAI. As integrações mencionadas incluem Open WebUI, n8n, Gaia Infinity, Arcade, GitHub Copilot, OpenHands, Dify, Deep Tutor e Iterate.ai.
Comunidade e Desenvolvimento
O projeto tem 2,1 mil estrelas no GitHub e uma comunidade ativa no Discord com 117 online no momento da fonte. É descrito como sendo construído pela comunidade de IA local para cada PC, com a filosofia de que a IA local deve ser gratuita, aberta, rápida e privada.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Pipeline de código aberto transforma fluxo de trabalho do Claude Code em habilidades reutilizáveis
Um desenvolvedor que usou o Claude Code diariamente por 9 meses disponibilizou em código aberto um pipeline que estrutura o desenvolvimento de funcionalidades com pontos de verificação como documentação funcional, documentação técnica, estimativa de complexidade e verificações de segurança. O pipeline inclui pontos de entrada /new-feature e /bug-fix que orientam a implementação.

Desenvolvedor compartilha ferramentas de CLI que funcionam bem com Claude Code
Um desenvolvedor mudou de MCPs para CLIs para trabalhar com o Claude Code, descobrindo que o Claude lida com comandos CLI de forma eficaz devido ao treinamento em scripts de shell e documentação. Eles compartilharam CLIs específicas que usam diariamente, incluindo gh, ripgrep, stripe, supabase, vercel, sentry-cli e neon.

Extensão OpenClaw Claude Atualizada para Usar o SDK do Agent Após Mudanças na Cobrança da Anthropic
Um desenvolvedor de extensão do OpenClaw reescreveu sua integração CLI do Claude para usar o claude-agent-sdk oficial depois que a Anthropic começou a detectar e reclassificar o uso da CLI como uso de aplicativo de terceiros, que fatura contra um pool de créditos separado em vez dos limites do plano Max.

NPCterm: Emulador de Terminal PTY Completo para Agentes de IA via MCP
O NPCterm fornece aos agentes de IA acesso completo ao terminal através de um emulador de terminal PTY headless em memória exposto via MCP. Inclui 15 ferramentas MCP para controle de terminal, detecção de estado de processos e suporte para aplicações TUI.