Lemonade von AMD: Open-Source-Lokaler-LLM-Server für GPU und NPU

Was Lemonade ist
Lemonade ist ein lokaler KI-Server, der von AMD und der lokalen KI-Community entwickelt wurde und Text-, Bild- und Sprachmodelle auf GPUs und NPUs ausführt. Er ist Open Source, auf Privatsphäre ausgelegt und soll in wenigen Minuten auf jedem PC einsatzbereit sein.
Wichtige Funktionen und Spezifikationen
- Natives C++-Backend: Leichtgewichtiger Dienst mit nur 2 MB
- Ein-Minuten-Installation: Einfacher Installer, der den Stack automatisch einrichtet
- OpenAI-API-kompatibel: Funktioniert mit Hunderten von Apps sofort und lässt sich in Minuten integrieren
- Automatische Hardware-Konfiguration: Konfiguriert Abhängigkeiten für Ihre GPU und NPU
- Multi-Engine-Kompatibilität: Funktioniert mit llama.cpp, Ryzen AI SW, FastFlowLM und mehr
- Mehrere Modelle gleichzeitig: Führen Sie mehr als ein Modell zur gleichen Zeit aus
- Plattformübergreifend: Einheitliches Erlebnis unter Windows, Linux und macOS (Beta)
- Integrierte App: Eine GUI, mit der Sie Modelle schnell herunterladen, testen und wechseln können
- Vereinheitlichte API: Ein lokaler Dienst für jede Modalität, einschließlich Chat, Vision, Bildgenerierung, Transkription und Sprachgenerierung
Modellunterstützung und Leistung
Der Server kann Modelle wie gpt-oss-120b oder Qwen-Coder-Next für erweiterte Werkzeugnutzung laden. Für das Tuning können Sie --no-mmap verwenden, um Ladezeiten zu beschleunigen und die Kontextgröße auf 64 oder mehr zu erhöhen. Die Quelle erwähnt, dass Sie mit 128 GB vereinheitlichtem RAM größere Modelle laden können.
Ökosystem-Integration
Lemonade ist in vielen Apps integriert und funktioniert dank des OpenAI-API-Standards sofort mit Hunderten weiteren. Genannte Integrationen umfassen Open WebUI, n8n, Gaia Infinity, Arcade, GitHub Copilot, OpenHands, Dify, Deep Tutor und Iterate.ai.
Community und Entwicklung
Das Projekt hat 2,1k Sterne auf GitHub und eine aktive Discord-Community mit 117 gleichzeitig Online zum Zeitpunkt der Quelle. Es wird als von der lokalen KI-Community für jeden PC entwickelt beschrieben, mit der Philosophie, dass lokale KI kostenlos, offen, schnell und privat sein sollte.
📖 Read the full source: HN LLM Tools
👀 Siehe auch

Agent-Telefonie-Ebene wird Open Source: Geben Sie Ihrer KI eine Telefonnummer
Ein Entwickler baute eine Open-Source-Telefonie-Ebene für KI-Agenten, die es ihnen ermöglicht, anzurufen und zu texten. Sie ist REST + MCP, framework-agnostisch und hat einen OpenClaw-Skill.

Entwickler teilt 10+ MCP-Server für KI-Agenten-Abrechnung, Reputation und Mikrozahlungen
Ein Entwickler hat BlindOracle auf Claude Code mit über 100 Agenten aufgebaut und 10+ MCP-Server für Abwicklung, Reputation und Mikrozahlungen erstellt. Die Architektur umfasst private Commit-Reveal-Prognosen, On-Chain-Bewertung, Mikrozahlungen pro Anfrage und verifizierbare Agenten-Attestierung.

„Gefundene-Probleme“-Plugin protokolliert Fehler, die Claude bei anderen Aufgaben ignoriert
Ein Claude Code Plugin, das einzeilige Einträge in docs/found-issues.md schreibt, wenn der Agent Bugs außerhalb des Aufgabenbereichs entdeckt, mit automatischer Schließung bei PR-Merge und Tombstone-Erkennung.

InsForge: Open-Source-Backend-Plattform für KI-Codierungsagenten
InsForge ist eine Open-Source-Backend-Plattform (Apache 2.0), die KI-Coding-Agenten mit verwalteter Datenbank, Authentifizierung, Speicher, Compute, Hosting und AI-Gateway bereitstellt, gesteuert über CLI oder MCP.