Lemonade von AMD: Open-Source-Lokaler-LLM-Server für GPU und NPU

✍️ OpenClawRadar📅 Veröffentlicht: 5. April 2026🔗 Source
Lemonade von AMD: Open-Source-Lokaler-LLM-Server für GPU und NPU
Ad

Was Lemonade ist

Lemonade ist ein lokaler KI-Server, der von AMD und der lokalen KI-Community entwickelt wurde und Text-, Bild- und Sprachmodelle auf GPUs und NPUs ausführt. Er ist Open Source, auf Privatsphäre ausgelegt und soll in wenigen Minuten auf jedem PC einsatzbereit sein.

Wichtige Funktionen und Spezifikationen

  • Natives C++-Backend: Leichtgewichtiger Dienst mit nur 2 MB
  • Ein-Minuten-Installation: Einfacher Installer, der den Stack automatisch einrichtet
  • OpenAI-API-kompatibel: Funktioniert mit Hunderten von Apps sofort und lässt sich in Minuten integrieren
  • Automatische Hardware-Konfiguration: Konfiguriert Abhängigkeiten für Ihre GPU und NPU
  • Multi-Engine-Kompatibilität: Funktioniert mit llama.cpp, Ryzen AI SW, FastFlowLM und mehr
  • Mehrere Modelle gleichzeitig: Führen Sie mehr als ein Modell zur gleichen Zeit aus
  • Plattformübergreifend: Einheitliches Erlebnis unter Windows, Linux und macOS (Beta)
  • Integrierte App: Eine GUI, mit der Sie Modelle schnell herunterladen, testen und wechseln können
  • Vereinheitlichte API: Ein lokaler Dienst für jede Modalität, einschließlich Chat, Vision, Bildgenerierung, Transkription und Sprachgenerierung
Ad

Modellunterstützung und Leistung

Der Server kann Modelle wie gpt-oss-120b oder Qwen-Coder-Next für erweiterte Werkzeugnutzung laden. Für das Tuning können Sie --no-mmap verwenden, um Ladezeiten zu beschleunigen und die Kontextgröße auf 64 oder mehr zu erhöhen. Die Quelle erwähnt, dass Sie mit 128 GB vereinheitlichtem RAM größere Modelle laden können.

Ökosystem-Integration

Lemonade ist in vielen Apps integriert und funktioniert dank des OpenAI-API-Standards sofort mit Hunderten weiteren. Genannte Integrationen umfassen Open WebUI, n8n, Gaia Infinity, Arcade, GitHub Copilot, OpenHands, Dify, Deep Tutor und Iterate.ai.

Community und Entwicklung

Das Projekt hat 2,1k Sterne auf GitHub und eine aktive Discord-Community mit 117 gleichzeitig Online zum Zeitpunkt der Quelle. Es wird als von der lokalen KI-Community für jeden PC entwickelt beschrieben, mit der Philosophie, dass lokale KI kostenlos, offen, schnell und privat sein sollte.

📖 Read the full source: HN LLM Tools

Ad

👀 Siehe auch

Maestro v1.5.0 fügt Claude Code-Unterstützung für die Multi-Agenten-Orchestrierung hinzu.
Werkzeuge

Maestro v1.5.0 fügt Claude Code-Unterstützung für die Multi-Agenten-Orchestrierung hinzu.

Maestro v1.5.0, eine Open-Source-Multi-Agent-Orchestrierungsplattform, läuft jetzt zusätzlich zur Gemini CLI auch als natives Plugin auf Claude Code. Das Update umfasst tiefgreifendere Designplanung, ein 42-stufiges Orchestrierungs-Backbone, Durchsetzung von Agenten-Fähigkeiten und Sicherheitshärtung.

OpenClawRadar
Agent Smith: Ein Befehl zum Erstellen von MCP-Servern, Fähigkeiten und einer Ticket-zu-PR-Pipeline für Claude Code
Werkzeuge

Agent Smith: Ein Befehl zum Erstellen von MCP-Servern, Fähigkeiten und einer Ticket-zu-PR-Pipeline für Claude Code

Agent Smith scannt Ihr Repository, erkennt exakt den verwendeten Stack (Go/Echo, React/Zustand, golang-jwt, pgx usw.), richtet MCP-Server, Hooks und Skills ein, die auf Ihre Umgebung zugeschnitten sind, und bietet eine autonome Ticket-to-PR-Pipeline.

OpenClawRadar
GrapeRoot MCP Tool reduziert Claude-Code-Token-Verbrauch um 50–70 %
Werkzeuge

GrapeRoot MCP Tool reduziert Claude-Code-Token-Verbrauch um 50–70 %

Ein Entwickler hat GrapeRoot erstellt, ein MCP-Tool, das mit Claude Code entwickelt wurde und die ineffiziente Token-Nutzung in Claude Code-Plänen adressiert. Das Tool konzentriert sich auf besseres Kontext- und Zustandsmanagement, um unnötigen Token-Verbrauch zu reduzieren.

OpenClawRadar
PeaDB: Mit KI-Assistenten in C++20 entwickelte, Redis-kompatible Datenbank
Werkzeuge

PeaDB: Mit KI-Assistenten in C++20 entwickelte, Redis-kompatible Datenbank

Ein Entwickler hat PeaDB erstellt, einen Redis 7.2.5-Drop-in-Ersatz, der in C++20 mit Codex, Copilot und Claude geschrieben wurde und etwa 147 Befehle mit Persistenz, Replikation und Cluster-Unterstützung implementiert. Benchmarks zeigen eine Leistung nahe an Redis.

OpenClawRadar