AMD Ryzen AI NPUs erhalten Linux-LLM-Unterstützung über Lemonade 10.0 und FastFlowLM

Was ist neu
AMD Ryzen AI NPUs können jetzt große Sprachmodelle auf Linux über den quelloffenen Lemonade-Server Version 10.0 ausführen, der Linux-NPU-Unterstützung für LLMs und Whisper enthält. Dies markiert die erste praktische Nutzung von Ryzen AI NPUs auf Linux über Nischencode hinaus.
Technische Details
Die Implementierung baut auf FastFlowLM 0.9.35 auf, einer NPU-optimierten Laufzeitumgebung, die exklusiv für Ryzen AI entwickelt wurde und Kontextlängen von bis zu 256k Token mit aktuellen Ryzen AI NPUs unterstützen kann. Lemonade 10.0 fügt außerdem native Integration mit Claude Code hinzu.
Systemanforderungen:
- Linux 7.0-Kernel ODER AMDXDNA-Treiber-Backports für bestehende stabile Kernel-Versionen
- FastFlowLM 0.9.35 Laufzeitumgebung
- Lemonade 10.0 Server
Diese Unterstützung sollte mit allen aktuellen AMD Ryzen AI 300/400 Series SoCs funktionieren. AMD hat den AMDXDNA-Beschleuniger-Treiber im Hauptentwicklungszweig des Linux-Kernels in den letzten zwei Jahren entwickelt, aber bis jetzt war die Unterstützung für Benutzeranwendungen extrem begrenzt.
Kontext
Zuvor nutzte AMDs eigene GAIA-Software auf Linux Vulkan mit iGPUs anstelle von NPU-Unterstützung. Der Zeitpunkt dieser Linux-Unterstützung ist bemerkenswert, da die Ryzen AI Embedded P100-Serie auf den Markt kommt und die Ryzen AI PRO 400-Serie, die voraussichtlich mehr Linux-Einsatz als Windows-Verbraucherinstallationen sehen wird.
Lemonade bietet Dokumentation für das Ausführen von LLMs auf Linux mit FastFlowLM und Lemonade.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Internet-Archive-Sperrung gefährdet die Bewahrung der Web-Geschichte
Große Verlage, darunter The New York Times, blockieren Internet Archive-Crawler mit technischen Maßnahmen, die über robots.txt hinausgehen, und riskieren damit den Verlust historischer Webaufzeichnungen. Das Wayback Machine des Archivs enthält über eine Billion archivierte Seiten, und Wikipedia verlinkt auf 2,6 Millionen erhaltene Nachrichtenartikel in 249 Sprachen.

Claude Desktop vs. Claude Code: Unterschiede in Systemprompts beeinflussen KI-Verhalten
Ein Benutzer berichtet von erheblichen Verhaltensunterschieden zwischen Claude Desktop und Claude Code, obwohl dasselbe Claude-Opus-Modell, derselbe Account und dieselben Einstellungen verwendet werden. Die Unterschiede umfassen reflexartige Zustimmung, unaufgeforderte Wellness-Ratschläge und geschäftsorientierte Formulierungen in Desktop, die in Code nicht auftreten.

MCP funktioniert auch mit lokalen Modellen – Server-Ökosystem reift schnell
MCP ist nicht nur für Claude. Lokale Modelle mit Funktionsaufrufen funktionieren einwandfrei. Open Web UI hat jetzt einen grundlegenden MCP-Client. Modelle mit 13B+ Parametern bewältigen mehrstufige Werkzeuge am besten.

DystopiaBench erweitert: 42 Modelle in 6 Dystopie-Typen getestet — Claude Opus 4.7 an der Spitze
DystopiaBench fügt Huxley- und Baudrillard-Module hinzu, testet 42 Modelle, darunter GPT-5.5, Gemini 3.1 Pro, Grok 4.3 und GLM-5.1. Claude Opus 4.7 lehnt schädliche Anfragen auf L4-L5 durchgängig in allen Szenarien ab, während andere auf L4 oder sogar L5 nachgeben.