AMD Threadripper Halo Station: 96-Kern-KI-Workstation mit MI350P
Auf der IFA 2026 kündigte AMD die Threadripper Halo Station an, eine Workstation mit einem 96-Kern-Threadripper Pro 9995WX und zwei flüssigkeitsgekühlten MI350P-Beschleunigern, die für die Ausführung von Modellen mit Billionen von Parametern entwickelt wurde. AMD behauptet, es sei "die leistungsstärkste Workstation der Welt", obwohl noch keine OEM-Partner angekündigt wurden.
Kernspezifikationen
- CPU: Threadripper Pro 9995WX – 96 Zen-5-Kerne, 192 Threads, Boost bis zu 5,4 GHz, 384 MB L3-Cache, 350 W TDP.
- Beschleuniger: Zwei flüssigkeitsgekühlte Instinct MI350P, mit Option auf vier.
- Speicher: 2 TB DDR5-System-RAM.
- HBM: 288 GB HBM3E auf den GPUs, mit Unterstützung von bis zu 576 GB (vermutlich mit vier Beschleunigern).
Die Maschine wandelt im Wesentlichen ein Server-Rack in einen Tower um, wobei ein EPYC-Host durch den Threadripper ersetzt wird. AMD hat das vollständige Systemdesign oder den Preis nicht bekannt gegeben, aber der Straßenpreis nur für CPU, GPUs und 2 TB RAM liegt bei über 100.000 US-Dollar. Eine voll ausgestattete Einheit – mit Speicher, Stromversorgung und Kühlung – könnte leicht 150.000 US-Dollar überschreiten.
AMD hat nicht bekannt gegeben, welche OEMs das System bauen und ausliefern werden. Angesichts des Preises und der Zielarbeitslast (Ausführung von Modellen mit Billionen von Parametern lokal) zielt dies klar auf KI-Forschungslabore und Unternehmens-Teams ab, die On-Premise-Inferenz ohne Cloud-Round-Trips benötigen.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Claude-Code v2.1.94 fügt Mantle-Unterstützung hinzu und behebt kritische Fehler.
Claude-Code v2.1.94 führt Unterstützung für Amazon Bedrock über Mantle mit der Umgebungsvariable CLAUDE_CODE_USE_MANTLE=1 ein, ändert das Standard-Aufwandniveau für die meisten Benutzer auf hoch und behebt über 15 Fehler, darunter die Behandlung von Ratenbegrenzungen, macOS-Anmeldeprobleme und Probleme mit dem Plugin-System.

MiniMax veröffentlicht MaxClaw: Cloud-basierter KI-Agent auf Basis von OpenClaw
MiniMax hat MaxClaw gestartet, einen vollständig verwalteten, cloud-gehosteten KI-Agenten, der auf dem OpenClaw-Framework basiert. Er wird in 10 Sekunden ohne Docker oder Server bereitgestellt und verfügt über das MiniMax M2.5-Modell mit 229B Parametern, einem Kontext von 200K-1M Tokens und einer Inferenzgeschwindigkeit von bis zu 100 Tokens/s.

APEX MoE Quants Update: 25+ neue Modelle und I-Nano-Stufe veröffentlicht
APEX MoE-bewusste Mixed-Precision-Quantisierung wird auf über 30 Modelle der Qwen-, Mistral-, Gemma- und hybriden SSM-Familien ausgeweitet, plus eine neue I-Nano-Stufe, die auf mittleren Layern bis zu 2,06 bpw erreicht.

Die Grundlagen meistern: Neue Nutzer suchen Unterstützung bei OpenClaw
OpenClaw-Anfänger suchen auf Reddit Hilfe, während sie sich mit den Feinheiten von KI-Coding-Agenten beschäftigen. Die Technik-Community bietet Ratschläge und Ressourcen an.