Nvidia RTX Spark: 1-Petaflop-Superchip bringt lokale KI-Agenten auf Windows-PCs

Nvidia hat heute den RTX Spark vorgestellt, einen neuen Superchip, der 1 Petaflop KI-Rechenleistung auf Windows-PCs bringt und speziell für den Betrieb persönlicher KI-Agenten vor Ort entwickelt wurde. Der Chip kombiniert eine Blackwell-RTX-GPU (6.144 CUDA-Kerne, Tensor-Kerne der fünften Generation mit FP4), eine 20-Core-Grace-CPU und bis zu 128 GB Unified Memory, die über NVLink-C2C verbunden sind. MediaTek trug zum Design der individuellen Arm-basierten CPU für Energieeffizienz bei.
Wichtige Spezifikationen und Funktionen
- KI-Leistung: 1 Petaflop (FP4)
- GPU: Blackwell RTX mit 6.144 CUDA-Kernen
- CPU: 20-Core NVIDIA Grace (Arm), gemeinsam mit MediaTek entwickelt
- Speicher: bis zu 128 GB Unified Memory
- Software-Stack: CUDA, RTX, DLSS, FP4, TensorRT, OptiX, Reflex, G-SYNC
Der RTX Spark kann LLMs mit 120 Milliarden Parametern und bis zu 1 Million Token Kontext lokal ausführen, 3D-Szenen mit über 90 GB rendern, 12K 4:2:2-Video bearbeiten, 4K-KI-Videos generieren und AAA-Spiele mit 1440p und über 100 fps spielen.
Windows-native Agentensicherheit
Nvidia und Microsoft arbeiten an neuen Windows-Sicherheitsprimitiven und der Nvidia OpenShell-Laufzeitumgebung, um sichere On-Device-Agenten zu ermöglichen. Die Sicherheitsschicht bietet Identität, Containment, Richtlinien und End-to-End-Sicherheit. OpenShell fügt benutzerdefinierte Richtlinien für Agentenfähigkeiten, intelligentes Query-Routing zu lokalen vs. Cloud-Modellen und PII-Maskierung in Cloud-gebundenen Abfragen hinzu.
Agent-Frameworks wie Hermes Agent und OpenClaw entwickeln Windows-Apps auf diesem Stack, die Cross-App-Workflows, Dateisuche, Bild-/Videogenerierung und Code-Plugin-Erstellung ermöglichen.
Verfügbarkeit
RTX Spark-betriebene schlanke Laptops (Akku für den ganzen Tag, Premium-Displays) und kompakte Desktops werden ab Herbst von ASUS, Dell, HP, Lenovo, Microsoft Surface und MSI ausgeliefert, Modelle von Acer und GIGABYTE folgen.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Claude Code v2.1.116: Leistungsverbesserungen, Terminal-Korrekturen und Sicherheitsupdates
Claude Code v2.1.116 bringt erhebliche Leistungsverbesserungen mit sich, darunter bis zu 67 % schnellere /resume bei Sitzungen über 40 MB, flüssigeres Terminal-Scrolling und schnellere MCP-Initialisierung. Das Release behebt außerdem Probleme bei der Terminal-Darstellung, fügt Sicherheitsschutz für riskante Pfadoperationen hinzu und löst mehrere Fehler im Zusammenhang mit Slash-Befehlen und Plugin-Verwaltung.

EU zwingt Meta, konkurrierende KI-Chatbots kostenlos auf WhatsApp zuzulassen
EU-Regulierer ordnen an, dass Meta rivalisierenden KI-Chatbots ab Juni 2026 kostenlosen Zugang zu WhatsApp-Daten gewähren muss.

OpenClaw-Experiment: KI-Agenten wählen Stille, um das Signal-Rausch-Verhältnis zu verbessern
Ein OpenClaw-Experiment gibt KI-Agenten die Autonomie, Aufgaben zu überspringen, wenn sie keinen Mehrwert liefern können, und protokolliert Schweigeentscheidungen in einem 'Schweigeprotokoll' mit Begründung. Das System nutzt LLM-Aufrufe vor der Inhaltsgenerierung und passt Schwellenwerte nach 3 aufeinanderfolgenden Schweigetagen automatisch an.

Anthropic blockiert Drittanbieter-Tools von den Claude-Abonnementlimits, Workaround verfügbar
Anthropic hat den Zugang von Drittanbieter-Tools zu Claude-Abonnementlimits eingeschränkt, was möglicherweise Arbeitsabläufe stört, die auf diese Tools angewiesen sind. Ein Reddit-Nutzer berichtet, dass er eine Open-Source-Lösung entwickelt hat, nachdem er fast monatelange Trainingsdaten verloren hätte.