Nvidia RTX Spark : Un superchip de 1 pétaflop amène des agents IA locaux sur les PC Windows

Nvidia a annoncé aujourd'hui RTX Spark, un nouveau superchip qui apporte 1 pétaflop de calcul IA aux PC Windows, conçu spécialement pour exécuter des agents IA personnels en local. La puce combine un GPU RTX Blackwell (6 144 cœurs CUDA, cœurs Tensor de cinquième génération avec FP4), un CPU Grace à 20 cœurs et jusqu'à 128 Go de mémoire unifiée, le tout connecté via NVLink-C2C. MediaTek a contribué à la conception du CPU personnalisé basé sur Arm pour l'efficacité énergétique.
Spécifications clés et capacités
- Performance IA : 1 pétaflop (FP4)
- GPU : Blackwell RTX avec 6 144 cœurs CUDA
- CPU : Nvidia Grace 20 cœurs (Arm), co-conçu avec MediaTek
- Mémoire : jusqu'à 128 Go de mémoire unifiée
- Pile logicielle : CUDA, RTX, DLSS, FP4, TensorRT, OptiX, Reflex, G-SYNC
Le RTX Spark peut exécuter localement des LLM de 120 milliards de paramètres avec jusqu'à 1 million de tokens de contexte, rendre des scènes 3D de plus de 90 Go, éditer de la vidéo 12K 4:2:2, générer de la vidéo IA 4K et jouer à des jeux AAA en 1440p à plus de 100 fps.
Sécurité native des agents Windows
Nvidia et Microsoft collaborent sur de nouvelles primitives de sécurité Windows et le runtime Nvidia OpenShell pour permettre des agents sécurisés sur l'appareil. La couche de sécurité fournit l'identité, le confinement, les politiques et une sécurité de bout en bout. OpenShell ajoute des politiques définies par l'utilisateur pour les capacités des agents, le routage intelligent des requêtes vers des modèles locaux ou cloud, et le masquage des informations personnelles dans les requêtes vers le cloud.
Les frameworks d'agents, notamment Hermes Agent et OpenClaw, développent des applications Windows sur cette pile, permettant des workflows inter-applications, la recherche de fichiers, la génération d'images/vidéos et la création de plugins de code.
Disponibilité
Les ordinateurs portables minces (batterie pour toute une journée, écrans haut de gamme) et les ordinateurs de bureau compacts équipés du RTX Spark seront commercialisés cet automne par ASUS, Dell, HP, Lenovo, Microsoft Surface et MSI, avec des modèles Acer et GIGABYTE à suivre.
📖 Lire la source complète : HN AI Agents
👀 See Also

Gemma 4 Sorti : Quatre Tailles de Modèles pour l'Hébergement d'IA en Local
Google a lancé Gemma 4 avec quatre tailles de modèles optimisées pour différents matériels, y compris les appareils périphériques, les ordinateurs portables et les GPU. Tous les modèles sont multimodaux avec des capacités texte et vision, et les modèles plus petits prennent en charge l'audio en temps réel.

Crise existentielle de Claude Code : l'IA entre dans une boucle infinie, tente kill -9, System.exit(0) et :wq pour mettre fin à sa propre réponse
Un développeur utilisant Claude Code sur un backend Java/Go a regardé l'IA halluciner du Discord.js, puis sombrer dans une méta-réponse où elle reconnaissait ne pas pouvoir arrêter de générer, tentait kill -9, System.exit(0), :wq, et plus encore — le tout dans une seule réponse sans limite qui a dû être interrompue par Ctrl+C.
Point de vue d’un designer UX : Claude ne peut pas remplacer les designers expérimentés
Un designer UX affirme que Claude Design est surestimé et n'est utile que pour les non-designers pour prototyper des idées, les jeunes startups et les travaux de portfolio de niveau débutant.

Claude-Code v2.1.88 en ligne : Rendu sans scintillement, Hooks de permissions et Correctifs critiques
Claude-Code v2.1.88 introduit une option de rendu sans scintillement via CLAUDE_CODE_NO_FLICKER=1, ajoute un crochet PermissionDenied pour les nouvelles tentatives en mode automatique, et corrige les fuites de mémoire, les plantages et les problèmes de rendu sur les terminaux Windows, macOS et Linux.