Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

biz.chosun+1biz.chosunsmbtech+1Nvidia a profité de l'IFA 2026 à Berlin pour présenter une stratégie d'IA locale de grande envergure, en lançant un outil open source gratuit qui transforme les PC de salon inactifs en un cluster de calcul IA partagé, et en confirmant que ses PC Windows RTX Spark basés sur l'architecture ARM commenceraient à être livrés en octobre.
La pièce maîtresse des annonces de jeudi est le logiciel NVIDIA Personal AI Router, ou PAIR, qui détecte automatiquement les PC compatibles sur un réseau local et oriente les requêtes d'inférence IA vers la machine disposant de capacités disponibles. Plus de la moitié des foyers américains possèdent au moins deux PC, et Nvidia souligne qu'une grande partie de cette puissance de calcul reste inutilisée tout au long de la journée.biz.chosun+1
PAIR fonctionne avec les applications d'inférence open source populaires Ollama et LM Studio, et prend en charge Windows, macOS et Linux. Le matériel compatible comprend les GPU GeForce de la série RTX 20 et plus récents, les GPU pour stations de travail RTX PRO, le DGX Spark, ainsi que les puces Apple M4 ou ultérieures. L'outil ne fusionne pas plusieurs GPU en une seule machine plus puissante. Au lieu de cela, il répartit les requêtes d'inférence indépendantes sur plusieurs appareils, réduisant ainsi les goulets d'étranglement lorsque les agents d'IA divisent des tâches complexes en sous-tâches parallèles. Lors d'un test réalisé par Nvidia, cinq sous-agents travaillant simultanément ont mis environ 18 minutes sur un seul appareil, mais ont terminé en moins de neuf minutes lorsqu'ils ont été répartis sur trois machines grâce à PAIR.blogs.nvidia+3
Nvidia s'est également attaqué à l'un des obstacles persistants à l'adoption de l'IA locale : la complexité de la configuration. Trois applications d'agents, Hermes Agent de Nous Research, Portable Computer de Perplexity et OpenClaw, bénéficient désormais d'une installation simplifiée en un clic sur les systèmes RTX et DGX, chacune étant basée sur llama.cpp avec les optimisations d'inférence de Nvidia déjà intégrées. Côté performances, le moteur llama.cpp offre désormais un débit jusqu'à 1,9 fois supérieur sur une GeForce RTX 5090, tandis que vLLM affiche des gains allant jusqu'à 1,4 fois sur les clusters à deux DGX Spark.blogs.nvidia+1
Nvidia a confirmé que les PC Windows RTX Spark seraient livrés en octobre sous le nom de produit N1X. La plateforme associe un GPU RTX basé sur Blackwell à un processeur Grace à 20 cœurs, prend en charge jusqu'à 128 Go de mémoire unifiée et offre jusqu'à un pétaflop de puissance de calcul IA. À l'IFA, Lenovo a dévoilé les Yoga Pro 9n et Yoga 9n 2-en-1, tandis qu'Acer a présenté un modèle de bureau compact. Asus ASUSTeK Computer Inc., Dell , HP et MSI Micro-Star International Co., Ltd. préparent également des appareils. Electronic Arts, Embark et Ubisoft ont rejoint les premiers soutiens, notamment Krafton, NetEase , Riot Games et Xbox Microsoft Corporation , en s'engageant à porter des titres de jeux sur la plateforme.windowscentral+4
Une vague de modèles déployables localement vient compléter le tableau : Muse Glimmer de Meta , DeepSeek v4 Flash, 3.8-Flash-Next de Qwen et Nemotron 3.5 Lightning de Nvidia sont tous optimisés pour le matériel RTX.blogs.nvidia