Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

LinkedInFuTu News+1ReutersMeta Platforms déploie une version personnalisée de l'accélérateur Instinct MI450 d'Advanced Micro Devices, Inc. qui réduit de moitié le silicium de calcul et diminue la capacité de mémoire d'environ deux tiers par rapport au MI455X standard, selon le cabinet de recherche sur les semi-conducteurs SemiAnalysis. Cette décision, optimisée pour les systèmes de recommandation de Meta plutôt que pour l'IA générative, a suscité une réprimande publique inhabituelle de la part du cabinet d'analystes, qui a averti que cette configuration placerait les équipes de recherche en IA de Meta en position de désavantage face à leurs concurrents.
SemiAnalysis a révélé le 21 juillet que la puce personnalisée de la série MI400 de Meta utilise quatre matrices de calcul au lieu des huit standard et remplace les douze piles HBM4 12-Hi du MI455X, totalisant 432 Go, par six piles 8-Hi fournissant environ 144 Go de mémoire. L'équipe d'infrastructure de Meta a justifié cette configuration comme étant adaptée au rapport CPU-GPU exigé par ses charges de travail de systèmes de recommandation, optimisant ainsi le coût par unité de bande passante mémoire.FuTu News+1
Le MI455X standard, construit sur le processus 2 nm de TSMC avec un emballage à liaison hybride, représente le plafond actuel en matière d'emballage GPU et de densité de mémoire. La variante personnalisée sacrifie cette marge pour servir des charges de travail que Meta exécute à une échelle énorme, mais qui diffèrent radicalement des tâches d'entraînement et d'inférence de grands modèles de langage, désormais au cœur de l'industrie de l'IA.FuTu News
SemiAnalysis a qualifié la décision de "catastrophique" et a pris la mesure rare d'exhorter publiquement AMD à travailler directement avec TBD Lab, la division de recherche en superintelligence de Meta dirigée par Alexandr Wang, plutôt qu'avec l'organisation d'infrastructure de Meta. Le cabinet a fait valoir que la puce réduite présente peu d'intérêt pour les ingénieurs de TBD Lab, qui "privilégieraient fortement" l'architecture Vera Rubin de Nvidia à la place.LinkedIn+1
Cette critique s'inscrit dans une tendance plus large identifiée par SemiAnalysis dans les choix matériels de Meta. Le cabinet a cité le serveur Ariel de l'entreprise, une configuration personnalisée GB200 avec un rapport CPU-GPU de un pour un, qui affichait un coût total de possession 14 % plus élevé que la conception standard NVL72, comme un autre exemple où les priorités des systèmes de recommandation l'emportent sur les besoins des équipes d'IA générative. Meta est depuis revenu à une configuration standard pour ses serveurs GB300, une reconnaissance implicite de l'échec de l'approche personnalisée.FuTu News
La puce personnalisée s'inscrit dans un accord plus large de cinq ans, annoncé en février, en vertu duquel AMD fournira jusqu'à six gigawatts de GPU Instinct à Meta dans le cadre d'un contrat évalué à 60 milliards de dollars. AMD a émis à Meta un bon de souscription basé sur la performance pour 160 millions d'actions, soit potentiellement 10 % du capital du fabricant de puces, avec des droits acquis liés aux jalons de livraison. Le premier gigawatt de matériel basé sur le MI450 devrait commencer à être livré au cours du second semestre 2026.Jon Peddie Research+1
SemiAnalysis a averti que si la conception réduite reste le principal déploiement AMD de Meta, cela pourrait miner le volume d'AMD au sein de l'entreprise et limiter la capacité de Mark Zuckerberg à louer la capacité excédentaire à des clients extérieurs.LinkedIn