Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1De nouvelles données de référence issues de la plateforme InferenceX de SemiAnalysis montrent que le GPU Instinct MI355X d'Advanced Micro Devices, Inc. fait tourner le modèle Kimi K3 de Moonshot AI (2 800 milliards de paramètres) à un coût par jeton inférieur à celui de la B300 de Nvidia , offrant à AMD de nouveaux arguments dans la course aux puces IA pour centres de données, à quelques jours de la publication de ses résultats du deuxième trimestre.
La plateforme InferenceX, un outil de référence open source et neutre qui mesure en continu les performances d'inférence IA sur l'ensemble des GPU et des piles logicielles, a publié des tests préliminaires pour Kimi K3 sur les derniers GPU de Nvidia et d'AMD. Selon les rapports sur ces résultats, le MI355X fait tourner Kimi K3 pour moins de la moitié du coût horaire de location cloud de la B300, un écart principalement expliqué par des tarifs horaires par GPU nettement plus bas pour le MI355X sur le marché. Les fournisseurs de cloud proposent actuellement des instances MI355X à partir d'environ 2,50 $ par heure-GPU, contre environ 6,00 $ pour la B300.news.ycombinator+4
Kimi K3, lancé le 16 juillet par la société pékinnoise Moonshot AI, est un modèle de type mélange d'experts (Mixture-of-Experts) comptant 2 800 milliards de paramètres au total et une fenêtre de contexte d'un million de jetons. Sa taille imposante, qui nécessite 288 Go de HBM par GPU, l'empêche de tourner sur les nœuds B200 plus anciens de Nvidia en précision FP4, ce qui limite son déploiement aux systèmes B300, GB300 NVL72 ou MI355X. Cette contrainte matérielle crée une confrontation directe entre les derniers accélérateurs de 288 Go d'AMD et de Nvidia.amd+3
Ce résultat sur Kimi K3 s'inscrit dans la continuité d'une tendance observée lors des précédents tests InferenceX de SemiAnalysis. Sur le modèle plus réduit Kimi K2.6, la B300 affichait un débit brut supérieur de 29 % par GPU, mais le MI355X était 23 % moins cher par jeton. Une dynamique similaire a été observée sur MiniMax M3, où le MI355X était 24 % moins cher par jeton malgré un débit absolu inférieur. Une évaluation indépendante menée par Signal65 en juillet a révélé que le MI355X générait 1,4 à 2,1 fois plus de jetons par dollar que la B200 sur plusieurs modèles.signal65+2
Le calendrier est particulièrement remarquable. AMD doit publier ses résultats du deuxième trimestre 2026 le 4 août, avec un consensus qui table sur un chiffre d'affaires d'environ 11,2 milliards de dollars, soit une croissance de 46 % sur un an. Le segment des centres de données, qui a atteint 5,8 milliards de dollars au premier trimestre grâce aux livraisons continues de GPU Instinct, est au cœur de l'attention des investisseurs. Wedbush a récemment relevé ses prévisions de chiffre d'affaires pour 2026 à 49,2 milliards de dollars, invoquant une croissance plus rapide que prévu dans les centres de données.seekingalpha+3
La question centrale reste de savoir si ces tests de coût d'inférence se traduiront par des gains de parts de marché. La B300 de Nvidia conserve son avance en matière de débit brut, et son écosystème logiciel CUDA reste profondément ancré dans les entreprises. Toutefois, alors que les modèles à poids ouverts comme Kimi K3 poussent les exigences matérielles dans leurs retranchements, l'avantage tarifaire d'AMD offre aux géants du cloud une alternative particulièrement attractive.