Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cerebras.ai+1cerebras.ai+1Business Insider+1AMD Advanced Micro Devices, Inc. et Cerebras Systems ont annoncé un partenariat technique mardi pour bâtir une plateforme d'inférence IA désagrégée combinant l'infrastructure à l'échelle du rack Helios d'AMD avec la technologie Wafer-Scale Engine de Cerebras. Les entreprises ont indiqué que le système combiné devrait offrir jusqu'à cinq fois plus de jetons par seconde et par watt par rapport à une configuration utilisant uniquement le WSE de Cerebras, selon des modélisations internes menées en juillet 2026.cerebras.ai+1
L'offre conjointe attribue différentes portions d'une charge de travail d'inférence au matériel le mieux adapté à chaque étape. AMD Helios gérera le traitement de pré-remplissage à haut débit, l'étape la plus intensive en calcul consistant à lire l'invite d'un utilisateur, tandis que la technologie WSE de Cerebras gérera la génération de jetons, là où ses avantages en matière de largeur de bande mémoire sont les plus prononcés.Investing.com+1
La plateforme devrait être disponible via Cerebras Cloud au second semestre 2026.cerebras.ai+1
Cette annonce a été faite lors de la allocution principale de la PDG d'AMD, Lisa Su, à l'événement Advancing AI 2026 de l'entreprise à San Francisco le 23 juillet. Business Insider a rapporté que ce partenariat reflète le pari global d'AMD selon lequel l'inférence désagrégée, qui consiste à répartir les charges de travail d'IA sur du matériel spécialisé plutôt que de tout exécuter sur une seule puce, représente la prochaine phase de l'infrastructure IA.Business Insider+2
Cette approche a gagné du terrain dans toute l'industrie. AWS et Cerebras ont annoncé une collaboration similaire en mars 2026, associant les puces Trainium d'Amazon pour le pré-remplissage au matériel de Cerebras pour le décodage sur Amazon Bedrock. Nvidia a acquis Groq pour adopter une architecture comparable. UBS a écrit en juin que les limites des systèmes actuels "incitent à un passage vers l'inférence désagrégée", selon Business Insider.youtube+2
L'accord avec Cerebras est intervenu au milieu d'une série d'annonces lors d'Advancing AI 2026. AMD a dévoilé son système complet de rack Helios, qui regroupe 72 accélérateurs Instinct MI455X avec 31 To de mémoire HBM4 et délivre environ trois exaflops d'IA par rack. Lisa Su a affirmé qu'Helios offre jusqu'à 30% de jetons d'inférence en plus par dollar que le rack Vera Rubin NVL72 de Nvidia.DCDNoticias+2
AMD a également annoncé un partenariat d'infrastructure de plusieurs milliards de dollars avec Anthropic la veille, s'ajoutant aux relations existantes avec OpenAI, Meta , Microsoft et Oracle .Business Insider
Pour Cerebras, l'accord avec AMD prolonge une série de partenariats majeurs suite à son introduction en bourse plus tôt cette année, qui a permis de lever 6,4 milliards de dollars lors de ce que l'entreprise a qualifié de plus grande introduction en bourse de semi-conducteurs de tous les temps. Cerebras alimente déjà le modèle GPT-5.4 d'OpenAI dans le cadre d'un accord multimilliardaire signé en janvier.The New York Times+2