Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cerebras.ai+1cerebras.ai+1Business Insider+1AMD Advanced Micro Devices, Inc. och Cerebras Systems tillkännagav ett tekniskt partnerskap på tisdagen för att bygga en uppdelad AI-inferensplattform som kombinerar AMD:s Helios-infrastruktur på racknivå med Cerebras Wafer-Scale Engine-teknologi. Bolagen uppgav att det kombinerade systemet förväntas leverera upp till fem gånger fler tokens per sekund och watt jämfört med en konfiguration enbart baserad på Cerebras WSE, baserat på interna beräkningar från juli 2026.cerebras.ai+1
Den gemensamma lösningen tilldelar olika delar av en inferensarbetslåt till den hårdvara som lämpar sig bäst för respektive steg. AMD Helios kommer att hantera förbearbetning med hög genomströmning, det vill säga det beräkningstunga steget att läsa en användares kommando, medan Cerebras WSE-teknologi hanterar tokengenerering där dess fördelar med minnesbandbredd märks som mest.Investing.com+1
Plattformen planeras bli tillgänglig via Cerebras Cloud under andra halvåret 2026.cerebras.ai+1
Tillkännagivandet gjordes under AMD-vd:n Lisa Sus anförande på företagets Advancing AI 2026-evenemang i San Francisco den 23 juli. Business Insider rapporterade att partnerskapet återspeglar AMD:s bredare satsning på att uppdelad inferens, det vill säga att dela upp AI-arbetslaster på specialiserad hårdvara i stället för att köra allt på ett enda chip, utgör nästa fas av AI-infrastrukturen.Business Insider+2
Tillvägagångssättet har vunnit mark i hela branschen. AWS och Cerebras tillkännagav ett liknande samarbete i mars 2026 där Amazons Trainium-chip för förbearbetning parades ihop med Cerebras hårdvara för avkodning på Amazon Bedrock. Nvidia förvärvade Groq för att följa en liknande arkitektur. UBS skrev i juni att begränsningar i nuvarande system driver på en förändring mot uppdelad inferens, enligt Business Insider.youtube+2
Cerebras-affären kom mitt i en våg av tillkännagivanden under Advancing AI 2026. AMD visade upp sitt kompletta Helios-racksystem som samlar 72 Instinct MI455X-acceleratorer med 31 TB HBM4-minne och levererar ungefär tre AI-exaflops per rack. Su hävdade att Helios levererar upp till 30 procent fler inferens-tokens per dollar än Nvidias Vera Rubin NVL72-rack.DCDNoticias+2
AMD tillkännagav även ett mångmiljardpartnerskap inom infrastruktur med Anthropic dagen innan, vilket bygger vidare på befintliga relationer med OpenAI, Meta , Microsoft och Oracle .Business Insider
För Cerebras innebär affären med AMD en fortsättning på en rad tunga partnerskap efter bolagets börsintroduktion tidigare i år, vilken inbringade 6,4 miljarder dollar i det bolaget beskrev som tidernas största halvledarbörsnotering. Cerebras driver redan OpenAIs modell GPT-5.4 genom ett mångmiljardavtal som undertecknades i januari.The New York Times+2