Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cerebras.ai+1cerebras.ai+1Business Insider+1AMD Advanced Micro Devices, Inc. og Cerebras Systems kunngjorde et teknisk partnerskap på tirsdag for å bygge en oppdelt KI-infernensplattform som kombinerer AMDs Helios-infrastruktur på rack-nivå med Cerebras' Wafer-Scale Engine-teknologi. Selskapene opplyste at det kombinerte systemet er forventet å levere opptil fem ganger flere tokens per sekund per watt sammenlignet med en oppsett kun bestående av Cerebras WSE, basert på intern modellering utført i juli 2026.cerebras.ai+1
Den felles løsningen tildeler ulike deler av en inferensarbeidsmengde til maskinvaren som egner seg best for hvert trinn. AMD Helios vil håndtere prefill-prosessering med høy gjennomstrømning, som er det dataintensive steget med å lese en brukers ledetekst, mens Cerebras' WSE-teknologi håndterer token-generering, der fordelene med minnebåndbredde er mest fremtredende.Investing.com+1
Plattformen er planlagt å bli tilgjengelig gjennom Cerebras Cloud i andre halvår av 2026.cerebras.ai+1
Kunngjøringen ble gjort under hovedtalen til AMD-sjef Lisa Su på selskapets Advancing AI 2026-arrangement i San Francisco den 23. juli. Business Insider rapporterte at partnerskapet gjenspeiler AMDs bredere satsing på at oppdelt inferens, det vil si å dele opp KI-arbeidsmengder på tvers av spesialisert maskinvare i stedet for å kjøre alt på en enkelt brikke, representerer neste fase av KI-infrastrukturen.Business Insider+2
Tilnærmingen har fått fotfeste i hele bransjen. AWS og Cerebras kunngjorde et lignende samarbeid i mars 2026, der Amazons Trainium-brikker for prefill ble paret med Cerebras-maskinvare for dekoding på Amazon Bedrock. Nvidia kjøpte opp Groq for å forfølge en sammenlignbar arkitektur. UBS skrev i juni at begrensninger i dagens systemer driver et skifte mot oppdelt inferens, ifølge Business Insider.youtube+2
Cerebras-avtalen kom midt i en rekke kunngjøringer på Advancing AI 2026. AMD avduket sitt helhetlige Helios-racksystem, som samler 72 Instinct MI455X-akseleratorer med 31 TB HBM4-minne og leverer omtrent tre KI-exaflops per rack. Su hevdet at Helios leverer opptil 30 prosent flere inferens-tokens per dollar enn Nvidias Vera Rubin NVL72-rack.DCDNoticias+2
AMD kunngjorde også et infrastrukturpartnerskap verdt milliarder av dollar med Anthropic dagen før, i tillegg til eksisterende relasjoner med OpenAI, Meta , Microsoft og Oracle .Business Insider
For Cerebras utvider AMD-avtalen en rekke store partnerskap etter børsnoteringen tidligere i år, som hentet inn 6,4 milliarder dollar i det selskapet omtalte som tidenes største halvlederbørsnotering. Cerebras driver allerede OpenAIs GPT-5.4-modell under en milliardavtale som ble signert i januar.The New York Times+2