Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1Nye testdata fra SemiAnalysis-plattformen InferenceX viser at akseleratoren Instinct MI355X fra AMD (Advanced Micro Devices, Inc. ) kjører Moonshot AIs Kimi K3-modell med 2,8 billioner parametere til en lavere kostnad per token enn Nvidias B300. Dette gir AMD nye argumenter i kappløpet om KI-brikker for datasentre, bare dager før selskapet legger frem sine tall for andre kvartal.
InferenceX-plattformen, en leverandørnøytral ytelsestest med åpen kildekode som kontinuerlig måler ytelsen til KI-inferens på tvers av GPU-er og programvarestabler, publiserte testresultater fra dag én for Kimi K3 på de nyeste Nvidia- og AMD-GPU-ene. Ifølge rapportering om resultatene kjører MI355X Kimi K3 til under halvparten av timeprisen for skyleie sammenlignet med B300. Forskjellen skyldes i stor grad at MI355X har en betydelig lavere pris per GPU-time i markedet. Skyleverandører tilbyr for tiden MI355X-instanser fra rundt 2,50 dollar per GPU-time, sammenlignet med omtrent 6,00 dollar for B300.news.ycombinator+4
Kimi K3, som ble lansert av Beijing-baserte Moonshot AI den 16. juli, er en Mixture-of-Experts-modell med totalt 2,8 billioner parametere og et kontekstvindu på én million tokens. Modellens enorme størrelse, som krever 288 GB HBM per GPU, gjør at den ikke får plass på Nvidias eldre B200-noder med FP4-presisjon. Dette begrenser bruken til B300-, GB300 NVL72- eller MI355X-systemer. Denne maskinvarebegrensningen skaper i praksis en direkte sammenligning mellom AMDs og Nvidias nyeste 288 GB-akseleratorer.amd+3
Kimi K3-resultatet bygger videre på et mønster som også var synlig i SemiAnalysis' tidligere InferenceX-sammenligninger. På den mindre Kimi K2.6-modellen leverte B300 29 prosent høyere ren råytelse per GPU, men MI355X var 23 prosent billigere per token. En tilsvarende dynamikk var synlig på MiniMax M3, der MI355X var 24 prosent billigere per token til tross for lavere absolutt ytelse. En uavhengig evaluering utført av Signal65 i juli viste at MI355X oppnådde 1,4 til 2,1 ganger flere tokens per dollar enn B200 på tvers av flere modeller.signal65+2
Tidspunktet er merkbart. AMD legger frem sine resultater for andre kvartal 2026 den 4. august, der konsensusforventningene ligger på omtrent 11,2 milliarder dollar i inntekter, noe som tilsvarer en vekst på 46 prosent sammenlignet med samme periode i fjor. Datasentersegmentet, som nådde 5,8 milliarder dollar i første kvartal på grunn av vedvarende Instinct-GPU-leveranser, er i hovedfokus for investorene. Wedbush oppjusterte nylig sitt inntektsestimat for 2026 til 49,2 milliarder dollar, med henvisning til raskere vekst i datasentersegmentet enn ventet.seekingalpha+3
Om ytelsestester for inferenskostnader omsettes til økte markedsandeler, er fremdeles det sentrale spørsmålet. Nvidias B300 leder fortsatt på ren råytelse, og selskapets CUDA-programvareøkosystem står sterkt forankret i bedriftsmarkedet. Men etter hvert som åpne modeller som Kimi K3 presser maskinvarekravene til det ytterste, gir AMDs prisfordel storskala aktører og skyleverandører et fristende alternativ.