Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1Nya prestandatester från SemiAnalysis plattform InferenceX visar att AMD:s (Advanced Micro Devices, Inc.) GPU Instinct MI355X kör Moonshot AI:s modell Kimi K3 med 2,8 tusen miljarder parametrar till en lägre kostnad per token än Nvidias B300. Det ger AMD nya argument i AI-racet för datacenter bara några dagar före bolagets delårsrapport för det andra kvartalet.
InferenceX, en leverantörsoberoende testplattform med öppen källkod som kontinuerligt mäter AI-inferens över olika GPU:er och mjukvarustackar, har publicerat färska prestandatester för Kimi K3 på de senaste grafikprocessorerna från Nvidia och AMD. Enligt rapporter om resultaten körs Kimi K3 på MI355X till mindre än hälften av molnhyran per timme jämfört med B300, en skillnad som till stor del förklaras av avsevärt lägre timpriser för MI355X på marknaden. Molnleverantörer listar för närvarande MI355X-instanser från cirka 2,50 dollar per GPU-timme, jämfört med drygt 6,00 dollar för B300.news.ycombinator+4
Kimi K3, som lanserades av Pekingsbaserade Moonshot AI den 16 juli, är en Mixture-of-Experts-modell med totalt 2,8 tusen miljarder parametrar och ett kontextfönster på en miljon token. Dess enorma storlek, som kräver 288 GB HBM-minne per GPU, gör att den inte får plats på Nvidias äldre B200-noder vid FP4-precision. Det begränsar användningen till system med B300, GB300 NVL72 eller MI355X. Hårdvarubegränsningen skapar därmed en direkt jämförelse mellan AMD:s och Nvidias senaste acceleratorer på 288 GB.amd+3
Resultatet för Kimi K3 följer ett mönster som synts i tidigare InferenceX-jämförelser från SemiAnalysis. På den mindre modellen Kimi K2.6 levererade B300 29 procent högre rå genomströmning per GPU, men MI355X var 23 procent billigare per token. En liknande dynamik syntes för MiniMax M3, där MI355X var 24 procent billigare per token trots lägre absolut genomströmning. En oberoende utvärdering av Signal65 i juli visade att MI355X genererade 1,4 till 2,1 gånger fler token per dollar än B200 över flera modeller.signal65+2
Tidpunkten är intressant. AMD redovisar sitt resultat för andra kvartalet 2026 den 4 augusti, där konsensus förväntar sig intäkter på cirka 11,2 miljarder dollar, vilket motsvarar en tillväxt på 46 procent jämfört med föregående år. Datacentersegmentet, som nådde 5,8 miljarder dollar under första kvartalet tack vare fortsatt leverans av Instinct-GPU:er, är i fokus för investerarna. Wedbush höjde nyligen sin intäktsprognos för 2026 till 49,2 miljarder dollar och hänvisade till snabbare tillväxt än väntat inom datacenter.seekingalpha+3
Huruvida prestandatester gällande inferenskostnad omvandlas till ökade marknadsandelar återstår att se. Nvidias B300 leder fortfarande när det gäller rå genomströmning, och företagets ekosystem CUDA har ett starkt fäste hos företagskunderna. Men när öppna modeller som Kimi K3 pressar hårdvarukraven till sina gränser ger AMD:s prisfördel molnjättarna och leverantörerna ett starkt alternativ i kalkylen.