Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

coreweave+1news.bmsnvidianews.nvidia+1NVIDIA Corporation:s rack-skalerbara AI-plattform Vera Rubin NVL72 närmar sig snabbt bred kommersiell tillgänglighet. CoreWeave har publicerat de första uppmätta prestandaresultaten och Bristol Myers Squibb har meddelat planer på att använda arkitekturen för läkemedelsforskning.
CoreWeave publicerade på söndagen benchmark-data som visar att Vera Rubin NVL72 genererade 10 gånger högre tokengenomströmning per megawatt jämfört med föregående generation NVIDIA GB200 NVL72 vid körning av DeepSeek:s R1-resonemangsmodell med matchade interaktivitetsmål. Testet använde avancerade inferensoptimeringar, inklusive expertparallellisering, NVFP4-precision, förutsägelse av flera tokens samt disaggregerad prefill och avkodning. Vid full skala producerade ett Vera Rubin NVL72-rack cirka 800 000 tokens per sekund med samma effektförbrukning som ett Grace Blackwell-system som hanterade 80 000, enligt rapporter från WCCFTech.wccftech+1
Samma dag meddelade Bristol Myers Squibb att de kommer att driftsätta en andra NVIDIA DGX SuperPOD byggd på åtta DGX Vera Rubin NVL72-system, vilket de beskriver som den mest kraftfulla AI-beräkningsinfrastrukturen inom life science-branschen. Företaget uppger att plattformen kommer att hjälpa forskare att utvärdera större kemiska utrymmen, köra mer komplexa molekylära förutsägelser och korta ner forskningstider. Enligt NVIDIAs blogg kan BMS bli det första biofarmaceutiska företaget i världen att driva Vera Rubin-arkitekturen.pulse2+2
CoreWeave slutförde branschens första driftsättning och validering av Vera Rubin NVL72 vid sin anläggning i Livingston, New Jersey, den 1 juni, med hjälp av Dell Technologies PowerEdge XE9812-serverplattform. Racket innehåller 72 Rubin-GPU:er och 36 Vera-CPU:er sammankopplade via en 260 TB/s NVLink 6-fabric.mlq+2
NVIDIA:s VD Jensen Huang bekräftade först att plattformen var i full produktion under sitt huvudtal på CES 2026 i januari, och företaget upprepade senare under Computex att produktionsleveranserna skulle påbörjas under hösten 2026. Molnpartner som Google Cloud , Microsoft Azure och Oracle Cloud Infrastructure förväntas erbjuda Vera Rubin-instanser under andra halvåret i år.hashrateindex+4
Plattformen integrerar sju samdesignade chip som spänner över beräkning, nätverk, lagring och säkerhet, och är utformad för agentiska AI-arbetsbelastningar där resonemangsmodeller genererar betydligt fler tokens per fråga än konventionell inferens.coreweave+1