Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

thenextwebthenextweb+1dell+1Nvidia bekräftade på måndagen att deras nästa generations AI-plattform Vera Rubin har nått full produktion. Systemen levereras nu till kunder som OpenAI, CoreWeave , Google Cloud, Microsoft Azure , Meta och Dell , enligt en genomgång vid företagets huvudkontor som först rapporterades av Bloomberg.thenextweb
Ian Buck, Nvidias vice vd för accelererad databehandling, uppgav att leveranserna är i full gång och att OpenAI planerar att driftsätta Vera Rubin-system i stor skala under tredje kvartalet. CoreWeave, en av de första molnleverantörerna som tog emot hårdvaran, rapporterade att deras NVL72-rack levererar tio gånger högre token-kapacitet än den tidigare Grace Blackwell-generationen.coreweave+1
Rubin-GPU:n, som utgör hjärtat i plattformen, har 336 miljarder transistorer, 288 GB HBM4-minne med en bandbredd på 22 TB/s och 50 sparse petaflops i NVFP4-inferensprestanda, vilket är fem gånger högre inferenskapacitet än den tidigare Blackwell-arkitekturen. Vera Rubin NVL72, ett system i fullt rackformat som kombinerar 72 Rubin-GPU:er med 36 Vera-CPU:er, använder vätskekylning för att eliminera interna kablar, vilket gör att komponenterna kan packas tätare.tech-insider+3
Nvidia använde även genomgången för att jämföra sin egen Vera-CPU med AMD:s Turin-chip och hävdade nästan dubbelt så hög prestanda vid Python-arbetsbelastningar, ett riktmärke som valts eftersom Python dominerar mjukvarustacken för AI-inferens. Anthropic, Perplexity, SpaceX och Oracle finns bland de tidiga mottagarna tillsammans med OpenAI och CoreWeave.thenextweb
Plattformens leveranskedja omfattar mer än 350 fabriker i 30 länder, med över 150 ekosystempartners bara i Taiwan. Dell var den första systemleverantören som skickade Vera Rubin NVL72 PowerRack-enheter till CoreWeave, och de lyfter fram upp till 10 gånger lägre kostnad per token jämfört med Blackwell för storskalig agentbaserad AI-inferens.investor.nvidia+3
Produktionsmilstolpen följer månader av förberedelser. Jensen Huang deklarerade först att Vera Rubin var i full produktion under Computex i början av juni, och Nvidia presenterade plattformen med sju chip formellt under GTC 2026 i mars. Måndagens genomgång gav de första kundrapporterade prestandasiffrorna, även om oberoende verifiering av uppgifterna återstår.datacenterknowledge+2