Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

blogs.nvidia+1blogs.nvidiapulse2Nvidia släppte på måndagen prestandadata som visar att deras nästa generations plattform Vera Rubin NVL72 levererar upp till 30 gånger högre inferensgenomströmning per megawatt än det nuvarande GB300 NVL72-systemet för agentbaserade AI-laster, samtidigt som kostnaden per miljon tokens sänks med upp till 35 gånger. Företaget presenterade samtidigt arkitekturen för sin nya Vera-CPU vid konferensen Hot Chips 2026 och introducerade Scale-In som en femte pelare i sin AI-nätverksinfrastruktur.
Genomströmningssiffrorna mättes med hjälp av SemiAnalysis AgentX-benchmark, som fångar upp verkliga agentbaserade kodningssessioner inklusive kontexttillväxt, verktygsanrop och skapande av underagenter. Vid körning av DeepSeek V4 Pro-modellen uppnådde Vera Rubin NVL72 en 30-faldig förbättring jämfört med GB300 NVL72, som i sig levererar upp till 15 gånger bättre genomströmning per megawatt än den tidigare Hopper-arkitekturen. Resultaten inväntar granskning från SemiAnalysis och återspeglar ännu inte Vera-CPU-prestanda för verktygsanrop.blogs.nvidia+1
Vinsterna är betydande eftersom agentbaserade arbetslaster förbrukar ungefär 15 gånger fler tokens än en enkel chattförfrågan, enligt data från OpenRouter som citeras av Nvidia. I kombination med Nvidias DSX MaxLPS-strömstyrningsteknik, som kan allokera upp till 40 procent fler GPU:er inom samma megawattbudget, adresserar plattformen en grundläggande begränsning för operatörer av AI-datacenter: hur mycket användbart arbete varje tillgänglig megawatt kan leverera.developer.nvidia+1
Vid Hot Chips 2026 detaljerade Nvidia Vera-CPU:ns design med 88 kärnor, byggd på deras anpassade Olympus-kärnarkitektur. Chippet prioriterar prestanda per tråd och låg latens framför antal kärnor, vilket är ett avsteg från branschtrenden mot svagare men fler kärnor. Vera har en 10-bred avkodnings-front-end, spatial flertrådshantering, åtta LPDDR5X-minneskontroller som levererar upp till 1,2 TB/s bandbredd, samt en konstruktion med sex chiplet-enheter med NVLink-C2C-sammankoppling.nvidianews.nvidia+1
"Agentbaserad AI kräver en ny typ av datorsystem, ett som är byggt inte bara för att generera svar, utan för att vidta åtgärder", sade Ian Buck, vice vd för hyperscale och högpresterande beräkningar hos Nvidia.nvidianews.nvidia
Nvidia introducerade även Scale-In-nätverksinfrastruktur som den femte pelaren i sitt AI-nätverk, drivet av BlueField-4 DPU:er och designat för att säkra, hantera och driva agentbaserade AI-fabriker i stor skala. Tillkännagivandet kompletterar Nvidias befintliga pelare för Scale-Up, Scale-Out, Scale-Across och lagringsnätverk.developer.nvidia
I ett separat tillkännagivande meddelade SpaceXAI att de kommer att distribuera Vera-CPU:er över sin AI-infrastruktur för Grok och planerar att utöka ett optimerat Vera Rubin NVL72-system i omloppsbana ombord på sin första generations Starmind AI-satellit.nvidianews.nvidia