Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

blogs.nvidia+1blogs.nvidiapulse2„Nvidia“ pirmadienį paskelbė našumo duomenis, rodančius, kad jos naujos kartos „Vera Rubin NVL72“ platforma, vykdant agentines DI užduotis, užtikrina iki 30 kartų didesnį išvadų pralaidumą vienam megavatui nei dabartinė „GB300 NVL72“ sistema, kartu sumažindama milijono žetonų kainą iki 35 kartų. Bendrovė „Hot Chips 2026“ konferencijoje pristatė naujojo „Vera CPU“ architektūrą ir „Scale-In“ kaip penktąjį savo DI tinklo infrastruktūros ramstį.
Pralaidumo rodikliai buvo išmatuoti naudojant „SemiAnalysis AgentX“ testą, kuris fiksuoja realias agentines programavimo sesijas, įskaitant konteksto augimą, įrankių iškvietimus ir subagentų kūrimą. Vykdant „DeepSeek V4 Pro“ modelį, „Vera Rubin NVL72“ pasiekė 30 kartų geresnį rezultatą nei „GB300 NVL72“, kuri pati užtikrina iki 15 kartų geresnį pralaidumą vienam megavatui nei ankstesnė „Hopper“ architektūra. Rezultatai laukia „SemiAnalysis“ peržiūros ir dar neatspindi „Vera CPU“ našumo vykdant įrankių iškvietimus.blogs.nvidia+1
Šie pasiekimai svarbūs, nes agentinės užduotys sunaudoja maždaug 15 kartų daugiau žetonų nei paprastos pokalbių užklausos, remiantis „Nvidia“ cituojamais „OpenRouter“ duomenimis. Kartu su „Nvidia“ „DSX MaxLPS“ energijos valdymo technologija, kuri leidžia tame pačiame megavatų biudžete patalpinti iki 40 procentų daugiau GPU, platforma sprendžia esminį DI duomenų centrų operatorių iššūkį: kiek naudingojo darbo gali atlikti kiekvienas turimas megavatas.developer.nvidia+1
„Hot Chips 2026“ konferencijoje „Nvidia“ detaliai pristatė 88 branduolių „Vera CPU“ dizainą, sukurtą naudojant pritaikytą „Olympus“ branduolių architektūrą. Lustas teikia pirmenybę vienos gijos našumui ir mažam vėlinimui, o ne branduolių skaičiui, taip nukrypstant nuo pramonės tendencijos rinktis silpnesnius, bet gausius branduolius. „Vera“ pasižymi 10 krypčių dekodavimo sąsaja, erdviniu daugiagijumi (spatial multithreading), aštuoniais LPDDR5X atminties valdikliais, užtikrinančiais iki 1,2 TB/s pralaidumą, ir šešių kristalų konstrukcija su „NVLink-C2C“ jungtimi.nvidianews.nvidia+1
„Agentiniam DI reikalinga naujo tipo skaičiavimo sistema, sukurta ne tik atsakymams generuoti, bet ir veiksmams atlikti“, – sakė Ianas Buckas, „Nvidia“ hiperskalės ir didelio našumo skaičiavimų viceprezidentas.nvidianews.nvidia
„Nvidia“ taip pat pristatė „Scale-In“ tinklo infrastruktūrą kaip penktąjį savo DI tinklo ramstį, varomą „BlueField-4 DPU“ procesorių ir skirtą saugiai valdyti bei eksploatuoti agentines DI gamyklas dideliu mastu. Šis pranešimas papildo esamus „Nvidia“ „Scale-Up“, „Scale-Out“, „Scale-Across“ ir duomenų saugyklų tinklo ramsčius.developer.nvidia
Atskirame pranešime „SpaceXAI“ teigė, kad diegs „Vera CPU“ savo DI infrastruktūroje, skirtoje „Grok“, ir planuoja iškelti optimizuotą „Vera Rubin NVL72“ sistemą į orbitą savo pirmosios kartos „Starmind“ DI palydove.nvidianews.nvidia