Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

blogs.nvidia+1blogs.nvidiapulse2Nvidia julkaisi maanantaina suorituskykytietoja, joiden mukaan sen seuraavan sukupolven Vera Rubin NVL72 -alusta tarjoaa jopa 30 kertaa suuremman päättelykapasiteetin megawattia kohden kuin nykyinen GB300 NVL72 -järjestelmä agenttipohjaisissa tekoälytyökuormissa, samalla kun se leikkaa miljoonaa tokenia kohden laskettavia kustannuksia jopa 35-kertaisesti. Yhtiö esitteli samalla uuden Vera-suorittimensa arkkitehtuurin Hot Chips 2026 -konferenssissa ja toi Scale-In-ratkaisun tekoälyverkkoinfrastruktuurinsa viidenneksi pilariksi.
Kapasiteettiväitteet mitattiin SemiAnalysis AgentX -vertailutestillä, joka tallentaa todellisia agenttipohjaisia koodausistuntoja, mukaan lukien kontekstin kasvun, työkalukutsut ja aliagenttien luomisen. DeepSeek V4 Pro -mallia ajettaessa Vera Rubin NVL72 saavutti 30-kertaisen parannuksen verrattuna GB300 NVL72 -järjestelmään, joka puolestaan tarjoaa jopa 15 kertaa paremman kapasiteetin megawattia kohden kuin aiempi Hopper-arkkitehtuuri. Tulokset odottavat SemiAnalysis-arviointia eivätkä vielä heijasta Vera-suorittimen suorituskykyä työkalukutsuissa.blogs.nvidia+1
Nämä parannukset ovat merkittäviä, koska agenttipohjaiset työkuormat kuluttavat Nvidian lainaamien OpenRouter-tietojen mukaan noin 15 kertaa enemmän tokeneita kuin yksinkertainen chat-pyyntö. Yhdessä Nvidian DSX MaxLPS -virranhallintateknologian kanssa, joka voi varata jopa 40 prosenttia enemmän grafiikkasuorittimia saman megawattibudjetin sisällä, alusta vastaa tekoälypalvelinkeskusten operaattoreiden kohtaamaan perustavanlaatuiseen rajoitteeseen: kuinka paljon hyödyllistä työtä kukin käytettävissä oleva megawatti voi tuottaa.developer.nvidia+1
Hot Chips 2026 -konferenssissa Nvidia esitteli Vera-suorittimen 88-ytimisen rakenteen, joka perustuu yhtiön omaan Olympus-ydinarkkitehtuuriin. Siru priorisoi yhden säikeen suorituskykyä ja pientä viivettä ydinten määrän sijaan, mikä on poikkeama alan trendistä kohti heikompia mutta lukuisampia ytimiä. Verassa on 10-leveyksinen dekoodauksen etupää, spatiaalinen monisäikeistys, kahdeksan LPDDR5X-muistiohjainta, jotka tarjoavat jopa 1,2 Tt/s kaistanleveyden, sekä kuuden piisirun rakenne NVLink-C2C-yhteydellä.nvidianews.nvidia+1
"Agenttipohjainen tekoäly vaatii uudenlaisen tietojärjestelmän, joka on rakennettu paitsi tuottamaan vastauksia, myös toimimaan", sanoi Ian Buck, Nvidian hyperscale- ja korkean suorituskyvyn laskennan varatoimitusjohtaja.nvidianews.nvidia
Nvidia esitteli myös Scale-In-verkkoinfrastruktuurin tekoälyverkkonsa viidenneksi pilariksi. Se saa virtansa BlueField-4 DPU-yksiköistä ja on suunniteltu suojaamaan, hallitsemaan ja käyttämään agenttipohjaisia tekoälytehtaita laajassa mittakaavassa. Julkistus täydentää Nvidian olemassa olevia Scale-Up-, Scale-Out-, Scale-Across- ja tallennusverkkopilareita.developer.nvidia
Erillisessä tiedotteessa SpaceXAI ilmoitti ottavansa Vera-suorittimet käyttöön tekoälyinfrastruktuurissaan Grok-mallia varten ja suunnittelevansa optimoidun Vera Rubin NVL72 -järjestelmän viemistä kiertoradalle ensimmäisen sukupolven Starmind-tekoälysatelliitissaan.nvidianews.nvidia