Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1nvidianews.nvidia+1cnbcNvidia pirmadienį paskelbė, kad jos Groq 3 LPX specializuotas DI išvadų spartintuvas pradėtas gaminti pilnu pajėgumu, taip komercializuojant technologiją iš didžiausio bendrovės istorijoje įsigijimo. Lustas, sukurtas itin greitam žetonų generavimui agentinio DI užduotims, vėliau šiais metais bus diegiamas pas „neocloud“ tiekėją Nebius.
Šis pranešimas, paskelbtas „Hot Chips 2026“ konferencijoje Palo Alto mieste, Kalifornijoje, pasirodė Nvidia ruošiantis trečiadienį skelbti savo finansinius rezultatus.cnbc
„Artificial Analysis“ atliktuose testuose Groq 3 LPX stelažas pasiekė 3 400 išvesties žetonų per sekundę greitį, vykdant „Google“ atvirojo kodo „Gemma 4 31B“ modelį su 100 000 žetonų konteksto langu. Tai yra didžiausias kada nors užfiksuotas šio modelio našumas. Nvidia teigia, kad dėl to sistema yra keturis kartus jautresnė delsai jautrioms užduotims nei artimiausia alternatyvi platforma.nvidianews.nvidia+1
Stelaže sumontuoti 256 atskiri Groq 3 lustai, kurių kiekvienas turi 500 megabaitų SRAM atminties tiesiogiai luste, kad būtų sumažinti atminties pralaidumo trikdžiai. Lustus gamina „Samsung“, o „Taiwan Semiconductor Manufacturing“ gamina Nvidia GPU.cnbc
„Tai nėra GPU pakeitimas“, – žurnalistams sakė Nvidia vyresnysis direktorius Dionas Harrisas. „Tai apie tinkamą kainą ir tinkamą procesorių tinkamai darbo daliai.“cnbc
Nvidia gruodį įsigijo startuolio Groq turtą už 20 mlrd. dolerių, o sandorio dalimi tapo ir įkūrėjo Jonathano Rosso bei prezidento Sunny Madros įdarbinimas. Groq architektūra orientuojasi tik į išvadas (inference), o ne į mokymą, taikantis į DI modelių aptarnavimo „dekodavimo“ fazę, kurioje delsa yra svarbiausia.siliconangle
Konkurencinė aplinka intensyvėja. „Advanced Micro Devices“ anksčiau šiais metais paskelbė, kad integruos stelažo masto sistemas su „Cerebras“ lustais mažos delsos išvadoms, o „OpenAI“ „Ultrafast“ režimas žada 750 žetonų per sekundę greitį, naudojant „Cerebras“ technologiją.cnbc
Kartu su Groq 3 LPX pristatymu, Nvidia atskleidė, kad „SpaceXAI“ pasirašė sutartį dėl Nvidia „Vera“ CPU diegimo. Bendrovė teigia, kad tai pirmasis procesorius, sukurtas specialiai DI agentams, skirtas paspartinti orkestravimą, įrankių vykdymą ir modeliavimo užduotis tiek antžeminiuose duomenų centruose, tiek orbitiniuose palydovuose.blogs.nvidia+1
„Vera Rubin išplečia šią viziją su darbo krūviui optimizuotomis DI gamyklų konfigūracijomis, sukurtomis agentinio DI erai“, – sakė generalinis direktorius Jensenas Huangas.nvidianews.nvidia
„Nebius“ technologijų vadovas Danila Shtanas teigė, kad bendrovė planuoja integruoti Groq 3 LPX į savo „Token Factory“ išvadų platformą. „Užtikriname, kad kiekvienas agento ciklo žingsnis vyktų akimirksniu“, – sakė Shtanas.nvidianews.nvidia