Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1nvidianews.nvidia+1cnbcNvidia ilmoitti maanantaina, että sen dedikoitu tekoälyn päättelykiihdytin Groq 3 LPX on siirtynyt täyteen tuotantoon, mikä merkitsee yhtiön historian suurimman yrityskaupan teknologian kaupallistamista. Piiri, joka on suunniteltu tarjoamaan erittäin nopeaa token-generointia agentti-tekoälytyökuormille, otetaan käyttöön neocloud-palveluntarjoaja Nebiusilla myöhemmin tänä vuonna.
Ilmoitus tehtiin Hot Chips 2026 -konferenssissa Palo Altossa, Kaliforniassa, samaan aikaan kun Nvidia valmistautuu julkaisemaan tuloksensa keskiviikkona.cnbc
Artificial Analysisin suorittamissa testeissä Groq 3 LPX -räkki saavutti 3 400 ulostulotokenia sekunnissa ajettaessa Googlen avoimen lähdekoodin Gemma 4 31B -mallia 100 000 tokenin konteksti-ikkunalla, mikä on nopein kyseiselle mallille koskaan kirjattu suorituskyky. Nvidia väittää, että tämä tekee siitä neljä kertaa responsiivisemman latenssiherkissä työkuormissa kuin lähin vaihtoehtoinen alusta.nvidianews.nvidia+1
Räkki sisältää 256 yksittäistä Groq 3 -piiriä, joista jokaisessa on 500 megatavua sirun sisäistä SRAM-muistia muistipullonkaulojen vähentämiseksi. Piirit valmistaa Samsung, kun taas Taiwan Semiconductor Manufacturing valmistaa Nvidian GPU-piirit.cnbc
"Tässä ei ole kyse GPU-piirien korvaamisesta", Nvidian johtaja Dion Harris kertoi toimittajille. "Kyse on oikean hinnan ja oikean prosessorin käyttämisestä työkuorman oikeaan osaan."cnbc
Nvidia hankki startup-yritys Groqin varat joulukuussa 20 miljardilla dollarilla ja palkkasi perustaja Jonathan Rossin sekä toimitusjohtaja Sunny Madran osana sopimusta. Groq-arkkitehtuuri keskittyy yksinomaan päättelyyn koulutuksen sijaan, kohdistuen tekoälymallien "dekoodausvaiheeseen", jossa latenssi on kriittisin tekijä.siliconangle
Kilpailutilanne kiristyy. Advanced Micro Devices ilmoitti aiemmin tänä vuonna integroivansa räkkitason järjestelmiä Cerebrasin piireillä matalan latenssin päättelyä varten, kun taas OpenAI:n Ultrafast-tila lupaa 750 tokenia sekunnissa Cerebrasin voimin.cnbc
Groq 3 LPX -julkistuksen ohella Nvidia paljasti, että SpaceXAI on allekirjoittanut sopimuksen Nvidia Vera -suorittimien käyttöönotosta. Yhtiö kutsuu niitä ensimmäisiksi erityisesti tekoälyagenteille rakennetuiksi suorittimiksi, joiden tarkoituksena on nopeuttaa orkestrointia, työkalujen suoritusta ja simulointitehtäviä maapohjaisista konesaleista kiertoradalla oleviin satelliitteihin.blogs.nvidia+1
"Vera Rubin laajentaa tätä visiota työkuormille optimoiduilla tekoälytehdaskonfiguraatioilla, jotka on suunniteltu agentti-tekoälyn aikakaudelle", toimitusjohtaja Jensen Huang sanoi.nvidianews.nvidia
Nebiusin teknologiajohtaja Danila Shtan kertoi yhtiön suunnittelevan Groq 3 LPX:n integroimista Token Factory -päättelyalustaansa. "Varmistamme, että jokainen agentin silmukan vaihe tuntuu välittömältä", Shtan sanoi. Päättelyyn keskittyvä Groq-pilvi aikoo seurata perässä yhtenä alustan varhaisimmista käyttäjistä.nvidianews.nvidia